{"as_of":"2026-08-17T16:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:998a01a31f6965b9079cda1a6bc16bcb4ef7819b64fe82bd405ad5c03de460bd","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:38:07.585126Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.11604/citation-record","integrity":"/paper/2608.11604/integrity","json":"/paper/2608.11604/citation-record.json","paper":"/paper/2608.11604"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:07.472426Z","title":"Bert4rec: Sequential rec- ommendation with bidirectional encoder representations from transformer","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.472426Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:2787bc1fc18dbd3389f5bb70ae545000ef0c4fad3a8c4229b4b7af9bcb3d5099","observation_id":"f4759258-f5d9-4df3-b92e-45e9bedf0baf","resolution":{"observed_at":"2026-08-16T00:38:07.472426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:08.580534Z","title":null,"venue":null,"work_id":"3e9f7ff3-24df-4486-9eac-e2797cef078b","year":2018},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.476508Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:a211c624ed92d47be67dbb53c1383e356e425d364fd1d53d9eddcfca063e027e","observation_id":"f77ad579-ddd8-4507-aa65-be93eeecf538","resolution":{"observed_at":"2026-08-16T00:38:08.584090Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1205.2618","last_updated":"2012-05-09T18:25:09Z","snapshot_observed_at":"2026-08-15T03:23:25.220336Z","submitted_at":"2012-05-09T18:25:09Z","title":"BPR: Bayesian Personalized Ranking from Implicit Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1205.2618","snapshot_observed_at":"2026-08-16T00:38:07.480194Z","title":"BPR: bayesian personalized ranking from implicit feedback.CoRR, abs/1205.2618, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.480194Z"},"links":{"cited_paper":"/paper/1205.2618","citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:064b1357fe7654e45dd3e71a7815b426a529f0c6618f017af25294cc29a96516","observation_id":"fe4619ee-47a3-4515-8ccb-d305ee0011c6","resolution":{"observed_at":"2026-08-16T00:38:07.480194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:07.484121Z","title":"S3-rec: Self-supervised learning for sequential recommendation with mutual information maximization","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.484121Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:374be29d66e7f3f24b6ee54b2f033ee375bf54bfe2674bc1833a6f06ba2da2de","observation_id":"3bc51d1d-222f-4e86-bce5-4cd7f98b1dbc","resolution":{"observed_at":"2026-08-16T00:38:07.484121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02006","last_updated":"2024-08-04T12:10:51Z","snapshot_observed_at":"2026-08-16T13:28:40.764420Z","submitted_at":"2024-08-04T12:10:51Z","title":"LLaSA: Large Language and E-Commerce Shopping Assistant","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02006","snapshot_observed_at":"2026-08-16T00:38:07.487634Z","title":"Llasa: Large language and e-commerce shopping assistant.CoRR, abs/2408.02006, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.487634Z"},"links":{"cited_paper":"/paper/2408.02006","citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:0e32fe2a3f128d548336237d5429295e60bfb300bc8d11c8e7e53e3ccc07700e","observation_id":"bf63aa3f-9890-4c3c-bea4-c321ea1c45cd","resolution":{"observed_at":"2026-08-16T00:38:07.487634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1551.37041","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:08.372896Z","title":"A shopping agent for addressing subjective product needs","venue":null,"work_id":"ab40a60c-f366-46be-ac94-e1f1192cfb26","year":2025},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.491457Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:7c7e1c6b7daf880e5283b803d1e04d8adda8488b8fa9e533478b67ef35f1bc45","observation_id":"ccf909c6-b8c2-409a-8576-d41f27091aca","resolution":{"observed_at":"2026-08-16T00:38:08.378294Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:07.495002Z","title":"Language model alignment for conversational shop- ping at amazon","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.495002Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:e0890625344c19bee5836f956b21f01e3b4a3004ac12f054ccd25161dee0f38c","observation_id":"fc95dea3-8284-4eed-9c43-db1a51a25e16","resolution":{"observed_at":"2026-08-16T00:38:07.495002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:07.498385Z","title":"In Ee-Peng Lim, Marianne Winslett, Mark Sanderson, Ada Wai-Chee Fu, Jimeng Sun, J","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.498385Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:27d07c3efc7d83c9269f9cb36f0ffb19f3ed834361e82978f63ec0b705e3d1b0","observation_id":"00501b2d-0f5e-4990-9a56-3d02c5c3c7df","resolution":{"observed_at":"2026-08-16T00:38:07.498385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.16994","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:08.166071Z","title":"R2ec: Towards large recommender models with reasoning.CoRR, abs/2505.16994, 2025","venue":null,"work_id":"8e5c2cfa-a01f-4f4a-aac3-27ea7c9bf0f8","year":2025},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.501750Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:a5c36aa4d000162fb606f0f5496e6d5076fb6df74905fbee1592b2fa74b7ec3d","observation_id":"92a2d589-6127-4eb7-8533-0fa16971d508","resolution":{"observed_at":"2026-08-16T00:38:08.172989Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05069","last_updated":"2025-06-09T09:08:12Z","snapshot_observed_at":"2026-08-15T07:42:10.226125Z","submitted_at":"2025-06-05T14:16:44Z","title":"Reason-to-Recommend: Using Interaction-of-Thought Reasoning to Enhance LLM Recommendation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05069","snapshot_observed_at":"2026-08-16T00:38:07.504889Z","title":"Reason-to-recommend: Using interaction-of-thought reasoning to enhance LLM recommendation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.504889Z"},"links":{"cited_paper":"/paper/2506.05069","citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:b5bc1a4c1af2a8e3bdf9b3c56e7e76324187b1572dfad6cdadb4f6406e9faba2","observation_id":"f49bb029-e590-4678-98b5-e2d5c7662bcc","resolution":{"observed_at":"2026-08-16T00:38:07.504889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:07.508790Z","title":"Let me do it for you: Towards llm empowered recommendation via tool learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.508790Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:fb2bea79bdb249b10077101226c38300165662b7566a59fde68349d3a3f50bdd","observation_id":"f44f0bad-b49f-402a-9db1-a07c2165111f","resolution":{"observed_at":"2026-08-16T00:38:07.508790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01135","last_updated":"2024-02-02T04:20:13Z","snapshot_observed_at":"2026-08-16T14:22:16.695816Z","submitted_at":"2024-02-02T04:20:13Z","title":"A Multi-Agent Conversational Recommender System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01135","snapshot_observed_at":"2026-08-16T00:38:07.513439Z","title":"A multi-agent conversational recommender system","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.513439Z"},"links":{"cited_paper":"/paper/2402.01135","citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:2efbc8e0c02a1440c63724d4e883adf3512058524d282c6641479d5c849015d1","observation_id":"2690fed4-a763-40d0-8e50-206953ae9daf","resolution":{"observed_at":"2026-08-16T00:38:07.513439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:07.517414Z","title":"Macrec: A multi-agent collaboration framework for recommendation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.517414Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:2082b542edafcbe9eb4679aacf34f841cebfd204c46c20f7554bb27647cc0147","observation_id":"d1897610-084b-4bf4-a11b-2c6b0acfb66e","resolution":{"observed_at":"2026-08-16T00:38:07.517414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02061","last_updated":"2026-07-28T04:34:05Z","snapshot_observed_at":"2026-08-17T12:00:35.498109Z","submitted_at":"2025-02-04T07:17:54Z","title":"Reason4Rec: Deliberative User Preference Alignment of Large Language Models for Recommendation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02061","snapshot_observed_at":"2026-08-16T00:38:07.520666Z","title":"Reason4rec: Large language models for recommendation with deliberative user preference alignment.CoRR, abs/2502.02061, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.520666Z"},"links":{"cited_paper":"/paper/2502.02061","citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:846c29dba2d34df76219831d67ca214425a194278dc568fec6b7e62f590afac5","observation_id":"074bf6e3-31b2-4312-af43-6cecb7173cbc","resolution":{"observed_at":"2026-08-16T00:38:07.520666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2603.09843","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:07.686214Z","title":"Recthinker: An agentic framework for tool-augmented reasoning in recommendation.CoRR, abs/2603.09843, 2026","venue":null,"work_id":"14f687e7-c32b-47c9-b277-23e0403ac33a","year":2026},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.524600Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:74f023ced93b25ff4035c6eb7c931044395116826e60ed172fcfd092df01ebd7","observation_id":"eee97971-7eb6-447d-afcd-e2ee3ee2cee8","resolution":{"observed_at":"2026-08-16T00:38:07.691562Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:07.527872Z","title":"Agentcf++: Memory-enhanced llm-based agents for popularity-aware cross-domain recommendations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.527872Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:2f59e9d1e547edc21e5a389ad8c5b7a14eab306feb4a7c497de6d9cd95721bd1","observation_id":"99816873-ccd5-4fc8-8a00-f86e12fbda30","resolution":{"observed_at":"2026-08-16T00:38:07.527872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:07.531000Z","title":"User behavior simulation with large language model-based agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.531000Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:7b06b8cdd10a6686b9e34c16322780680dbe1248a1c7ae7ea3f24d330037e254","observation_id":"8625505f-8b0f-4866-845d-3fc4eef43155","resolution":{"observed_at":"2026-08-16T00:38:07.531000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12722","last_updated":"2025-04-17T07:57:23Z","snapshot_observed_at":"2026-08-17T06:31:58.484786Z","submitted_at":"2025-04-17T07:57:23Z","title":"SimUSER: Simulating User Behavior with Large Language Models for Recommender System Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12722","snapshot_observed_at":"2026-08-16T00:38:07.534439Z","title":"Simuser: Simulating user behavior with large language models for recommender system evaluation.CoRR, abs/2504.12722, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.534439Z"},"links":{"cited_paper":"/paper/2504.12722","citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:9d5fcf43e081afc9e94885510ab87ba50c5c45a19d35a8ad87c761b2032f09ea","observation_id":"e47c87a4-1416-4b8b-924e-a8ed988bcd58","resolution":{"observed_at":"2026-08-16T00:38:07.534439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:07.538122Z","title":"A llm-based controllable, scalable, human-involved user simulator framework for conversational recommender systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.538122Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:0443a5f156e72d8b4c1fe60fbca1da289373ad8096c039ca18ca01995c947a6c","observation_id":"149fee2c-831c-4b00-8036-eab471acad70","resolution":{"observed_at":"2026-08-16T00:38:07.538122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:07.541435Z","title":"Agentcf: Collaborative learning with autonomous language agents for recommender systems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.541435Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:69269888cd14f0d58de81e55d758ee483db7dbb27d4b9c83fd91bae3d76d79a9","observation_id":"b678ae9f-7d2f-450e-8a13-d78122357226","resolution":{"observed_at":"2026-08-16T00:38:07.541435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:08.569391Z","title":"Recmind: Large language model powered agent for recommendation","venue":null,"work_id":"dae8523b-dd0a-4a10-9736-366f8e771d40","year":2024},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.544391Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:487c48a6b3d4b12aa31a81286d30e0011118d4c7a23883f5d03a932ff1549fe7","observation_id":"19c1879d-130d-4a15-9017-f98deba75fb7","resolution":{"observed_at":"2026-08-16T00:38:08.573722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:08.559126Z","title":"Personax: A recommendation agent- oriented user modeling framework for long behavior sequence","venue":null,"work_id":"73a3b0ce-0e44-4d40-af4a-25f3399cca04","year":2025},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.547517Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:9ad5da2e46d4dbeef86ff50b4790b24411433b8c4df0d552de61f93c0523219f","observation_id":"e6f55a26-648b-43d8-9656-d28aacf142aa","resolution":{"observed_at":"2026-08-16T00:38:08.563092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:07.550744Z","title":"Recommender ai agent: Integrating large language models for interactive recommendations.ACMTrans.Inf","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.550744Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:f667c3dbf06aea68a20394d1a2ab5a8943821e54f5b85af6dd936560ca57122d","observation_id":"f2ffc806-27d0-49bc-84a3-9ba81eee6aa5","resolution":{"observed_at":"2026-08-16T00:38:07.550744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:07.557409Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.557409Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:9198fea3c3b096a203d698c7d69985d83dc657d7c542a06ff63444e7f2a3ad57","observation_id":"7ca18182-26ff-430f-ada1-d4359d53767a","resolution":{"observed_at":"2026-08-16T00:38:07.557409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:07.560691Z","title":"Manning, Stefano Ermon, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.560691Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:c6f3a4272b33d1f2b56c0a004359e8b44ea324f7cc3923e2b18d9638e08a6068","observation_id":"59e889c3-191a-4c53-833f-737d1a93bf0a","resolution":{"observed_at":"2026-08-16T00:38:07.560691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-16T00:38:07.564004Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.564004Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:e709c93017c7166c405015d51d3072b683182ef85a51f4e37a727f9d519e3092","observation_id":"c728cda4-83e8-449f-9814-2b5f668e0f3e","resolution":{"observed_at":"2026-08-16T00:38:07.564004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:08.537317Z","title":"On-policy distillation of language models: Learning from self-generated mistakes","venue":null,"work_id":"502e5ca6-10fa-43b4-9128-875a4f07541a","year":2024},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.567302Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:30a9ce24136a2d8cab59916cee7bcbfd330d5d99b00bef04b1cc7393a11888c1","observation_id":"00de486e-5583-4252-8d8f-942ff0d6a378","resolution":{"observed_at":"2026-08-16T00:38:08.541385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13116","last_updated":"2024-10-21T16:22:33Z","snapshot_observed_at":"2026-08-10T17:26:33.432994Z","submitted_at":"2024-02-20T16:17:37Z","title":"A Survey on Knowledge Distillation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13116","snapshot_observed_at":"2026-08-16T00:38:07.570503Z","title":"A survey on knowledge distillation of large language models.CoRR, abs/2402.13116, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.570503Z"},"links":{"cited_paper":"/paper/2402.13116","citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:e903d163ae5c6e6ca0c7a41218337ea95bfe13e39ea7878f2913e0d5b382ca69","observation_id":"57eb09ca-f036-4955-9c2f-b69f3fe68ce7","resolution":{"observed_at":"2026-08-16T00:38:07.570503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:38:08.525036Z","title":"Minillm: Knowledge distillation of large language models","venue":null,"work_id":"1a65abbd-950d-4437-a975-92378429579e","year":2024},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.574797Z"},"links":{"citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:1649b403bcc53407670170467c18cd483cfc0fd59daeacd3a9c83ba037edf9c2","observation_id":"5c6fc283-a67e-4387-a194-08c8d81ae6fb","resolution":{"observed_at":"2026-08-16T00:38:08.529417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18734","last_updated":"2026-03-20T15:40:19Z","snapshot_observed_at":"2026-08-13T14:47:47.249767Z","submitted_at":"2026-01-26T17:56:50Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.18734","snapshot_observed_at":"2026-08-16T00:38:07.578156Z","title":"Self-distilled reasoner: On-policy self-distillation for large language models.CoRR, abs/2601.18734, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.578156Z"},"links":{"cited_paper":"/paper/2601.18734","citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:e5baff045058c6e85dbf7e3a29628cd8ffe8e63424c3587a9c0704429e345e1a","observation_id":"61e79c54-e954-439c-892b-9ad692bd0dfd","resolution":{"observed_at":"2026-08-16T00:38:07.578156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-16T00:38:07.581950Z","title":"Qwen3 technical report.CoRR, abs/2505.09388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.581950Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:e519fbf346d34c69908b151d18dc1b9249cb29995270a4d1dc358341cce0c34e","observation_id":"105b8ee6-e40c-4ee9-bd50-cd75f0a88261","resolution":{"observed_at":"2026-08-16T00:38:07.581950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-08-17T01:58:07.850738Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-08-16T00:38:07.585126Z","title":"Deepseek-v3.2: Pushing the frontier of open large language models.CoRR, abs/2512.02556, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T00:38:07.585126Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2608.11604"},"observation_digest":"sha256:7923d5252e5bc8216df6a25705363f4e934958c18267d6481b258cf9856e1d11","observation_id":"5bd4da44-beb7-49dd-8e62-944da58adc81","resolution":{"observed_at":"2026-08-16T00:38:07.585126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.11604","last_updated":"2026-08-12T03:24:44Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-16T00:31:33.768389Z","submitted_at":"2026-08-12T03:24:44Z","title":"Learning from Online User Feedback for Shopping Agents"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":25,"verified_exact":2,"verified_fuzzy":4},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2608.11604."}