{"as_of":"2026-08-08T02:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6bf79a03d635b7a1fc56e23ac3c85515fb1e180e2d79c7aeffc679b43d76f91a","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T01:06:57.869871Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.00215/citation-record","integrity":"/paper/2608.00215/integrity","json":"/paper/2608.00215/citation-record.json","paper":"/paper/2608.00215"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:52.534468Z","title":"2023 , note =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:52.534468Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:4e6392a675dcc51c2f5da38dfb94cbe96edf0f8c8626932c5031d2fab740d7fa","observation_id":"828f4b68-468d-48df-84aa-e29f7250fe13","resolution":{"observed_at":"2026-08-04T01:06:52.534468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-04T01:06:52.700355Z","title":"arXiv preprint arXiv:2302.04761 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:52.700355Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:6c0725d9d72ca9689c22bb71a0a872f60cc8b2269fb81ba96cc3434a1a65e2bb","observation_id":"0a697e5c-6f1f-492a-b11c-4633b6f1b25a","resolution":{"observed_at":"2026-08-04T01:06:52.700355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:52.775773Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:52.775773Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:7aa919cc83d620e066766f3bafc73b8c1ea836b4e6f30f3dfeef5ee8e37cc3ff","observation_id":"4939fb93-c8a9-43d5-93db-5b56235b5c9c","resolution":{"observed_at":"2026-08-04T01:06:52.775773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:52.884355Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:52.884355Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:eb67026c2ae1c2a5a4e5ac1556db5ea34c7ac83fc927466327d9075726e9770e","observation_id":"9c257a27-ad83-4293-837d-8bb00acbd482","resolution":{"observed_at":"2026-08-04T01:06:52.884355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:52.957799Z","title":"and Song, Yufan and Li, Boxuan and Tang, Yuxuan and Jain, Kritanjali and Bao, Mengxue and Wang, Zora Z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:52.957799Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:85dce2873b4522740220fbac1de5b52bea5239efb6812da32e3b56e024dacb26","observation_id":"189b4f02-31bb-45ad-90d1-12d785027d8b","resolution":{"observed_at":"2026-08-04T01:06:52.957799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.020908Z","title":"Transactions on Machine Learning Research (TMLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.020908Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:96af5be1dba5b43d94469f5f82458b55b3c2e802504db08d11a1dfddbf444bb0","observation_id":"b714580a-710f-470f-975c-29ec11d9babd","resolution":{"observed_at":"2026-08-04T01:06:53.020908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.084425Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.084425Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:ca9ac2726aca7aec585c3e17ffcb766eb533dbf8ee2e3bc8dcfab68d5a3f1535","observation_id":"58a9955e-e768-4837-b600-cbb1b9e428c3","resolution":{"observed_at":"2026-08-04T01:06:53.084425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.147715Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.147715Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:dd0a2f4e52cd08106d20fd8ec0cda1c14bfc1979782d4e1cc6f05d8fb3231c8c","observation_id":"2e328b3a-3734-4d1a-aedb-2c4a67bc5896","resolution":{"observed_at":"2026-08-04T01:06:53.147715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.208648Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.208648Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:a884db2f363528d563a5486af92f49804ac63d64f5e48e7e15d36c130f2e1058","observation_id":"3c605b53-ba1a-4547-9312-035acb23962b","resolution":{"observed_at":"2026-08-04T01:06:53.208648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.275947Z","title":"and Li, Xian , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.275947Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:3b817c812e4edf9b720478897e61195500c043ae56f87628dce627dd5e569394","observation_id":"a264c3df-96e0-4993-bef8-c72d118f79a5","resolution":{"observed_at":"2026-08-04T01:06:53.275947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.334662Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.334662Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:9da716c883a40d82332983308e48e046973f9fba613e29f6e26d8977fe17be1c","observation_id":"2be3b790-6bfe-415e-9928-197298eb25f7","resolution":{"observed_at":"2026-08-04T01:06:53.334662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.413036Z","title":"Memory as a Controlled Process: Learned Adaptive Memory Management for","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.413036Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:4804a3a58b2b66853aa92230ab71b7d92e0e89e35593bd9280f5fdfb259b7b2f","observation_id":"229ce206-e978-429d-860c-02bf72ef0c68","resolution":{"observed_at":"2026-08-04T01:06:53.413036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.464442Z","title":"User Preference Modeling for Conversational","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.464442Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:e0500513b299c544cef9530035684b9b952e4634a3a075927516378a3f9ea6c0","observation_id":"0935c429-8fe6-4877-9b62-9f89298be0f4","resolution":{"observed_at":"2026-08-04T01:06:53.464442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.524190Z","title":"Optimizing User Profiles via Contextual Bandits for Retrieval-Augmented","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.524190Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:a6e85a7de0421e3e615c3677eecd97c70e7c75333c187e98c579a83890d412a2","observation_id":"72c446c8-9640-49a1-b713-56987c2bb2aa","resolution":{"observed_at":"2026-08-04T01:06:53.524190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.623160Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.623160Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:ee85dd1ec62292a4e80c2f469f2d3742ed6f7fb2f74c09f582881fd9c0c3cbe4","observation_id":"201351c4-27fe-4771-9d07-6508d7d33a54","resolution":{"observed_at":"2026-08-04T01:06:53.623160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.686781Z","title":"Training Proactive and Personalized","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.686781Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:33ba1befe8959bb6282fbc95362b5700c9cc08d3c5df8cac88538bcbba6559f3","observation_id":"b2ef6971-4361-469a-b5f0-6418f1f6c918","resolution":{"observed_at":"2026-08-04T01:06:53.686781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.754524Z","title":"Proceedings of the ACM Web Conference 2025 , year =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.754524Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:f2e545607937df57c1785a15e6fce998d1adb16801eb2e3da3729a7332682f02","observation_id":"dbdf4a99-f94a-4520-b1df-611b1b349e92","resolution":{"observed_at":"2026-08-04T01:06:53.754524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.799456Z","title":"2025 , publisher =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.799456Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:0e1699acb57337c35eb2f47ca1e008c5c4c6a29ca57543461235e3a8433c8f1d","observation_id":"db68ad26-cf53-4daa-942a-933feff75719","resolution":{"observed_at":"2026-08-04T01:06:53.799456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.900607Z","title":"Findings of the Association for Computational Linguistics: ACL 2026 , pages =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.900607Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:6ca1791663d6beb3a69ed3aebf47d30f1221585a1ea116fb950a652f82c977e6","observation_id":"f5b57a1b-7630-44b9-9777-26a8f2ccec47","resolution":{"observed_at":"2026-08-04T01:06:53.900607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:53.964393Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:53.964393Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:a495e14f89593490e44a6ae9d4bea4b708b26bd2cbe27ebbd2f7fee2acb0d460","observation_id":"fa255062-b5af-4498-860c-95f15c77df54","resolution":{"observed_at":"2026-08-04T01:06:53.964393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.057049Z","title":"Online Personalizing White-box","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.057049Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:a850f13755510568fc5cbd0760314a64d4579ed3c941c3082865c4f611c94b0a","observation_id":"00ada0fe-f02b-4974-9ab3-33179748cbe1","resolution":{"observed_at":"2026-08-04T01:06:54.057049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.154404Z","title":"Proceedings of the 41st International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.154404Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:23308f3e83c9affab056a19ac4df41297605d1e076b2053ccdd2650adf99203f","observation_id":"c0d8d334-f894-45b2-bee5-3645efacc1b2","resolution":{"observed_at":"2026-08-04T01:06:54.154404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.221140Z","title":"Learning to Control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.221140Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:297dfce5270a70c13b1f38a06c9881af96df7d06152e7ed437e5fe8852e009d6","observation_id":"4742454c-98c5-4a2c-8539-1fbc6a8b6f6c","resolution":{"observed_at":"2026-08-04T01:06:54.221140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.316300Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.316300Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:a45ad52a41bb852a2c8085c827c8d7897a5f5f7f617f85bfcc26c4e0b651695b","observation_id":"3fb2e3b5-2f0c-4d98-b1f1-233df9ed345e","resolution":{"observed_at":"2026-08-04T01:06:54.316300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.387181Z","title":"2024 , note =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.387181Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:a675fa49f4cc2d2a755c00efea3e9944756459f33fed965d42e07e9748b51be6","observation_id":"e8d54210-1094-42df-9866-c3ce4b149d6a","resolution":{"observed_at":"2026-08-04T01:06:54.387181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.451553Z","title":"Two Tales of Persona in","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.451553Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:ed15dfe83aaef19f72ba01f539f5c98d41a053b1a862ef3114dc2115f536946e","observation_id":"54217a13-2285-49c6-8d18-1b34a26c0bca","resolution":{"observed_at":"2026-08-04T01:06:54.451553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.552236Z","title":"Personalized Reasoning: Just-In-Time Personalization and Why","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.552236Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:d7a4a86f3ccd7a0d3e27357b223cb7e111ef8e478a57c51b14dea723d1e78ba6","observation_id":"f0b52858-3ff9-44da-8508-b24d51cf9bdf","resolution":{"observed_at":"2026-08-04T01:06:54.552236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.647765Z","title":"arXiv preprint arXiv:2602.16173 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.647765Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:5d6b06dacd706e5ed9d2c94109961a5eb64fac2c456b66b3ce86360cc1de3a19","observation_id":"c949b5bb-2c3a-4f19-be72-80f50b004925","resolution":{"observed_at":"2026-08-04T01:06:54.647765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.730897Z","title":"2025 , note =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.730897Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:cd08c57bdbb5c13c385cea905879200f5588aa928ea2c4ef1069a6194f87376a","observation_id":"a0c918d9-ecf5-49f6-907b-a8eb3e8057aa","resolution":{"observed_at":"2026-08-04T01:06:54.730897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.785864Z","title":"Clarify When Necessary: Resolving Ambiguity Through Interaction with","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.785864Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:5bf2a0928652b44de62754b4c5dc74eaaa48de8f9879e7238991e7c06bf4912b","observation_id":"a027c521-77dd-40e4-ab6f-fba1d96590a6","resolution":{"observed_at":"2026-08-04T01:06:54.785864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.859816Z","title":"2025 , publisher =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.859816Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:4cb9e9906182b99dda827b4a7a2afd67ef0e6d8b2fe3260cccd1c9e26ef98ca5","observation_id":"35c1266c-0650-43df-9986-927e8f158bba","resolution":{"observed_at":"2026-08-04T01:06:54.859816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.925630Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.925630Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:639233499da77d2f8a2d289b351bc9d0dc122f944773be5dd3dd15e96b0a534d","observation_id":"67d97c1b-9eac-4fad-b426-6cb2d7a369fb","resolution":{"observed_at":"2026-08-04T01:06:54.925630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:54.988828Z","title":"Measuring Mathematical Problem Solving with the","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:54.988828Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:b8c077808f33375d1f161b9d535d9a0b199b4e9bbe06fc5154ccbe53ddfb3334","observation_id":"1796b0b5-a8b1-43bc-8015-b2be1123e865","resolution":{"observed_at":"2026-08-04T01:06:54.988828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-04T01:06:55.047035Z","title":"arXiv preprint arXiv:2305.20050 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.047035Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:23f2c936f1799fbd567e7f46cd4a339a08e4fc555fb03872a467c959b20e7dca","observation_id":"4ffc41f5-b55e-46f9-ae78-f198e97a2668","resolution":{"observed_at":"2026-08-04T01:06:55.047035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.120577Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.120577Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:bf757029f2a5d53ede9b5ca871b962d6d075567b5e5afcdb5f85cf743ff160b3","observation_id":"f51e124d-5f56-4024-8d98-5e50f9a25fff","resolution":{"observed_at":"2026-08-04T01:06:55.120577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.181318Z","title":"arXiv preprint arXiv:2601.02702 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.181318Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:6923b4773692885f0ed85e1800015a5d600538f52a4a407000891cecfe239800","observation_id":"90475b80-fa79-4686-b834-7711aaee6df5","resolution":{"observed_at":"2026-08-04T01:06:55.181318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.17886","last_updated":"2026-04-20T06:57:50Z","snapshot_observed_at":"2026-08-02T05:37:30.648992Z","submitted_at":"2026-04-20T06:57:50Z","title":"Latent Preference Modeling for Cross-Session Personalized Tool Calling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.17886","snapshot_observed_at":"2026-08-04T01:06:55.247493Z","title":"arXiv preprint arXiv:2604.17886 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.247493Z"},"links":{"cited_paper":"/paper/2604.17886","citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:a3e11122eb8e24e2890d7115647573090f60621a1d61d7d9eec39994085e7172","observation_id":"4923894f-455a-466b-9552-2d3452bfac9d","resolution":{"observed_at":"2026-08-04T01:06:55.247493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.313620Z","title":"and Stoica, Ion and Gonzalez, Joseph E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.313620Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:7abdcbabb3c09c8cca111316fb676f3b256553b24fc0423e9aaa82edb04cc90f","observation_id":"5a94adb8-30cd-40cb-bcd4-550068a6d8e1","resolution":{"observed_at":"2026-08-04T01:06:55.313620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.360498Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.360498Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:faf6c88236889bed74c79b80cd3db4c9714c4aa68506a792fe57c77c881edf68","observation_id":"ae67b765-3092-4616-b314-66d8ab5acd1f","resolution":{"observed_at":"2026-08-04T01:06:55.360498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.437828Z","title":"2025 , note =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.437828Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:44a601d573813ed7f08499adf0b0cc26d8d53d6331db4ec7843d987c2c0084b8","observation_id":"4b4e6ecf-4d78-4d6c-964b-cba444220c78","resolution":{"observed_at":"2026-08-04T01:06:55.437828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.483793Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.483793Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:b9ed8483b8797dd8a116b32381aac8704213ed0587dca30d92417684a6b4558a","observation_id":"2e06a672-723f-4081-b4e6-15283f0df48a","resolution":{"observed_at":"2026-08-04T01:06:55.483793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.553820Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.553820Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:fd236d042f5a60992357767bb4353a0ba3895ec5a43a3ae33354e8d5fbb2e9bf","observation_id":"73d42ab3-ebed-46d1-96f2-8860e79d3ed9","resolution":{"observed_at":"2026-08-04T01:06:55.553820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.617594Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.617594Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:28e6de1804183d346765999657d348722daf3ea6d6ddb5b231425f1eb295c0b0","observation_id":"e348c941-d1e3-4cfb-b7de-95013af46cd9","resolution":{"observed_at":"2026-08-04T01:06:55.617594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.661295Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.661295Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:50d12c6ef4123288466904565607e120e60efa78016365dd965e9b9f16e446a7","observation_id":"604d4eff-99c6-4133-83ec-1f59c1ffa31a","resolution":{"observed_at":"2026-08-04T01:06:55.661295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10075","last_updated":"2024-08-19T15:18:30Z","snapshot_observed_at":"2026-07-06T19:02:56.021845Z","submitted_at":"2024-08-19T15:18:30Z","title":"Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10075","snapshot_observed_at":"2026-08-04T01:06:55.741495Z","title":"arXiv preprint arXiv:2408.10075 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.741495Z"},"links":{"cited_paper":"/paper/2408.10075","citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:925b613d313b608c8ebd6c5aecb1b27af95e2b7ca1e65af521be979ef1f000f0","observation_id":"6541a1d8-99be-4956-8599-770a848228d5","resolution":{"observed_at":"2026-08-04T01:06:55.741495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.800844Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.800844Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:a76c26bd2241dec77967af5b509de2f1e949e534c17824bcc676b6a562c7e2b7","observation_id":"88cda4d4-0fab-4849-a077-4e4563fb25bd","resolution":{"observed_at":"2026-08-04T01:06:55.800844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.869399Z","title":", journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.869399Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:f419c22a4cb343f79a4297c983fe82e4ca43ed4f35fcb4d12dd9726b619a0ac6","observation_id":"1e4a5041-a7ff-4559-964f-4341e2e6dbee","resolution":{"observed_at":"2026-08-04T01:06:55.869399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:55.963928Z","title":"2025 , note =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:55.963928Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:34cd5d52d5538835ed01e67ef895b632c28f6c9051d1d7abff57aa76fc1a3b01","observation_id":"d4c7a684-110a-4602-a85a-5f7ddab142b8","resolution":{"observed_at":"2026-08-04T01:06:55.963928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.044993Z","title":"Active Preference Optimization for Sample Efficient","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.044993Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:b4d8faf46382a39850d9a5c321d543f678521a78000123f283ea89486b8a6ac8","observation_id":"6bc595cc-29df-4b4c-8104-31324ecd2e6a","resolution":{"observed_at":"2026-08-04T01:06:56.044993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09401","last_updated":"2025-02-11T18:18:59Z","snapshot_observed_at":"2026-07-06T17:30:12.459471Z","submitted_at":"2024-02-14T18:58:40Z","title":"Reinforcement Learning from Human Feedback with Active Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09401","snapshot_observed_at":"2026-08-04T01:06:56.090015Z","title":"arXiv preprint arXiv:2402.09401 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.090015Z"},"links":{"cited_paper":"/paper/2402.09401","citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:c7a2473ccb102dfb011dfd44f18ff2b13755ae6a8e4588433f80985825e12ba3","observation_id":"755b9f24-0268-4a2b-9487-2d017ca150c1","resolution":{"observed_at":"2026-08-04T01:06:56.090015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.163488Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.163488Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:7498b444f7aa648ee8fbee58fea7b0670119eeb4667b23bc6e6cf879609da2f6","observation_id":"53e80c3e-b6e4-4297-9baa-77c835e05044","resolution":{"observed_at":"2026-08-04T01:06:56.163488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.223953Z","title":"Proceedings of the 19th International Conference on World Wide Web (WWW) , pages =","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.223953Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:e4d3bec3c4f90959c03db9b224502038873442e4826ed97dcfecd0fb368b0dde","observation_id":"00e9c827-4e42-4572-8460-9fb9d175886a","resolution":{"observed_at":"2026-08-04T01:06:56.223953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.264361Z","title":"Proceedings of the 26th International Conference on Artificial Intelligence and Statistics , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.264361Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:fdf214dc89286135b2071d104714e35a340918db7944dd52f6ad99864fb04819","observation_id":"c810884e-96d2-467e-a7df-c85c6954e659","resolution":{"observed_at":"2026-08-04T01:06:56.264361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.341306Z","title":"and Murphy, Susan A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.341306Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:6b6e9252e38537bfae3a20c7f1e3f35a6e3a5c73495c2b287d7da2878747172e","observation_id":"16761947-b99f-47e3-8ccb-1a6189ceb2cd","resolution":{"observed_at":"2026-08-04T01:06:56.341306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.424208Z","title":"Proceedings of the 37th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.424208Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:6d858a72cf5b84079317651995ad3835535205d7ab85f68cf88132e00fd12733","observation_id":"384c7a6b-09c8-4197-8791-d0823252d957","resolution":{"observed_at":"2026-08-04T01:06:56.424208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.491811Z","title":"Advances in Neural Information Processing Systems , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.491811Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:dcadbf4e788094a7ee46ad62005c2a69452f06de8d79606e2b46e93806172020","observation_id":"2f8534b5-66fd-4620-9a18-40204b71879f","resolution":{"observed_at":"2026-08-04T01:06:56.491811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.576356Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.576356Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:f09315c5ab2ce808d8d8fa35c67253e5dbc4755b9a7eb83d18ff041252a0c710","observation_id":"26c92e7c-fe14-4383-8c5c-cd8abd5c0a3d","resolution":{"observed_at":"2026-08-04T01:06:56.576356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.644753Z","title":"Proceedings of the 35th International Conference on Machine Learning (ICML) , pages =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.644753Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:020401635f69e3739dea9da2ab6e1d96a2f07d43871efea6530974e5bd4609be","observation_id":"60a7a705-7cf8-498b-98ed-8c374bde6f03","resolution":{"observed_at":"2026-08-04T01:06:56.644753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.687019Z","title":"Proceedings of the 36th International Conference on Machine Learning (ICML) , pages =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.687019Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:c07670dfff86b0a29f5f05367cc1064967d4f4a2ebc4c072d379e86966b16f9f","observation_id":"1544815c-3bda-49ed-a1ef-3a147b23bce0","resolution":{"observed_at":"2026-08-04T01:06:56.687019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.777541Z","title":"Proceedings of the 39th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.777541Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:f5458f3d6272c8eaddfbbf7c851b0f27b2365ef77d4ab4d4b14a9b0a229573ff","observation_id":"53bb0003-cbb0-4bc7-9e93-521db8398135","resolution":{"observed_at":"2026-08-04T01:06:56.777541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.838854Z","title":"Proceedings of the 26th International Conference on Artificial Intelligence and Statistics (AISTATS) , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.838854Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:b343df56dba07a93d6e1f774a5694ee3de10bdb0e70153ac64ac89dca6f8b082","observation_id":"1a0eca40-4040-4240-8cf2-ecba5b95b374","resolution":{"observed_at":"2026-08-04T01:06:56.838854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.883229Z","title":"Machine Learning , volume =","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.883229Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:16474ec54ce959cc1c4bac0a0161bc7583b47951e4a27cf02f9f5be3efb423a7","observation_id":"7620e837-da4c-4c72-9478-e6cf7e423be1","resolution":{"observed_at":"2026-08-04T01:06:56.883229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.937537Z","title":"arXiv preprint arXiv:2410.05362 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.937537Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:f5e6b8b52d82d5dbee94d5d2a8497977dd0b2d18e65b808fd046a11a4b8deddd","observation_id":"f0808da7-43ed-43aa-9798-72cc25d5ab8d","resolution":{"observed_at":"2026-08-04T01:06:56.937537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:56.985067Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:56.985067Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:588c578f47a645ccd25ccfdebb093e5ed050c677959eeae99d4ad81364b61fe9","observation_id":"b6552889-478a-4d14-bed7-10c84ebf258f","resolution":{"observed_at":"2026-08-04T01:06:56.985067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.096189Z","title":"Proceedings of the 30th International Conference on Machine Learning (ICML) , pages =","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.096189Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:57c3e10666e31ed67b3cb661444c33dd0bd849af00e391afd91023e94e8c253f","observation_id":"1faae8fe-8908-4419-a941-be439cfa19e9","resolution":{"observed_at":"2026-08-04T01:06:57.096189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.157059Z","title":"Proceedings of the 20th International Conference on Artificial Intelligence and Statistics (AISTATS) , pages =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.157059Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:682e04718a53dce724d7ab0b2f2be0ff4fb660005e9ec709d77eb43c12036ed6","observation_id":"daa66893-1556-4d5b-a45b-5d2166ed4759","resolution":{"observed_at":"2026-08-04T01:06:57.157059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.193572Z","title":"Journal of Computational and Graphical Statistics , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.193572Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:60b5b50b7927d75a22bd13ca45557d4c1f060c6eed0158d4f47e05bf78b0f7ac","observation_id":"605aa653-db09-4c8e-92e7-ee32f40bbd3e","resolution":{"observed_at":"2026-08-04T01:06:57.193572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.249778Z","title":"and Lanckriet, Gert R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.249778Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:11d87e95f331c16f9f6ff27fc7c8d0f8f0f0c7bee5aaafa53c51652d6a51bc21","observation_id":"20cce504-814f-4231-a371-51ab5571773b","resolution":{"observed_at":"2026-08-04T01:06:57.249778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.301575Z","title":"Foundations and Trends in Machine Learning , volume =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.301575Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:2781d2145bd40e04547ec0c62505fa97555274fbbf6f2e37af9b643e079ab62b","observation_id":"c7e68f1c-da43-411b-8560-6b0c8cf7d415","resolution":{"observed_at":"2026-08-04T01:06:57.301575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.370676Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.370676Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:74a2c2fc88f6ee9ddad7a23d9d5d88a83c74bb20e1b2a496b42a78b0f5d109b6","observation_id":"40ae25fc-65c5-4c21-99bf-cc52851a93e9","resolution":{"observed_at":"2026-08-04T01:06:57.370676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.436451Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.436451Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:10ffd16bd5471e96b06984b6c4133537d86380b6e4c29ddbe2ff97451c9e8298","observation_id":"94f8f073-60bd-46b4-b076-7a98e6bdf9d9","resolution":{"observed_at":"2026-08-04T01:06:57.436451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.486907Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.486907Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:a48753df8090a04bedc772a57ce56645450676f01c7bd47676550f165f92f11d","observation_id":"9fc7f19b-9ea8-4b04-a40d-20ceeaf0e32a","resolution":{"observed_at":"2026-08-04T01:06:57.486907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.552420Z","title":"Annals of Statistics , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.552420Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:29c9b99ad303a0c1934eb4a7662caff2095cb4d7a86e65100cb6cc4355eabad2","observation_id":"48e3d454-eca7-436f-8c07-05a4c2bb9d5f","resolution":{"observed_at":"2026-08-04T01:06:57.552420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.594881Z","title":"Proceedings of the 37th International Conference on Machine Learning (ICML) , pages =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.594881Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:7df21b624e267e8180b9d199e92e752c148c85a8dfcb31707a5e236c51dec421","observation_id":"14b41daf-a712-4661-9fa6-1e3be9c70607","resolution":{"observed_at":"2026-08-04T01:06:57.594881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.657991Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.657991Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:a44b12ad9682224c248cb9b5b41168986ea5cbb7c8cf204c1d55f403e8df0b5c","observation_id":"49e994a0-8efe-42cb-9ad4-efcf5d52ce25","resolution":{"observed_at":"2026-08-04T01:06:57.657991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.696621Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.696621Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:10f1bf2306783cf1dd0d127dd7fc00ab7f35db306dc004320ad6c6436dbd4c53","observation_id":"05b34efc-231d-4cf4-8507-5e423be2c152","resolution":{"observed_at":"2026-08-04T01:06:57.696621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.763081Z","title":"IEEE Transactions on Signal Processing , volume =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.763081Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:5833db77fe85f9fbdcfac23db0e9238b6be81412bf43ae6122cf7d7323547233","observation_id":"b5c859e9-85ff-4fe2-8885-8e8a86ea4849","resolution":{"observed_at":"2026-08-04T01:06:57.763081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.807502Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.807502Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:045dfed6698de825d4a32d37d2f79ad7fb0890e9bed3167324a109a00d9f28d3","observation_id":"ada481aa-9360-47e7-b8a9-7d2739fbb04a","resolution":{"observed_at":"2026-08-04T01:06:57.807502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:06:57.869871Z","title":"2025 , note =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-04T01:06:57.869871Z"},"links":{"citing_paper":"/paper/2608.00215"},"observation_digest":"sha256:48be27100aac1132ad39b905364412fbcf4867a8b0dcd4cee559488ee9a5f484","observation_id":"ac82b3be-0969-4964-bcd7-c0136937385f","resolution":{"observed_at":"2026-08-04T01:06:57.869871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.00215","last_updated":"2026-07-31T18:56:30Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T23:12:13.941911Z","submitted_at":"2026-07-31T18:56:30Z","title":"Personalizing Large Language Model Agents with Small Policy Models"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":79,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 0 inbound Pith citation observations for arXiv:2608.00215."}