{"as_of":"2026-08-07T12:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2ac2fc0741ca7a12ec27c3f5ca3b83835a5d660e04a5a72871257150d1919817","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T04:26:24.074391Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T12:23:46.965989Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.03162","snapshot_observed_at":"2026-08-01T12:23:46.965989Z","title":"arXiv preprint arXiv:2607.03162 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26611","last_updated":"2026-07-29T08:34:29Z","snapshot_observed_at":"2026-08-07T11:42:10.489663Z","submitted_at":"2026-07-29T08:34:29Z","title":"Fewer Clarifications, Better Code: Benchmarking Cross-Session Personalized Ambiguity Adaptation in Coding Assistants","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T12:23:46.965989Z"},"links":{"cited_paper":"/paper/2607.03162","citing_paper":"/paper/2607.26611"},"observation_digest":"sha256:2857786dbfe8d44c4db1ba744456de8a0c87dacf72747c895d4d0434c73eba3a","observation_id":"64dd2e59-95a1-412f-8b1c-f914f1366a7a","resolution":{"observed_at":"2026-08-01T12:23:46.965989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.03162/citation-record","integrity":"/paper/2607.03162/integrity","json":"/paper/2607.03162/citation-record.json","paper":"/paper/2607.03162"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.29782","last_updated":"2026-05-28T11:31:13Z","snapshot_observed_at":"2026-08-04T05:44:29.740235Z","submitted_at":"2026-05-28T11:31:13Z","title":"Hista and Numca: Estimate State Value Effectively for LLM Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.29782","snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"Prateek Chhikara, Dev Khant, Saket Aryan, Taranjeet Singh, and Deshraj Yadav","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"cited_paper":"/paper/2605.29782","citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:52145b896b009a0c52a30454ed46b919302a650a18eaac6f3075fae2df522a23","observation_id":"f36e8105-ebcc-453b-9b13-0eabe99137a5","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18965","last_updated":"2025-02-26T09:25:10Z","snapshot_observed_at":"2026-07-06T20:42:55.911327Z","submitted_at":"2025-02-26T09:25:10Z","title":"OneRec: Unifying Retrieve and Rank with Generative Recommender and Iterative Preference Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18965","snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"Xiang Deng, Yu Gu, Boyuan Zheng, Shijie Chen, Samual Stevens, Boshi Wang, Huan Sun, and Yu Su","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"cited_paper":"/paper/2502.18965","citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:5552f6af3114d16f951cf31cf0e0c3406b0ff173c1480cff6097ce9e51edde02","observation_id":"82467b3c-8746-4b56-9e2f-a0cfbe2f45bc","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:0e6e793b7978712421f2d042b3eab41ea1ce79eee6282aedfb6f1ede8e3dc29b","observation_id":"e4ddd04b-98c0-4221-9dd9-661dacaa5f52","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:641d64c9b0480edae9a0da94ec2966e2deffed49065e83908a63c37ea5a24d70","observation_id":"e0ae9dc4-c6f5-400d-bf6c-0498be3942ea","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17753","last_updated":"2024-02-27T18:42:31Z","snapshot_observed_at":"2026-08-06T11:15:36.554174Z","submitted_at":"2024-02-27T18:42:31Z","title":"Evaluating Very Long-Term Conversational Memory of LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17753","snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"Joshua Maynez, Shashi Narayan, Bernd Bohnet, and Ryan McDonald","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"cited_paper":"/paper/2402.17753","citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:31989de19c6a46708c3f0c96699f09eba700701f57780ff5fa9575866e29b11b","observation_id":"23bab859-6e60-4d9b-9bc1-0f29078fc8a3","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08560","last_updated":"2024-02-12T18:59:46Z","snapshot_observed_at":"2026-08-03T06:31:15.541423Z","submitted_at":"2023-10-12T17:51:32Z","title":"MemGPT: Towards LLMs as Operating Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08560","snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"Preprint, arXiv:2310.08560","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"cited_paper":"/paper/2310.08560","citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:5481dcd34b2986a2a6fcb750aea8699b8a4b4f0e248ef772253b5dcf89ba7a24","observation_id":"4fe437d5-2378-4e4e-8939-38be177fe612","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.06588","last_updated":"2022-06-14T04:25:26Z","snapshot_observed_at":"2026-07-06T13:20:29.949578Z","submitted_at":"2022-06-14T04:25:26Z","title":"Shopping Queries Dataset: A Large-Scale ESCI Benchmark for Improving Product Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.06588","snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"Steffen Rendle, Christoph Freudenthaler, Zeno Gantner, and Lars Schmidt-Thieme","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"cited_paper":"/paper/2206.06588","citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:8a14887373ad7f36f40acd78b68f8db41d2a24c9681792b6ade0d999b8d30edf","observation_id":"9703bdcf-4097-4a01-b2d1-b5e031f38faa","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19623","last_updated":"2025-05-28T14:32:56Z","snapshot_observed_at":"2026-07-06T21:30:23.899598Z","submitted_at":"2025-05-26T07:45:11Z","title":"AgentRecBench: Benchmarking LLM Agent-based Personalized Recommender Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19623","snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"Weiqi Shao, Xu Chen, Jiashu Zhao, Long Xia, Jingsen Zhang, and Dawei Yin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"cited_paper":"/paper/2505.19623","citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:edac8ceda6c15488a22b7c30a8abf7c8672bc84f767e7880c06d981a758b0a31","observation_id":"a710db35-3b65-4fe4-8fa9-81fe76eb1971","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"InProceedings of the 32nd ACM Inter- national Conference on Information and Knowledge Management, CIKM ’23, page 5407–5411","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:fd038c968ab397663d9c837ce6adf9666010ce9815bbb72ee7ea66378dc4cb08","observation_id":"6a4074b9-f1d4-4929-b17c-4e110ef3efb6","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.12109","last_updated":"2026-05-31T16:50:19Z","snapshot_observed_at":"2026-07-14T22:27:11.483595Z","submitted_at":"2026-03-12T16:14:14Z","title":"On Information Self-Locking in Reinforcement Learning for Active Reasoning of LLM agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.12109","snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"Han Zhu, Xiang Li, Pengye Zhang, Guozheng Li, Jie He, Han Li, and Kun Gai","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"cited_paper":"/paper/2603.12109","citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:d2fb66e478af0a9a1e5bbdacab07e3a0d7cb02d3c32edc6741b998a20f6675ff","observation_id":"d744202d-e589-4a13-9129-7edb23f2e9bd","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"When deployed as a ReAct agent, we reduce the reasoning budget to 1024 tokens to ensure practical efficiency","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:5c01997b8f51b9397405be14aa099c0ab99b5ff9f225ce42a8851f4f2a56534d","observation_id":"fd2006ad-cfd9-47f9-8ea6-ba608f3d0766","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:cf6826b9c22f2a17b1924e821184fb28ca84eb7116e422b4688fea28be3922ce","observation_id":"02fe168b-b982-41e7-a661-0882697e85ed","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:97920625bfd9c7f1919e0e7d8efcc978e56b32e50d85abcd3c0279a98b3ddabd","observation_id":"83566e84-d942-4d06-8646-2b7f453c6631","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"Other settings remain default","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:a45dd172582e788c4d19f177512c9dbbe80807cc3c372454851b808b5f44e295","observation_id":"ee245c44-f833-4507-9207-ab1174b7cc09","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:d7b7966ee540297fe4895f65b4fdd3536e20d56f7748a85b9696458cc3d6ff45","observation_id":"1a1a3dd3-c22d-4ff6-8ef8-5f5ee4f966ae","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:9ec79ec1272ddf6c6aef8bfe7a1fed5f12d0a959dd72469a7463ed5c8b86671c","observation_id":"0b5f57f5-b7a9-4c14-a9c2-72b37d70e785","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:2a907d50ee4dfddb25d93b59a70b45f83fbc0fb7463b6a50b3cc3aaa3234a389","observation_id":"ae6a88bf-ad5b-4827-b12b-ab25d31e87cb","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:0b3bbb291c44ef686318642d7345f30bf5ffc01e7200563ad254ecd37b1e9510","observation_id":"804419e2-f97d-4cad-9114-d15778ea9631","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"C.1 Additional Model-Family Results Table 12 provides the appendix position for ad- ditional model-family runs that extend the main result structure in Table 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:9ee5814eb083a5e7fa14704c535f2112f53b69aa7554661e82214f11dcdd4ec0","observation_id":"af34c766-3996-4e72-9a12-d564117b16c8","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:e8aceefdf4461e864fc1fcb91c455bc8dbe63c6e4d7da43de9937d5218f0764b","observation_id":"50888c3a-8dc1-4725-80be-b78e64e60342","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:1d4fa4a83b9cd2fe1c48c79f02ae8b084eef3c9da0872047da8a5c63739b367c","observation_id":"42e6caf7-abbb-497f-95c6-5b7d942c66e5","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:1e4988fc479865e18297fd6e759e059194b9c7902eeba9b96995c74be67e1d59","observation_id":"45956be4-39b0-48cf-8636-eba32a53c715","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:601f962aed5e18fc9cb2396f54b28c84ca8bf0f047e36e4c6ba7c6bba2fabf02","observation_id":"df3744d4-9bc5-4f43-9ebc-ab64e8f1d27c","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"As these contents exceed prompt- length limits, they are organized in a fixed schema and stored in a retrieval database, which the agent queries via this tool (see Ap- pendix C.6)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:29a69c921da77bd8af73df59c525ff2036bfdb7577323ceeb90b0ffce0faec9a","observation_id":"930c8fbc-51e1-4c0e-87ea-edd621d0f41c","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"Each query returns the top-3 relevant text chunks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:243e35f7ef9f330be16c3e037436cc42c4e6550a2da7645d2b38307aa0c3deed","observation_id":"58cbdbd9-c662-4141-9a8c-7892486423f7","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:f413dfca4a598b94da682b7d504b53b4981af9ff4ca1060407b00eaef3ae8457","observation_id":"d4ba69e3-966f-459f-9a3f-e6d03790f285","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:e5f80395dfc725ed5842d6c05db396ce813a3373580a66d40df7f236cf05caee","observation_id":"f32c4f06-009a-4e8d-818e-3b9e29ddc103","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"In Table 20, we report Hit@1 results when vary- ing the retrieval backend","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:4027120cb9c4cfab34d64a3df41aa5c4fdc74b66b8056084944e00832d7010c5","observation_id":"c25bb309-75a1-45b9-98fa-d02135ea57ce","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"Please distinguish them and list them out clearly","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:90a73278187bb83607987ab5f03c495525524bfc836860869894caec00794ecd","observation_id":"a7523657-838c-4f87-8c85-21dd24cf5ff8","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"Notice that common features are not necessarily to be ranked higher, because details always matter to the user","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:a0f17ef5b9e445453a699d65c212fc809ae1e2cb881f386868806928ab31ba9b","observation_id":"709ec71a-8bd0-4e43-bdfa-5f1f98bbda6b","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:26:24.074391Z","title":"Finally, you should output a rank for all candidates based on how much it is suitable for the user","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-12T04:26:24.074391Z"},"links":{"citing_paper":"/paper/2607.03162"},"observation_digest":"sha256:00c5b4e20491d7c18f545735bef4e146a6af71fced5869ee224fe58efbeb46d4","observation_id":"1297b855-bcdc-47a8-b425-42b412c2f67f","resolution":{"observed_at":"2026-07-12T04:26:24.074391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.03162","last_updated":"2026-07-03T10:03:35Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-05T10:47:31.437333Z","submitted_at":"2026-07-03T10:03:35Z","title":"APeB: Benchmarking Personalization Ability of Large Language Model Agents"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2607.03162."}