{"as_of":"2026-08-09T16:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:17a1222f972c75db3bf5f43af289ff809af21a8144c240bd301acb8e3df2f53e","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:17:53.524604Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05246/citation-record","integrity":"/paper/2608.05246/integrity","json":"/paper/2608.05246/citation-record.json","paper":"/paper/2608.05246"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5712.38099","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.740252Z","title":"Learning to reason for multi-step retrieval of personal context in personalized question answering","venue":null,"work_id":"fa2745d3-4dcc-4c7f-8fec-2c8db7ed3c6a","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.272051Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:5ab47b001207cc54ce663224aeb57081e86e1aabe05b48bb119eea0927287fe4","observation_id":"cbe5b08b-a1a0-4570-84a2-5ea7da5335df","resolution":{"observed_at":"2026-08-08T17:17:54.748244Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.277727Z","title":"Large language models empowered personalized web agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.277727Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:67be10fcb4f5e480a894f83c7066c4ac224263f3e0835d5024f8005803524a3f","observation_id":"79ad8bfc-f4b9-429c-8877-4842ba5b5e35","resolution":{"observed_at":"2026-08-08T17:17:53.277727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08362","last_updated":"2026-05-21T16:20:11Z","snapshot_observed_at":"2026-08-02T15:20:13.753843Z","submitted_at":"2026-04-09T15:26:21Z","title":"Towards Real-world Human Behavior Simulation: Benchmarking Large Language Models on Long-horizon, Cross-scenario, Heterogeneous Behavior Traces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08362","snapshot_observed_at":"2026-08-08T17:17:53.283149Z","title":"Towards real-world human behavior simulation: Benchmarking large language models on long-horizon, cross-scenario, heterogeneous behavior traces, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.283149Z"},"links":{"cited_paper":"/paper/2604.08362","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:a3da3ba3cc07153be49f0c5915767f81f841a1c3eda488d935983f5fdab3b9b5","observation_id":"6b6bc56a-3184-44fe-a44e-f73234dc6201","resolution":{"observed_at":"2026-08-08T17:17:53.283149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08455","last_updated":"2026-04-09T16:50:50Z","snapshot_observed_at":"2026-07-06T22:57:31.046146Z","submitted_at":"2026-04-09T16:50:50Z","title":"KnowU-Bench: Towards Interactive, Proactive, and Personalized Mobile Agent Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.08455","snapshot_observed_at":"2026-08-08T17:17:53.289378Z","title":"Knowu-bench: Towards interactive, proactive, and personalized mobile agent evaluation, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.289378Z"},"links":{"cited_paper":"/paper/2604.08455","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:824144c719b600c4ef8a4df46a7404ae3ce4e29067d59795238ec098958e7b64","observation_id":"05ac2751-17c0-4bf0-90b6-984eefa4c23c","resolution":{"observed_at":"2026-08-08T17:17:53.289378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.17881","last_updated":"2026-04-24T20:38:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-17T23:07:57Z","title":"POPI: Personalizing LLMs via Optimized Natural Language Preference Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.17881","snapshot_observed_at":"2026-08-08T17:17:53.294909Z","title":"Popi: Personalizing llms via optimized natural language preference inference, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.294909Z"},"links":{"cited_paper":"/paper/2510.17881","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:6e8a11116cfba912ac5bac823902ccee6c8f7b4581ac143ba631b7b9b6d957b7","observation_id":"647d158d-7195-422d-87bc-e353944c7d53","resolution":{"observed_at":"2026-08-08T17:17:53.294909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.301349Z","title":"Lifebench: A benchmark for long-horizon multi-source memory, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.301349Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:cb3c6938eb6d25139a84d18880a70a5ca49ad7d2790550685c1003868158e796","observation_id":"5fa22ae1-bd35-49d5-a584-db57a9fdf609","resolution":{"observed_at":"2026-08-08T17:17:53.301349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-02T07:32:11.339534Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-08-08T17:17:53.306961Z","title":"Mem0: Building production- ready ai agents with scalable long-term memory, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.306961Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:e4aa5b9dc50d50d6cb33c1916faf32b9ec81d5925805dca76a2b85c07d0f1ccd","observation_id":"d566f43c-52a3-489b-b7d7-a44398374f6c","resolution":{"observed_at":"2026-08-08T17:17:53.306961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:55.117361Z","title":"Lifesim: Long-horizon user life simulator for personalized assistant evaluation","venue":null,"work_id":"3d00d75b-38ef-441f-bb5d-1868aca210e9","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.312072Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:6108b4345fdef9dbe4af9c3fa4f888737053c2f79031e35191adfd9ab6cc7f99","observation_id":"1f13e3a0-abd7-4c66-8078-1ab509693913","resolution":{"observed_at":"2026-08-08T17:17:55.125871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:55.095814Z","title":"A survey on personalized alignment—the missing piece for large language models in real-world applications","venue":null,"work_id":"79d842c9-ad99-4031-9da4-734d316e88f7","year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.316730Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:c5cc9d1914097c0356bcadb719a701d21b01f35a3dda169bb6940a6564f98330","observation_id":"015c68cd-1c79-4cd7-87f4-2dc8ef03ff31","resolution":{"observed_at":"2026-08-08T17:17:55.104016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.321693Z","title":"Towards realistic personalization: Evaluating long-horizon preference following in personalized user-llm interactions.arXiv preprint arXiv:2603.04191, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.321693Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:d51ef019b8f03d7bd78e90f8fb636d5c6ce5278711be4419874d7efd55c2948d","observation_id":"2f3e4e44-ae26-4184-bf7f-b33dbd09a03a","resolution":{"observed_at":"2026-08-08T17:17:53.321693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.327020Z","title":"Computing inter-rater reliability and its variance in the presence of high agreement.British Journal of Mathematical and Statistical Psychology, 61(1):29–48, 2008","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.327020Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:c2107dc86fee24ba9b8d51671a47a5c16b10792ba2274742ef25895e6e7bc1e3","observation_id":"5a833f00-6104-4aff-8872-1a955379b6ea","resolution":{"observed_at":"2026-08-08T17:17:53.327020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:55.068214Z","title":"Rap: Retrieval-augmented personal- ization for multimodal large language models","venue":null,"work_id":"e0b57890-38b1-4493-aba2-3a68f6541866","year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.331856Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:0618c648f9a8bcc155e0bf68591a5cde77f246fae7da60ab5103134f44e7613c","observation_id":"4e65dcc8-0313-48e6-ba2f-143f54d7cea1","resolution":{"observed_at":"2026-08-08T17:17:55.074174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.19069","last_updated":"2026-05-15T00:52:26Z","snapshot_observed_at":"2026-08-02T14:30:17.101736Z","submitted_at":"2026-02-22T06:54:24Z","title":"Asking the Right Questions: Improving Reasoning with Generated Stepping Stones","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.19069","snapshot_observed_at":"2026-08-08T17:17:53.336566Z","title":"Asking the right questions: Improving reasoning with generated stepping stones, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.336566Z"},"links":{"cited_paper":"/paper/2602.19069","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:b9a407d5d984e11c5e68545ee9a4936f967e03816565c0b6c5566dce90f4bf40","observation_id":"56da7c87-ee3c-4df9-b752-e35cd45242dc","resolution":{"observed_at":"2026-08-08T17:17:53.336566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.342011Z","title":"Op-bench: Benchmarking over-personalization for memory-augmented personalized conversational agents.arXiv preprint arXiv:2601.13722, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.342011Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:7a4b1ca74b30679addc0146ffddba100ccc8bcc1eaa4dd8a4564dd16f5ddb064","observation_id":"587f4df2-c4fc-4f95-8a4f-e51722811664","resolution":{"observed_at":"2026-08-08T17:17:53.342011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:55.049780Z","title":"Mem-pal: Towards memory-based personalized dialogue assistants for long-term user-agent interaction","venue":null,"work_id":"3e888168-f65f-457d-be34-d64430d31573","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.346834Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:d7df7b54ab7481901b36cde208734729c4ad8171641a28e38b8bd2508e980668","observation_id":"26d5f4ea-1045-4c42-a35a-452f625912d9","resolution":{"observed_at":"2026-08-08T17:17:55.056133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.352101Z","title":"Taylor, and Dan Roth","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.352101Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:1fe158a6fe89aca3d305977746a991972c46d30cc38e1b99b3b266dde12277fa","observation_id":"fc44df1e-9e30-44e3-8dea-6c4ea85bddbd","resolution":{"observed_at":"2026-08-08T17:17:53.352101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.17003","last_updated":"2026-05-27T12:15:49Z","snapshot_observed_at":"2026-08-02T22:25:27.596476Z","submitted_at":"2026-02-19T01:54:26Z","title":"Persona2Web: Benchmarking Personalized Web Agents for Contextual Reasoning with User History","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.17003","snapshot_observed_at":"2026-08-08T17:17:53.356534Z","title":"Persona2web: Benchmarking personalized web agents for contextual reasoning with user history.arXiv preprint arXiv:2602.17003, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.356534Z"},"links":{"cited_paper":"/paper/2602.17003","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:72fddb4cb20d7379e21f9e5b220491c97937abd6e778e7638add5cb66d74f648","observation_id":"09fed038-012f-4d9a-a4e7-d0b7da1e84b5","resolution":{"observed_at":"2026-08-08T17:17:53.356534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0854.37802","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.155443Z","title":"Humanllm: Towards personalized understanding and simulation of human nature","venue":null,"work_id":"ad2396e7-4cd3-4b3e-a458-cd936ee6441c","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.361281Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:fe053725452ab55fdf6e0e68cd69aa4e0d94ef7b209fc23fd55ebaef82f55fc7","observation_id":"1761f197-9cf5-44b7-9579-ff4770ea77d5","resolution":{"observed_at":"2026-08-08T17:17:54.163090Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:55.033695Z","title":"Retrieval-augmented genera- tion for knowledge-intensive nlp tasks","venue":null,"work_id":"efd172c3-8b65-4004-893f-14888c3b4cb6","year":2020},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.366074Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:23b6c3d042128cdd91c2fd6bb28b3cb69cdf92b22f0d99bcfe67584191557cb5","observation_id":"3df11aa5-64a0-4e50-9c98-4ab4a69a979f","resolution":{"observed_at":"2026-08-08T17:17:55.039109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:55.015353Z","title":"Can llm agents simulate multi-turn human behavior? evidence from real online customer behavior data","venue":null,"work_id":"774a2550-6a43-405a-8763-2e54923e8bfb","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.370929Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:1beeaa562487a3a784f84cf42555c91581c938a542d4c8704b1ef2637101babe","observation_id":"0ec4ee73-f0bd-48d8-b716-81e5dd09304c","resolution":{"observed_at":"2026-08-08T17:17:55.021118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-lo","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.588437Z","title":"Exploring the potential of LLMs as person- alized assistants: Dataset, evaluation, and analysis","venue":null,"work_id":"ab2ccea5-7ee5-45d2-babf-048d0c2edef2","year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.375836Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:73c9de2dfe48e516f5f5935f92d57df7272b15fbc0d6b9d3aca6707aec7aeab4","observation_id":"1f0c53b9-6e91-4f50-94c1-229004c058e5","resolution":{"observed_at":"2026-08-08T17:17:53.595425Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.380675Z","title":"Privacybench: A conversational benchmark for evaluating privacy in personalized ai, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.380675Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:a0adb1d56f5e6379c026587082dac9b45cba8c3ccea1a4cda34d7695f826b60f","observation_id":"d126780d-3f88-4567-a0a9-0fda6c6b59fc","resolution":{"observed_at":"2026-08-08T17:17:53.380675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13074","last_updated":"2026-03-20T17:59:57Z","snapshot_observed_at":"2026-07-06T23:01:10.333101Z","submitted_at":"2026-03-20T17:59:57Z","title":"PersonaVLM: Long-Term Personalized Multimodal LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.13074","snapshot_observed_at":"2026-08-08T17:17:53.385274Z","title":"Personavlm: Long-term personalized multimodal llms","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.385274Z"},"links":{"cited_paper":"/paper/2604.13074","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:7f441b4924cf643b7f62f66457863e1acd409cde22f4422ec9b51d1757851fcf","observation_id":"ad1f9ba3-504a-4ab0-8a64-429516c6ef1e","resolution":{"observed_at":"2026-08-08T17:17:53.385274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05589","last_updated":"2025-03-03T16:49:18Z","snapshot_observed_at":"2026-08-08T18:40:28.575625Z","submitted_at":"2025-02-08T14:28:36Z","title":"On Memory Construction and Retrieval for Personalized Conversational Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05589","snapshot_observed_at":"2026-08-08T17:17:53.390227Z","title":"On memory construction and retrieval for personalized conversational agents.arXiv preprint arXiv:2502.05589, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.390227Z"},"links":{"cited_paper":"/paper/2502.05589","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:d6c47c5e771146010d0191ff7b3abc91951703b2fce116343c218dabf708a1fb","observation_id":"cb7d46fd-ed79-4425-ae21-9c923116454c","resolution":{"observed_at":"2026-08-08T17:17:53.390227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10109","last_updated":"2026-06-28T22:37:51Z","snapshot_observed_at":"2026-07-06T19:50:52.652955Z","submitted_at":"2024-11-15T11:14:34Z","title":"LLM Agents Grounded in Self-Reports Enable General-Purpose Simulation of Individuals","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10109","snapshot_observed_at":"2026-08-08T17:17:53.395160Z","title":"Zou, Jonne Kamphorst, Niles Egan, Aaron Shaw, Benjamin Mako Hill, Carrie Cai, Meredith Ringel Morris, Percy Liang, Robb Willer, and Michael S","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.395160Z"},"links":{"cited_paper":"/paper/2411.10109","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:866fc682251959a68af8d3ea2a6da0dd4e4b03a1a7fefb7bd8b2e8bab64fbced","observation_id":"a2e0a7b9-8a7c-4286-a73a-a35006f2af53","resolution":{"observed_at":"2026-08-08T17:17:53.395160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.998728Z","title":"Lamp-qa: A benchmark for personalized long-form question answering","venue":null,"work_id":"14be2afb-3d5b-4f99-ba85-3473af27312c","year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.400822Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:0e62c2d00d680583bb19b32fa12bb41684b2f281cc24c736e9bb93b8e23e9e61","observation_id":"c4df0f79-a0e7-40ed-aa7c-a6b0fc3768e0","resolution":{"observed_at":"2026-08-08T17:17:55.003847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.405758Z","title":"Optimization methods for personalizing large language models through retrieval augmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.405758Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:92673123641aa22b19f41a4f5510e887cfc5914cbd6821ae78416c0acb22794f","observation_id":"b7cb8012-50dc-419e-bf7d-a489e1e3d0e5","resolution":{"observed_at":"2026-08-08T17:17:53.405758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.982085Z","title":"Lamp: When large language models meet personalization","venue":null,"work_id":"df6b2097-a77f-4865-9582-4f0939c93351","year":2024},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.410357Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:01b5049e366423afaa5450d58535119fadc34dea62bc99c1a2b3cc8cb77255ff","observation_id":"636e4262-22b5-469c-be69-20b8decfc0c2","resolution":{"observed_at":"2026-08-08T17:17:54.987973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.414867Z","title":"PersonaBench: Evaluating AI models on understanding personal information through accessing (synthetic) private user data","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.414867Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:5cabd84e95b3648c1ab7472fc48006af031394c46ac76b55d37cc5795a0ee791","observation_id":"63cdc21d-4945-41e9-b83a-2d50e16f610b","resolution":{"observed_at":"2026-08-08T17:17:53.414867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.955895Z","title":"Democratizing large language models via personalized parameter-efficient fine-tuning","venue":null,"work_id":"1a61e4ba-afe6-4e8f-9547-33c36d39d6b4","year":2024},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.419312Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:b9d2436bb086198bf439b658909a6d6111cdf7bf1113c26ab010c02e3f0e63ee","observation_id":"ad19aebd-878a-49c0-a267-9cf724497249","resolution":{"observed_at":"2026-08-08T17:17:54.961165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.940958Z","title":"In prospect and retrospect: Reflective memory management for long-term personalized dialogue agents","venue":null,"work_id":"ac8e1a19-5c60-410a-940b-8e19849989a1","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.424373Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:cd623e330586a23e24780206b76020e907116bd703e93c8546c6c9180a653625","observation_id":"5e34d33a-f1a6-4e94-88bc-38449f3a8511","resolution":{"observed_at":"2026-08-08T17:17:54.945799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12915","snapshot_observed_at":"2026-08-08T17:17:53.434087Z","title":"Personafeedback: A large-scale human-annotated benchmark for personalization, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.434087Z"},"links":{"cited_paper":"/paper/2506.12915","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:0f8f13b8d6bf28b569ac3f800260c8758a69e8f5e0cc27a1f14bd2948cc3cc4b","observation_id":"cba440d3-9b69-45e2-a3f3-0aa57e8bb554","resolution":{"observed_at":"2026-08-08T17:17:53.434087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.acl-long.2033","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.923604Z","title":"OPeRA: A dataset of observation, persona, rationale, and action for evaluating LLMs on human online shopping behavior simulation","venue":null,"work_id":"6b6253b8-f5e1-41b6-8c45-a580d0111cd0","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.438950Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:bd3fc779ad99348a5aa2f89d91b03b45a58ae32d2e572950c82f129d0a7548cf","observation_id":"d24e8727-09ee-4441-ab20-6213f38d17de","resolution":{"observed_at":"2026-08-08T17:17:54.930558Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14245","last_updated":"2025-10-02T11:31:47Z","snapshot_observed_at":"2026-08-09T05:14:36.079509Z","submitted_at":"2025-06-17T07:06:56Z","title":"Reinforcement Learning with Verifiable Rewards Implicitly Incentivizes Correct Reasoning in Base LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.14245","snapshot_observed_at":"2026-08-08T17:17:53.443925Z","title":"Reinforcement learning with verifiable rewards implicitly incentivizes correct reasoning in base llms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.443925Z"},"links":{"cited_paper":"/paper/2506.14245","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:171392a3b5325c19a57923c1a5a8e1f7805291e39778d8d65bda08e386a0d8a4","observation_id":"d7cabc12-5fd3-4ad5-9e9c-693f2d03cd75","resolution":{"observed_at":"2026-08-08T17:17:53.443925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.22877","last_updated":"2026-06-22T05:41:20Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T05:41:20Z","title":"DynamicMem: A Long-Horizon Memory Benchmark in Real-World Settings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.22877","snapshot_observed_at":"2026-08-08T17:17:53.448806Z","title":"Dynamicmem: A long-horizon memory benchmark in real-world settings, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.448806Z"},"links":{"cited_paper":"/paper/2606.22877","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:8e58e6bb7196ae1df75a06dc1e0a0c3111c5bffbf4d1be87404dfadb95cb2fd4","observation_id":"1636cc8f-8755-4d64-a7a7-2d33cc89459b","resolution":{"observed_at":"2026-08-08T17:17:53.448806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.907058Z","title":"Lauvrak, Jon Atle Gulla, and Heri Ramampiaro","venue":null,"work_id":"504c760b-56c3-4376-a448-a0b0034b989d","year":2024},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.453682Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:e1b15ddf0c88a20291fa57e3d590ac847b6ff4f6917c4ac7d5584b44875fe02c","observation_id":"294eab45-e44f-4b36-b70a-debc93e08f27","resolution":{"observed_at":"2026-08-08T17:17:54.913126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.459192Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.459192Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:69763a836274c6add753c1b11cd739816f159f1494a2eb826de07d2579b00527","observation_id":"d87058c1-ad0c-498c-956d-3ab710d15acf","resolution":{"observed_at":"2026-08-08T17:17:53.459192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5712.38096","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.730742Z","title":"Promax: Exploring the potential of llm-derived profiles with distribution shaping for recommender systems","venue":null,"work_id":"a735a1a0-3624-467d-8ef5-0046e51c4704","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.464402Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:8d3890fd9b00a0c73cc430108974c610763b2784a0e65579a019d33bcb95adbe","observation_id":"19ce0ba7-0d2c-4154-8a0b-359a578a26b8","resolution":{"observed_at":"2026-08-08T17:17:53.739143Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09597","last_updated":"2025-02-13T18:52:03Z","snapshot_observed_at":"2026-08-07T20:50:37.813735Z","submitted_at":"2025-02-13T18:52:03Z","title":"Do LLMs Recognize Your Preferences? Evaluating Personalized Preference Following in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09597","snapshot_observed_at":"2026-08-08T17:17:53.469368Z","title":"Do llms recognize your preferences? evaluating personalized preference following in llms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.469368Z"},"links":{"cited_paper":"/paper/2502.09597","citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:bcfaa5e4b9707396dd8390361bf0c1320663178622674d6e2f3d01ca8312243d","observation_id":"adffac51-bba2-4278-aec2-65d48b3e81bd","resolution":{"observed_at":"2026-08-08T17:17:53.469368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.474220Z","title":"Cohen, and Emine Yilmaz","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.474220Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:01f349fa53631ef600550e21b7936cbb1bd9cd786d1a6370ecf1234ebe8560b0","observation_id":"d0a33fd7-19bc-4d37-b060-191a6d177e0e","resolution":{"observed_at":"2026-08-08T17:17:53.474220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.479258Z","title":"Cantonese cuisine","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.479258Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:06d40e1d91f7c862a832fae0ae6b351ddbb0b6afe58da0afdfcdca3b33582f3e","observation_id":"3bef6ec4-4c44-4604-9663-e53fa6a84e70","resolution":{"observed_at":"2026-08-08T17:17:53.479258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.891465Z","title":"You tend toward budget-conscious choices","venue":null,"work_id":"224b45ff-de6c-46b2-8dbc-1328ecb8a996","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.485499Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:fe4ba19ca89ada9ef12f3b554de65d8e4e741d20b4140560db64cc8e0ba0f943","observation_id":"46159ad9-2549-44f9-819d-091c4950fd99","resolution":{"observed_at":"2026-08-08T17:17:54.896381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.875143Z","title":"Note that cross-domain references serving the response are legitimate; offense occurs only when references are purely demonstrative","venue":null,"work_id":"a62a715e-8181-4ebf-9ad4-de0d203fb406","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.490402Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:80625346a826ce611ccd8e08c9139865dba09770d198a5c4626b8f54173fc97b","observation_id":"cbacb1d9-02bc-4d7d-911f-7b2fd1fbb502","resolution":{"observed_at":"2026-08-08T17:17:54.880274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.858992Z","title":"educate\" the user, such as","venue":null,"work_id":"5f9321c1-7208-4e07-aa70-c27b97c57873","year":2026},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.495608Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:0d7004e318ccd2973485752385ea754af66934eb4fdbe49dd76b6c526a0637e8","observation_id":"91dd12f4-3f53-478f-99a7-0b60caec758d","resolution":{"observed_at":"2026-08-08T17:17:54.863931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.842049Z","title":null,"venue":null,"work_id":"aa6058c1-9c95-4cd4-9f79-d8a35e4a8275","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.500517Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:8c9bdecd8250110ff1152eb7aaa36e1667d1ea856b7819e0b57b74e574592a1f","observation_id":"8d064032-1750-4f6c-9512-85b3a0f62214","resolution":{"observed_at":"2026-08-08T17:17:54.848030Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.825360Z","title":null,"venue":null,"work_id":"e4ff4688-e2a8-4bd4-a70a-f6f8467601fa","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.505050Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:5e5c155e5484bdc40df483c72979334f04830ed929dad087c836119ff20aa409","observation_id":"ad1790ac-5891-4b0f-ad40-1fab75938661","resolution":{"observed_at":"2026-08-08T17:17:54.830944Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.810080Z","title":"retrieval","venue":null,"work_id":"e6a52abf-cea0-48de-beab-4f810ee83bb2","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.509773Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:ddae0be7be51c0be3d664bc3f87336a1f2af8e94bdb67fc7e329361be2a933de","observation_id":"177d19fa-f24d-4b90-bd51-6c8034977286","resolution":{"observed_at":"2026-08-08T17:17:54.815062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.793331Z","title":"swap test","venue":null,"work_id":"37500662-6f87-4df2-ba91-8d2ba6533b2e","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.515287Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:06a8b667b69b94690b4b45b49dde4a8b0f5e8e30a684c3a21d76d73910532d6d","observation_id":"c704c8f8-0641-4b77-8a85-e02176aefcae","resolution":{"observed_at":"2026-08-08T17:17:54.799387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.776666Z","title":null,"venue":null,"work_id":"37ccff61-6ea6-4650-85cc-c6de06fd33e5","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.519873Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:5bab9c3fd2e67ad4523bdd4d6811de8e2446a9428a8a86f7d4e1588b6a961550","observation_id":"f44d3304-2982-4065-862d-6d738a01164c","resolution":{"observed_at":"2026-08-08T17:17:54.781914Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:54.761146Z","title":"retrieval","venue":null,"work_id":"edbd1a2c-db6d-4231-8f43-2d1a365ee546","year":null},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.524604Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:56507f7a7e7c9a5a246024968060e6905abc1a9c138871b432220436967b7cf5","observation_id":"7f5c301d-97ed-471f-a7b4-055c5b9993f3","resolution":{"observed_at":"2026-08-08T17:17:54.765834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:17:53.429103Z","title":"ISBN 979-8-89176-251-0","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T17:17:53.429103Z"},"links":{"citing_paper":"/paper/2608.05246"},"observation_digest":"sha256:5a21d12faf2a825842440a28610a1c4271c076dc87cf483b62755523fc281c0e","observation_id":"0e0385c0-3997-4f02-8d7f-73c7f45ff40a","resolution":{"observed_at":"2026-08-08T17:17:53.429103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05246","last_updated":"2026-08-05T15:11:06Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T16:10:14.725958Z","submitted_at":"2026-08-05T15:11:06Z","title":"LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":29,"verified_exact":2,"verified_fuzzy":17},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2608.05246."}