{"as_of":"2026-08-08T11:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:22236954c3d6d90bf81f9da3bc87fd7bc5b5182b42146816465c4373186afbda","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:42:49.542276Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T14:51:27.110839Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T23:26:22.230033Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"cited_work":{"arxiv_id":"2506.12915","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12915","snapshot_observed_at":"2026-07-01T23:26:22.230033Z","title":"Personafeedback: A large-scale human-annotated benchmark for personalization.arXiv preprint arXiv:2506.12915,","venue":null,"work_id":"fdcec0a3-5fda-45f2-8c22-a5afd925893d","year":2025},"citing_paper":{"arxiv_id":"2603.26680","last_updated":"2026-05-11T16:07:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-09T11:06:19Z","title":"AlpsBench: An LLM Personalization Benchmark for Real-Dialogue Memorization and Preference Alignment","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-15T14:50:23.587894Z"},"links":{"cited_paper":"/paper/2506.12915","citing_paper":"/paper/2603.26680"},"observation_digest":"sha256:df3f0e8e3aa2e1282cfa995e7b34704cf410e243a8e8ff38acaa431b00179b2c","observation_id":"1beb8346-8819-4887-8d18-355c24811f45","resolution":{"observed_at":"2026-05-15T14:51:08.344417Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"cited_work":{"arxiv_id":"2506.12915","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12915","snapshot_observed_at":"2026-07-01T23:26:22.230033Z","title":"Personafeedback: A large-scale human-annotated benchmark for personalization.arXiv preprint arXiv:2506.12915,","venue":null,"work_id":"fdcec0a3-5fda-45f2-8c22-a5afd925893d","year":2025},"citing_paper":{"arxiv_id":"2606.02300","last_updated":"2026-06-01T14:23:17Z","snapshot_observed_at":"2026-07-06T23:42:44.661608Z","submitted_at":"2026-06-01T14:23:17Z","title":"Beyond Isolated Behaviors: Hierarchical User Modeling for LLM Personalization","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:27.110839Z"},"links":{"cited_paper":"/paper/2506.12915","citing_paper":"/paper/2606.02300"},"observation_digest":"sha256:f46032a86b9d2be7e0beeeb1c971f40ca00c642e436b551defed9dd51b2843f1","observation_id":"1a8b8716-b32f-4be0-85d8-05f974e0118d","resolution":{"observed_at":"2026-07-01T22:56:20.508725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"cited_work":{"arxiv_id":"2506.12915","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12915","snapshot_observed_at":"2026-07-01T23:26:22.230033Z","title":"Personafeedback: A large-scale human-annotated benchmark for personalization.arXiv preprint arXiv:2506.12915,","venue":null,"work_id":"fdcec0a3-5fda-45f2-8c22-a5afd925893d","year":2025},"citing_paper":{"arxiv_id":"2606.02798","last_updated":"2026-06-01T19:04:36Z","snapshot_observed_at":"2026-08-06T16:00:21.523460Z","submitted_at":"2026-06-01T19:04:36Z","title":"BehaviorBench: Modeling Real-World User Decisions from Behavioral Traces","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T14:25:04.965228Z"},"links":{"cited_paper":"/paper/2506.12915","citing_paper":"/paper/2606.02798"},"observation_digest":"sha256:188e0fa7ef472520f8165760952374e2807e61b5afe370d50b7a5bb51943a706","observation_id":"a79d1622-dd64-44c9-9ceb-3422a5b9d438","resolution":{"observed_at":"2026-07-01T23:26:22.232555Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.12915/citation-record","integrity":"/paper/2506.12915/integrity","json":"/paper/2506.12915/citation-record.json","paper":"/paper/2506.12915"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.838924Z","title":"Llama 3 model card","venue":null,"work_id":"cde4d026-c20d-4d19-ac55-28568df569c1","year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:43.116952Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:d14c454d1426a2b38d460408f56e4f1c77957402ef105d94ea9a9b737d23ecea","observation_id":"df9fe52e-ff70-4ff4-afbf-c7761ecfa2dc","resolution":{"observed_at":"2026-08-07T00:42:50.843270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.824307Z","title":"Introducing Claude, 2023","venue":null,"work_id":"3b03d708-719c-4167-a80c-ba19ce071e45","year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:43.188670Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:c8f6c1c58e85dc30be4d4f4b1286efb00ff350c210423d6bd9d7d152cb42d35e","observation_id":"b19c539b-7d07-4fe1-bbde-cbdbdad264cb","resolution":{"observed_at":"2026-08-07T00:42:50.828770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.808602Z","title":"Explainable recommendations via attentive multi-persona collaborative filtering","venue":null,"work_id":"76da7d58-b8e1-4ab9-98f9-9561da540564","year":2020},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:43.265144Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:e30391954478313fb25bc8da8d997bf80b58cbdf6310f811104b0f726622fa19","observation_id":"ff1e70a9-6682-4a2b-a50d-a011166f801d","resolution":{"observed_at":"2026-08-07T00:42:50.813694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.790903Z","title":null,"venue":null,"work_id":"cd976429-29dd-4404-8067-bb05d027d323","year":1952},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:43.356103Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:5e81caaaee0547d6a6896b23cf26564eca10b5ce57af8fa0a09e146913deb39c","observation_id":"f3b75099-335c-4262-b5c2-1fe692280546","resolution":{"observed_at":"2026-08-07T00:42:50.796199Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15498","last_updated":"2023-05-24T18:40:43Z","snapshot_observed_at":"2026-07-06T15:32:54.279309Z","submitted_at":"2023-05-24T18:40:43Z","title":"Large Language Models for User Interest Journeys","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15498","snapshot_observed_at":"2026-08-07T00:42:43.472270Z","title":"Large language models for user interest journeys.arXiv preprint arXiv:2305.15498, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:43.472270Z"},"links":{"cited_paper":"/paper/2305.15498","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:d0705f517aec07c15a68dcbe471e0ab8244409a810827b5503a766d6d857cee0","observation_id":"561a77ed-1958-4873-8564-51d59a221274","resolution":{"observed_at":"2026-08-07T00:42:43.472270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T00:42:43.629485Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:43.629485Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:60d1af1283251ff723fbca442a1c2bdfaaf3b6292284e313e7c500a6e8e4ab6d","observation_id":"8a3216b6-73a9-4a1e-9a0d-be5db0003b2b","resolution":{"observed_at":"2026-08-07T00:42:43.629485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.775610Z","title":"Language-based user profiles for recommendation, 2024","venue":null,"work_id":"ea13d07c-cced-44c5-97c1-bcc9e949aedc","year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:43.726112Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:2021be09db210f6748a10067b4b6e49a2134acceb5a7e08f3b8a136a64656c83","observation_id":"d8741c97-87a6-4dd9-acba-06bdd36e5ccf","resolution":{"observed_at":"2026-08-07T00:42:50.780640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T00:42:43.815017Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:43.815017Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:7464da0f890a8d8e8ef25f91a3997b39ca8867b920c20351898ae63837963947","observation_id":"899e24ab-2fc9-4c62-acf9-65dd0abb82dc","resolution":{"observed_at":"2026-08-07T00:42:43.815017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07863","last_updated":"2024-11-12T11:18:43Z","snapshot_observed_at":"2026-08-07T08:32:00.916309Z","submitted_at":"2024-05-13T15:50:39Z","title":"RLHF Workflow: From Reward Modeling to Online RLHF","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07863","snapshot_observed_at":"2026-08-07T00:42:43.921624Z","title":"Rlhf workflow: From reward modeling to online rlhf.arXiv preprint arXiv:2405.07863, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:43.921624Z"},"links":{"cited_paper":"/paper/2405.07863","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:81362251e863e0a75889e91127ff8fda8ccb9b98fe9f7a6b6d0deb00b5dd6173","observation_id":"d72be3e2-a298-4fb3-8d48-4f70bb024aab","resolution":{"observed_at":"2026-08-07T00:42:43.921624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10164","last_updated":"2024-09-16T10:54:04Z","snapshot_observed_at":"2026-07-06T19:15:56.947205Z","submitted_at":"2024-09-16T10:54:04Z","title":"Quantile Regression for Distributional Reward Models in RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10164","snapshot_observed_at":"2026-08-07T00:42:44.017650Z","title":"Quantile regression for distributional reward models in rlhf.arXiv preprint arXiv:2409.10164, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:44.017650Z"},"links":{"cited_paper":"/paper/2409.10164","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:d03e33c84089759d378f7e558f0c7a7deeadb56f123078568cacfd82d5308252","observation_id":"605a7477-2042-4cab-a746-468a1fb2b8d0","resolution":{"observed_at":"2026-08-07T00:42:44.017650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.759908Z","title":"Statistics (international student edition).Pisani, R","venue":null,"work_id":"ce457ede-223c-498b-b78e-dcde31fcfd5e","year":2007},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:44.098073Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:c0e7c84bde0dce588b804d06130cf7fef4b57f905a229138627730224ba1a016","observation_id":"45001a41-529d-4669-9d0c-f91bbbfda397","resolution":{"observed_at":"2026-08-07T00:42:50.765154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13108","last_updated":"2024-01-01T14:26:39Z","snapshot_observed_at":"2026-07-06T17:06:00.378648Z","submitted_at":"2023-12-20T15:28:38Z","title":"ASSISTGUI: Task-Oriented Desktop Graphical User Interface Automation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13108","snapshot_observed_at":"2026-08-07T00:42:44.206786Z","title":"Assistgui: Task-oriented desktop graphical user interface automation.arXiv preprint arXiv:2312.13108, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:44.206786Z"},"links":{"cited_paper":"/paper/2312.13108","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:198909be0e408e4cdab5bf0f9a2736602ddae5eeb02f44d8663cbb38df7d5e92","observation_id":"03d740ed-0988-4b0f-a89b-85fbd99e33db","resolution":{"observed_at":"2026-08-07T00:42:44.206786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:44.309282Z","title":"Maxwell Harper and Joseph A","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:44.309282Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:dd3f6c26d727259cac5c864ed5620f6a6bdbea2aba66f13326c6bf4772a74744","observation_id":"1193d218-ba07-48e8-89ba-7d602c4bbcfe","resolution":{"observed_at":"2026-08-07T00:42:44.309282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T00:42:44.407417Z","title":"Lora: Low-rank adaptation of large language models.arXiv preprint arXiv:2106.09685, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:44.407417Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:074a033248e84984156a1f16a947879cd36a636235623ccbe6b26f67d2f6bb64","observation_id":"b1884a62-b91b-4376-a3a7-d49738113ca5","resolution":{"observed_at":"2026-08-07T00:42:44.407417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T00:42:44.528247Z","title":"Mistral 7b.arXiv preprint arXiv:2310.06825, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:44.528247Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:bb62345b371d89d2b5821cfacb84e7e310daf58f1e9656a952bc89aa0b9f51e7","observation_id":"1d126f49-7c51-46de-99e0-93dbcd3e385a","resolution":{"observed_at":"2026-08-07T00:42:44.528247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:44.598568Z","title":"Know me, respond to me: Benchmarking llms for dynamic user profiling and personalized responses at scale","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:44.598568Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:1123117d4595f04b8df812565387d32612f9a7bb9865b31cd7c50c40e4c39f20","observation_id":"fd144a6d-b9b9-4cfc-9103-81a078686f19","resolution":{"observed_at":"2026-08-07T00:42:44.598568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.744656Z","title":"Do llms understand user preferences? evaluating llms on user rating prediction, 2023","venue":null,"work_id":"c6931887-12d8-4f4a-91c7-459719366e3c","year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:44.661027Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:a555b8fef1a46b9a16c7d2d4e560a3a6739f5ea456a70f94e4b5e64d8fd605c4","observation_id":"dbe554b2-9e60-4dd1-a25c-75daaa960b0f","resolution":{"observed_at":"2026-08-07T00:42:50.749534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.728397Z","title":"Smith, and Hannaneh Hajishirzi","venue":null,"work_id":"fed3778c-be56-4b48-bf5b-e2f8cb5fa476","year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:44.747736Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:b777baab27d9c6e370f884c9cbd83312e71ba0222428fa5e160553f63266b6a3","observation_id":"acce208d-69f1-44cb-9511-5df271303cc5","resolution":{"observed_at":"2026-08-07T00:42:50.732943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07968","last_updated":"2023-08-15T18:06:23Z","snapshot_observed_at":"2026-08-03T15:59:42.686889Z","submitted_at":"2023-08-15T18:06:23Z","title":"Teach LLMs to Personalize -- An Approach inspired by Writing Education","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07968","snapshot_observed_at":"2026-08-07T00:42:44.839306Z","title":"Teach llms to personalize–an approach inspired by writing education.arXiv preprint arXiv:2308.07968, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:44.839306Z"},"links":{"cited_paper":"/paper/2308.07968","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:5bd9db20b436b7456ffd6b927f1e8cb122a4ffea615ead27749af66831fd084f","observation_id":"9082a722-79eb-41b9-b5cd-4d17e4b93a5f","resolution":{"observed_at":"2026-08-07T00:42:44.839306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00599","last_updated":"2024-03-31T08:10:50Z","snapshot_observed_at":"2026-08-07T19:41:09.683401Z","submitted_at":"2024-03-31T08:10:50Z","title":"EvoCodeBench: An Evolving Code Generation Benchmark Aligned with Real-World Code Repositories","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00599","snapshot_observed_at":"2026-08-07T00:42:44.993579Z","title":"Evocodebench: An evolving code generation benchmark aligned with real-world code repositories.arXiv preprint arXiv:2404.00599, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:44.993579Z"},"links":{"cited_paper":"/paper/2404.00599","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:a1bf422b58f24f46e7e8e50ecc0c1797c632d57d71cae91271fa0559b233c311","observation_id":"0b93c821-47e3-4fe1-8aa4-28568b20c44b","resolution":{"observed_at":"2026-08-07T00:42:44.993579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:45.206984Z","title":"Personal llm agents: Insights and survey about the capability, efficiency and security, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:45.206984Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:362c9b11e4ba31c58fed1d7a8a45a47762dbc54c2176403f733129833f58b3a7","observation_id":"025f6729-5c25-481f-bdfe-384501a9f724","resolution":{"observed_at":"2026-08-07T00:42:45.206984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T00:42:45.417302Z","title":"Deepseek-v3 technical report.arXiv preprint arXiv:2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:45.417302Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:13b670f6f2a4e491d0b0b59e2b0df54cba0e9b6ae68aadb2e1d63783279e1560","observation_id":"973c623b-a330-4568-a22f-3e7161ae9a37","resolution":{"observed_at":"2026-08-07T00:42:45.417302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-08-07T05:53:12.643515Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18451","snapshot_observed_at":"2026-08-07T00:42:45.662556Z","title":"Skywork-reward: Bag of tricks for reward modeling in llms.arXiv preprint arXiv:2410.18451, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:45.662556Z"},"links":{"cited_paper":"/paper/2410.18451","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:e43545cf39a47fbcb05106012f07fff949b03d2c279b0a3e47ea275b625a2b32","observation_id":"de613ca4-0ea1-418f-be08-dc47640c140d","resolution":{"observed_at":"2026-08-07T00:42:45.662556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:45.826955Z","title":"Gaia: a benchmark for general ai assistants","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:45.826955Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:83ea38482710fa408bc16f0b20d4e5c21c6f95111b44c76226dc146dfb63537f","observation_id":"55e67858-b126-43f9-ac1b-997055aa356e","resolution":{"observed_at":"2026-08-07T00:42:45.826955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.690997Z","title":"Inf-orm-llama3.1-70b, 2024","venue":null,"work_id":"a908542b-b4c4-49ee-b7e5-2b9a962e8871","year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:45.986279Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:753e5bf53504df485a823b215ba07a47ff67cdccf0f713d26efdd6e7c47b0f43","observation_id":"4dabe5ad-e1e6-4a06-b7a2-938676365973","resolution":{"observed_at":"2026-08-07T00:42:50.695554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09180","last_updated":"2024-11-05T03:34:10Z","snapshot_observed_at":"2026-07-06T16:48:05.271182Z","submitted_at":"2023-11-15T18:19:58Z","title":"Pearl: Personalizing Large Language Model Writing Assistants with Generation-Calibrated Retrievers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09180","snapshot_observed_at":"2026-08-07T00:42:46.217896Z","title":"Pearl: Personalizing large language model writing assistants with generation-calibrated retrievers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:46.217896Z"},"links":{"cited_paper":"/paper/2311.09180","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:9e4b9fa8af7855304687d11da12fadc54c1e5b33bdb138791c1411a7faca6d96","observation_id":"9d26339a-a4ce-4341-8da2-a6ddfd21d52d","resolution":{"observed_at":"2026-08-07T00:42:46.217896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:46.468846Z","title":"Justifying recommendations using distantly-labeled reviews and fine-grained aspects","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:46.468846Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:4b396d83991e1fad0011a84e7456ae48dc43e8168281cf29d9b31b20d60e57fc","observation_id":"a502846c-f74d-497d-bbef-3624da7b143c","resolution":{"observed_at":"2026-08-07T00:42:46.468846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:46.669467Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:46.669467Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:ff53323dc32b933b743f7191e8d695fac938cc49a372a9dc2d76616f920f24b0","observation_id":"d1461068-c92c-4a21-ac22-b1f37d22cb80","resolution":{"observed_at":"2026-08-07T00:42:46.669467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.663962Z","title":"Offsetbias: Leveraging debiased data for tuning evaluators, 2024","venue":null,"work_id":"10f3d7e7-410e-44c7-94e8-374e8437e02b","year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:46.759553Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:ba6f7f84052c4b1a53160fe62470f4f7a9969683387761a299291647d1f03ecc","observation_id":"f960dc81-d99d-495c-91f7-ec993c0142c3","resolution":{"observed_at":"2026-08-07T00:42:50.669232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20081","last_updated":"2023-10-30T23:40:41Z","snapshot_observed_at":"2026-07-06T16:40:51.343918Z","submitted_at":"2023-10-30T23:40:41Z","title":"Integrating Summarization and Retrieval for Enhanced Personalization via Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20081","snapshot_observed_at":"2026-08-07T00:42:46.830983Z","title":"Integrating summarization and retrieval for enhanced personalization via large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:46.830983Z"},"links":{"cited_paper":"/paper/2310.20081","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:784ea1a2d1db1614ebc7f1443f6f4f0c6101a84776c35f9bf058322cfbb21687","observation_id":"f83332af-f9fb-4ed0-8352-46c1c07a1adc","resolution":{"observed_at":"2026-08-07T00:42:46.830983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.648307Z","title":"Optimization methods for personalizing large language models through retrieval augmentation","venue":null,"work_id":"a43f0944-7ad6-4a0f-9cfd-b3818589fb82","year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:46.893593Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:7f4fc7ea9c2c484a39d3cdda4e9083ff30695ab7539b40171ec672112f0ac3a5","observation_id":"e299f189-bbd1-4955-8105-9907101978a1","resolution":{"observed_at":"2026-08-07T00:42:50.653364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.632543Z","title":"Lamp: When large language models meet personalization, 2024","venue":null,"work_id":"df3da039-6540-4bef-b8c5-90c82548619c","year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:46.993342Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:d03ef014f800e4a182a439c0a5aa56779da64ca384c898076c80800de1f7b752","observation_id":"38b19d84-5506-4f08-969a-747f6f9600da","resolution":{"observed_at":"2026-08-07T00:42:50.637116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11518","last_updated":"2023-12-23T21:39:52Z","snapshot_observed_at":"2026-07-06T17:04:50.608413Z","submitted_at":"2023-12-11T03:59:36Z","title":"User Modeling in the Era of Large Language Models: Current Research and Future Directions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11518","snapshot_observed_at":"2026-08-07T00:42:47.082342Z","title":"User modeling in the era of large language models: Current research and future directions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:47.082342Z"},"links":{"cited_paper":"/paper/2312.11518","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:6e24f1ed85e2db64a65ce27c18f3332acbd5165ff36cbc4aa9388517a463e2cb","observation_id":"7bdf8faf-4cd0-42c0-a1b0-dbfbb3010824","resolution":{"observed_at":"2026-08-07T00:42:47.082342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04401","last_updated":"2025-02-08T20:01:56Z","snapshot_observed_at":"2026-08-06T06:47:59.560379Z","submitted_at":"2024-02-06T21:03:52Z","title":"Democratizing Large Language Models via Personalized Parameter-Efficient Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04401","snapshot_observed_at":"2026-08-07T00:42:47.145964Z","title":"Democratizing large language models via personalized parameter-efficient fine-tuning.arXiv preprint arXiv:2402.04401, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:47.145964Z"},"links":{"cited_paper":"/paper/2402.04401","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:815d0b92010a9702ce6196f48d3dc38564627da24da750d1a614523ac4521972","observation_id":"d461b08c-aee2-4354-9315-d2dac31d9b72","resolution":{"observed_at":"2026-08-07T00:42:47.145964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09432","last_updated":"2024-04-04T13:27:38Z","snapshot_observed_at":"2026-07-06T17:16:59.193820Z","submitted_at":"2023-12-17T17:57:50Z","title":"RoleCraft-GLM: Advancing Personalized Role-Playing in Large Language Models","version":2},"cited_work":{"arxiv_id":"2401.09432","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.09432","snapshot_observed_at":"2026-08-07T00:42:50.081214Z","title":"RoleCraft-GLM: Advancing Personalized Role-Playing in Large Language Models","venue":"cs.CL","work_id":"ee8bfc58-a128-4be4-bd82-9f6e01f94d19","year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:47.232242Z"},"links":{"cited_paper":"/paper/2401.09432","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:373d2aa1f29faa86947aa8ff77c6850d1880d2aa169050e32c5a0e6c1b210f62","observation_id":"434d6938-67d5-464d-9f87-cec2fd64484b","resolution":{"observed_at":"2026-08-07T00:42:50.086889Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:47.309915Z","title":"Qwq-32b: Embracing the power of reinforcement learning, March 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:47.309915Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:8ad92d825d30ba826facae7010cbc44e45878c99b22f393e18654454c42b32c0","observation_id":"0685e883-6cb0-4d03-b974-b7dbd8af8505","resolution":{"observed_at":"2026-08-07T00:42:47.309915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T00:42:47.380532Z","title":"Llama 2: Open foundation and fine-tuned chat models.CoRR, abs/2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:47.380532Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:eecbc79e42631d5655c810625c70bc3d43b902c19be439a901d997dc49f78da1","observation_id":"52a40200-fdec-478b-9b9b-eb2ab9254003","resolution":{"observed_at":"2026-08-07T00:42:47.380532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:47.488090Z","title":"Interpretable preferences via multi- objective reward modeling and mixture-of-experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:47.488090Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:8eeb291a07919d61a77f1b1cd65643426a6849c8c0a722c16b59417f60d2b11b","observation_id":"eb62ce9f-152e-48f4-bb12-f0185e72ab63","resolution":{"observed_at":"2026-08-07T00:42:47.488090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17268","last_updated":"2024-01-30T18:58:43Z","snapshot_observed_at":"2026-08-07T06:25:49.480096Z","submitted_at":"2024-01-30T18:58:43Z","title":"Weaver: Foundation Models for Creative Writing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17268","snapshot_observed_at":"2026-08-07T00:42:47.548157Z","title":"Weaver: Foundation models for creative writing.arXiv preprint arXiv:2401.17268, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:47.548157Z"},"links":{"cited_paper":"/paper/2401.17268","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:7be6525556d4f752299731a62dc90c1635abd9c7069274e706f9c368a3c24b60","observation_id":"6a019766-1fae-4bd3-be1d-cea19a4539d4","resolution":{"observed_at":"2026-08-07T00:42:47.548157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13103","last_updated":"2024-12-17T17:17:03Z","snapshot_observed_at":"2026-08-04T15:41:20.898389Z","submitted_at":"2024-12-17T17:17:03Z","title":"AI PERSONA: Towards Life-long Personalization of LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13103","snapshot_observed_at":"2026-08-07T00:42:47.668122Z","title":"Ai persona: Towards life-long personalization of llms.arXiv preprint arXiv:2412.13103, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:47.668122Z"},"links":{"cited_paper":"/paper/2412.13103","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:0bda67df7de06ea4c9fc9a0f68a3911304979d01b65c54a1cefa0ff9ac222fc0","observation_id":"07794934-94f4-48a7-ab18-1e99d21aad81","resolution":{"observed_at":"2026-08-07T00:42:47.668122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09528","last_updated":"2023-11-16T03:13:29Z","snapshot_observed_at":"2026-07-06T16:48:21.364659Z","submitted_at":"2023-11-16T03:13:29Z","title":"HelpSteer: Multi-attribute Helpfulness Dataset for SteerLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09528","snapshot_observed_at":"2026-08-07T00:42:47.768903Z","title":"Helpsteer: Multi-attribute helpfulness dataset for steerlm","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:47.768903Z"},"links":{"cited_paper":"/paper/2311.09528","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:d63c0f7bd5ca596d76365273d3720349fdcaef19eee7b26465a0e71964f28d5b","observation_id":"8d710010-a9d1-489c-94c5-ad874f411ade","resolution":{"observed_at":"2026-08-07T00:42:47.768903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08673","last_updated":"2024-06-12T22:28:08Z","snapshot_observed_at":"2026-07-06T18:29:58.140132Z","submitted_at":"2024-06-12T22:28:08Z","title":"HelpSteer2: Open-source dataset for training top-performing reward models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08673","snapshot_observed_at":"2026-08-07T00:42:47.880878Z","title":"Helpsteer2: Open-source dataset for training top-performing reward models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:47.880878Z"},"links":{"cited_paper":"/paper/2406.08673","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:8473078c8d5ec6b243b654d5236615ffaf2283292dbcba0563a9585dda454d93","observation_id":"b3b23bd3-640a-4e84-89ff-091dd43c11d9","resolution":{"observed_at":"2026-08-07T00:42:47.880878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.597241Z","title":"Personalized large language models, 2024","venue":null,"work_id":"169b3112-a8da-4d11-9424-9b9244640f10","year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:47.977115Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:91d5eb664421034b0a1d49580eb1c899874fe02b2e2217922575ed38c94681b2","observation_id":"aa31f723-4050-45ba-beab-792317fd412c","resolution":{"observed_at":"2026-08-07T00:42:50.601764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.581264Z","title":"Travelplanner: A benchmark for real-world planning with language agents","venue":null,"work_id":"1acccebf-50df-4f74-970f-79dd9425131d","year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:48.038867Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:5661cefefbcb7ed6eaba3d77cfc18d86f81fa4231a68f40ad376b30b69e4e8e1","observation_id":"c2f88625-db39-4e3e-8f3f-1633a63acba6","resolution":{"observed_at":"2026-08-07T00:42:50.586415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:48.114443Z","title":"Iterative preference learning from human feedback: Bridging theory and practice for rlhf under kl-constraint, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:48.114443Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:9df8e6eef842cdca3fffe9291bea307ab3dac156234b93c3dc77f5edaa397c0d","observation_id":"443bcc92-0eec-47b2-91f2-6e23338da4aa","resolution":{"observed_at":"2026-08-07T00:42:48.114443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T00:42:48.319868Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:48.319868Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:35a99899a0dd9adb51b60ce93ddbc05f8dd3b128aace6ab27e3dd0c127d1e69d","observation_id":"90af4112-5601-42c0-8992-089a64fef636","resolution":{"observed_at":"2026-08-07T00:42:48.319868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14994","last_updated":"2023-10-19T00:45:51Z","snapshot_observed_at":"2026-07-06T15:32:25.931739Z","submitted_at":"2023-05-24T10:30:42Z","title":"RefGPT: Dialogue Generation of GPT, by GPT, and for GPT","version":3},"cited_work":{"arxiv_id":"2305.14994","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.14994","snapshot_observed_at":"2026-08-07T00:42:49.837250Z","title":"RefGPT: Dialogue Generation of GPT, by GPT, and for GPT","venue":"cs.CL","work_id":"3b843681-bdaf-4060-a687-e8acd20dca4a","year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:48.395777Z"},"links":{"cited_paper":"/paper/2305.14994","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:e9a893e21a2e6e198d1d3b69bed6679b8bb00421be8e0e6ea2cb3d8bd0f2cf3c","observation_id":"48cd27ac-c3ea-4593-8bf8-e05e9953898a","resolution":{"observed_at":"2026-08-07T00:42:49.854512Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.554864Z","title":"Palr: Personalization aware llms for recommendation, 2023","venue":null,"work_id":"60848db1-8945-4b64-82af-bfd75b3534d3","year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:48.483560Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:4ec328d45badf0d77e8196146cc3ddacc32a24459fa679b8019825816daa633f","observation_id":"fd8a4f3d-b645-4051-a713-0c8618677e9a","resolution":{"observed_at":"2026-08-07T00:42:50.559366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15673","last_updated":"2023-05-25T02:45:22Z","snapshot_observed_at":"2026-08-05T03:58:58.539757Z","submitted_at":"2023-05-25T02:45:22Z","title":"BookGPT: A General Framework for Book Recommendation Empowered by Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15673","snapshot_observed_at":"2026-08-07T00:42:48.564482Z","title":"Bookgpt: A general framework for book recommen- dation empowered by large language model.arXiv preprint arXiv:2305.15673, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:48.564482Z"},"links":{"cited_paper":"/paper/2305.15673","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:6ca102c6170e5ab14f88ce267b3995a222c3c9b785bced58890813e99cae67b5","observation_id":"c8ca9a81-b836-42c8-b79c-0ed0a04d842c","resolution":{"observed_at":"2026-08-07T00:42:48.564482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-07T00:42:48.631231Z","title":"Instruction-following evaluation for large language models.arXiv preprint arXiv:2311.07911, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:48.631231Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:a8acd6d0c2201e69a2925e34157fd5ebe185583b3bf2b548af09190dddca723d","observation_id":"51d0cc83-eb94-4122-8a29-3233366d4fdf","resolution":{"observed_at":"2026-08-07T00:42:48.631231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:48.711798Z","title":"Learning to predict persona information for dialogue personalization without explicit persona description","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:48.711798Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:d597507f09b78b6395fb697ebd05c17d003315543d04841fee63002f9710a9e2","observation_id":"8788018d-c404-4c45-bc0a-847d301b557f","resolution":{"observed_at":"2026-08-07T00:42:48.711798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20296","last_updated":"2025-02-24T16:00:16Z","snapshot_observed_at":"2026-07-06T19:24:35.007698Z","submitted_at":"2024-09-30T13:55:42Z","title":"PersonalLLM: Tailoring LLMs to Individual Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20296","snapshot_observed_at":"2026-08-07T00:42:48.799048Z","title":"+HelpSteer2 Personalized Trained","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:48.799048Z"},"links":{"cited_paper":"/paper/2409.20296","citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:9fa9fa400fd13f9bb7b81d9631928edc0a6fa86d2491054e648e36cb099b7356","observation_id":"94f043c8-85a3-4f6f-9cca-51230c272405","resolution":{"observed_at":"2026-08-07T00:42:48.799048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.540242Z","title":"Avoid purely factual queries","venue":null,"work_id":"868b740d-7fe5-4ddf-94ac-26048644ffc6","year":null},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:48.864789Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:7fc5b1c3ab9b2cfb38bde96f467e2b185f438fb80f61f60e6bc8a2ef9b3c0024","observation_id":"aa98592d-827f-404c-b1a4-3de0e13ce052","resolution":{"observed_at":"2026-08-07T00:42:50.544671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.525300Z","title":"Do not awkwardly mash memory scenes and persona configuration","venue":null,"work_id":"bb195f64-87d0-4f42-8b39-9e5d6e14ad27","year":null},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:48.938392Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:e48dee267c1733d4a7ceb07003c78df8177d33e96c426cf1a23e53d61f493088","observation_id":"cdbe10b5-461b-4df8-bd19-a0bf147a9a1d","resolution":{"observed_at":"2026-08-07T00:42:50.530177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.509898Z","title":null,"venue":null,"work_id":"e8ed7cbf-412a-453b-b85f-bf44b45a16cb","year":null},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:49.000542Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:76c6b769b97e5cba71bc3983294aec4e11bd29c91deb4bf747eaca9127702e7e","observation_id":"f0962368-c738-45f3-801e-ccc15cbcfc52","resolution":{"observed_at":"2026-08-07T00:42:50.514814Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.491953Z","title":null,"venue":null,"work_id":"ffb9596f-8914-4226-b65e-275551da0f50","year":null},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:49.072393Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:d2f4c36c78a3f93076a8163d42f27204f8d94423fc3e97f082cc364dff83ece2","observation_id":"08bba89e-7836-4ab4-b1ed-d1d2f60846c5","resolution":{"observed_at":"2026-08-07T00:42:50.496231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.477075Z","title":"Instead, infer what the user might want based on their existing persona configuration, rather than just combining field details","venue":null,"work_id":"e56daff9-219a-4d6c-a700-9793f325f067","year":null},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:49.172406Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:382d3d3d39de3d3b4fa2a1eee34502d404e3d062d907bc92ef9bc63c3559ee88","observation_id":"6f0cf8fc-877e-4f07-8129-e9174fd3afa4","resolution":{"observed_at":"2026-08-07T00:42:50.481803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.462330Z","title":null,"venue":null,"work_id":"c5126cc3-0a4a-4566-b61e-9250247c1f4c","year":null},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:49.319156Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:7f2f8c41d961def3151270262531cd7484e49469e664250b70bd0871ec36f222","observation_id":"a89e8741-4e83-4f7e-992d-b71feb342576","resolution":{"observed_at":"2026-08-07T00:42:50.466452Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.446944Z","title":null,"venue":null,"work_id":"a0d7fa68-99c0-4e23-a12d-a15c5a3cf7ad","year":null},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:49.423886Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:9c748bed12985c6907e541e175e8b6ceb2a598fd31fd7b8b4ff4d0420f1a0e90","observation_id":"d39cdb81-053f-4132-bcff-6707cbe688bc","resolution":{"observed_at":"2026-08-07T00:42:50.451650Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:50.431165Z","title":"For instance, add overly general or irrelevant information, or provide vague or overly broad advice","venue":null,"work_id":"a7dd4d4b-2d4c-4d72-be36-a0aa555a5e73","year":null},"citing_paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:49.542276Z"},"links":{"citing_paper":"/paper/2506.12915"},"observation_digest":"sha256:6fb6c91703ffeecd3043d0058b186bd57599dbc9e4b765190d3c8c01d3fbc508","observation_id":"862f2935-76d3-4266-85f9-654c411cc260","resolution":{"observed_at":"2026-08-07T00:42:50.435777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.12915","last_updated":"2025-06-15T17:19:19Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T00:34:00.489875Z","submitted_at":"2025-06-15T17:19:19Z","title":"PersonaFeedback: A Large-scale Human-annotated Benchmark For Personalization"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":2,"verified_fuzzy":18},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 3 inbound Pith citation observations for arXiv:2506.12915."}