{"as_of":"2026-08-06T10:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4cdf1bedf1f3a8878da46eda1c496ff20b1a2280623bafeb8ac85fdb2e0536ca","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T07:12:53.858708Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.22411/citation-record","integrity":"/paper/2605.22411/integrity","json":"/paper/2605.22411/citation-record.json","paper":"/paper/2605.22411"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compress to impress: Unleashing the potential of compressive memory in real-world long-term conversations","venue":null,"work_id":"0310c1e1-c69a-42f1-b092-b0d5a985cce7","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:c13015f302864ab032af1036322cf15540ddf2560f2dc0ecfaac461889367426","observation_id":"b6ec7e82-2512-41f7-874d-640bc0e5b5d1","resolution":{"observed_at":"2026-05-22T07:14:43.238482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-02T07:32:11.339534Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":"2504.19413","doi":"10.48550/arxiv.2504.19413","metadata_source":"pith","pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","venue":"cs.CL","work_id":"a5aed26c-a248-48b6-a59e-f7693fcb180a","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:9aef25698b82d9b0c56e33813d450a033473dae504cef74cc23a66899e21d9b2","observation_id":"e929c0bd-deb7-439c-af1c-642ee2f7e4f8","resolution":{"observed_at":"2026-05-22T07:14:42.619628Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.00675","doi":"10.48550/arxiv.2505.00675","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Shicheng Fang, Yuxin Wang, Xiaoran Liu, Jiahao Lu, Chuanyuan Tan, Xinchi Chen, Yining Zheng, Xuanjing Huang, and Xipeng Qiu","venue":"arXiv (Cornell University)","work_id":"f9de7feb-ce6c-4d45-b99a-97f04b1c3acf","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:e12904c124387c81d162dc3dc9f3b9b35429791736d2e7e399c2a39253b009fa","observation_id":"4c8e470d-0e4c-45d7-a0ea-1e34854ca47c","resolution":{"observed_at":"2026-05-22T07:14:42.602699Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pan, Yuxin Jiang, and Kam-Fai Wong","venue":null,"work_id":"b9970ea6-1844-42b9-a92f-0181892ea9c9","year":2026},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:d638a343cb782a6a460afc75d524dfa589db7d0389b0854a607163b68c7f6a3c","observation_id":"27c0d6c3-5e6d-46e2-87b4-4c322ddb1709","resolution":{"observed_at":"2026-05-22T07:14:43.232195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16130","last_updated":"2025-02-19T10:49:41Z","snapshot_observed_at":"2026-07-06T18:05:11.700127Z","submitted_at":"2024-04-24T18:38:11Z","title":"From Local to Global: A Graph RAG Approach to Query-Focused Summarization","version":2},"cited_work":{"arxiv_id":"2404.16130","doi":"10.48550/arxiv.2404.16130","metadata_source":"pith","pith_arxiv_id":"2404.16130","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"From Local to Global: A Graph RAG Approach to Query-Focused Summarization","venue":"cs.CL","work_id":"588618d7-fd41-4053-b34d-a981f8793039","year":2024},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"cited_paper":"/paper/2404.16130","citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:94467186a4aa129c4038e652f78d26f4b34224a11d7f26bec01a88563f737f39","observation_id":"85c9117d-fe79-40ec-8ed9-0b8084ab9618","resolution":{"observed_at":"2026-05-22T07:14:42.608146Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:49:57.694079+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:49:57.694079+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lightmem: Lightweight and efficient memory-augmented generation","venue":null,"work_id":"e410be48-1075-41c7-87c8-d6b4295af238","year":2026},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:eb55ff7e8c5ddd4c2e9bc951586a7c7460182636b210438819e1f815e129cd11","observation_id":"26f6211a-9fd5-47f1-a230-82304a5a0ccc","resolution":{"observed_at":"2026-05-22T07:14:43.235507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11536","last_updated":"2025-04-17T16:46:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-15T18:10:22Z","title":"ReTool: Reinforcement Learning for Strategic Tool Use in LLMs","version":2},"cited_work":{"arxiv_id":"2504.11536","doi":"10.48550/arxiv.2504.11536","metadata_source":"pith","pith_arxiv_id":"2504.11536","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReTool: Reinforcement Learning for Strategic Tool Use in LLMs","venue":"cs.CL","work_id":"6da510e4-e55c-4412-b7c8-839984508e99","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"cited_paper":"/paper/2504.11536","citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:e98368a82ec3a142ea27f86bffa79bddce484c2213c2e8f7868eddbe9c98d981","observation_id":"09cb5fa0-d446-48d1-b2ae-3025df7313dc","resolution":{"observed_at":"2026-05-22T07:14:42.625287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-025-09422-z","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T03:06:43.562716Z","title":"doi: 10.1038/s41586-025-09422-z","venue":"Nature","work_id":"9835b482-5032-4135-93dd-82a066677569","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:dfc573420e459898f6b150b30f1129ad1ff2e55517df251352862a77d12c7efb","observation_id":"ebb3fe59-dd01-4df3-b1fb-486963511d9d","resolution":{"observed_at":"2026-05-22T07:14:42.262085Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-03T22:08:21.094896+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T22:08:21.094896+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-emnlp.568","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LightRAG: Simple and fast retrieval-augmented generation","venue":null,"work_id":"2c9d3575-68f9-496c-bb22-26cccb5e8b46","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:21a09fe686db9f1d1e8b28223df008be05e49cbd29d0862d30ccf7c4d4a7d356","observation_id":"8ee437bb-895f-4f73-84e4-36b99bca2a37","resolution":{"observed_at":"2026-05-22T07:14:42.252807Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T05:50:01.400176+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T05:50:01.400176+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From RAG to memory: Non-parametric continual learning for large language models","venue":null,"work_id":"c9babbf6-ec6c-482d-8574-3f1e44c24437","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:167a9666c5364fc2f7eb81262f94d54a7e3b5d5a827ce5cc407a264cb1430001","observation_id":"36f52cf2-e6fc-4a30-91ba-3f39220ca183","resolution":{"observed_at":"2026-05-22T07:14:43.277092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Memory in the age of AI agents","venue":null,"work_id":"f445889b-1c99-49e1-8dce-35bfda0957b6","year":null},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:38b7a31827a9aec53fd8e959b2f6b41df0d3f58a5225237249416ef2c86d29d5","observation_id":"7fd0b4df-c4ca-405e-a1c5-1e7a606b6d40","resolution":{"observed_at":"2026-05-22T07:14:43.271097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13564","last_updated":"2026-01-13T09:33:57Z","snapshot_observed_at":"2026-08-06T08:27:07.254588Z","submitted_at":"2025-12-15T17:22:34Z","title":"Memory in the Age of AI Agents","version":2},"cited_work":{"arxiv_id":"2512.13564","doi":"10.48550/arxiv.2512.13564","metadata_source":"pith","pith_arxiv_id":"2512.13564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory in the Age of AI Agents","venue":"cs.CL","work_id":"1ff75a14-302e-4906-aa86-1f96fbcf12ff","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"cited_paper":"/paper/2512.13564","citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:1aca8271083eced7031eb1a2209c49f95767d6021e0e37e438490e9897ceef80","observation_id":"8305fdd6-ee84-49fe-963e-7e92290261d3","resolution":{"observed_at":"2026-05-22T07:14:42.555665Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.06052","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T10:17:57.832911Z","title":"Rethinking memory mechanisms of foundation agents in the second half","venue":null,"work_id":"639480bb-7fee-4f7e-ac4f-23006d622bd4","year":2026},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:5c5b83a112165619770d1ac68e356eef9626b0210169e52a6b7fd0f3714e0e23","observation_id":"d3181dd0-d9a0-4a3f-8142-99b07410ad7d","resolution":{"observed_at":"2026-05-22T07:14:42.582038Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"WAGLE: Strategic weight attribution for effective and modular unlearning in large language models","venue":null,"work_id":"736c8301-2b9f-4a6e-9283-724ebcaf175a","year":null},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:93bf85bcc77b5c4f61cdf40db7362939f2acc2e44cc056b2c3ebff1c7842b257","observation_id":"aa938dba-804b-41be-8ab3-d3039b35406c","resolution":{"observed_at":"2026-05-22T07:14:43.274267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"207df0ff-7a0e-4461-a11d-f2a2241c4818","year":null},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:af2e6041e23402cb4050c5eaea375c54e24164859b25c46050f212a1f91d00c7","observation_id":"4869d813-cdb6-4f95-a749-ab241a2f0183","resolution":{"observed_at":"2026-05-22T07:14:43.311302Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The AI hippocampus: How far are we from human memory?Transactions on Machine Learning Research","venue":null,"work_id":"94c6804a-e1fc-4c17-9bc1-9281ac51a495","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:5fc12221bd62e1af0759e24fe2bd134dca7f21775e8a06aabca2656fd7961d16","observation_id":"c50d466d-475c-4a4f-8d7c-277eede80208","resolution":{"observed_at":"2026-05-22T07:14:43.307773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Graph chain-of-thought: Augmenting large language models by reasoning on graphs","venue":null,"work_id":"90aca2fd-bc19-4143-8fc3-62e33147cdb5","year":2024},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:9429746334a66498c853dae957f792ca6a43056f217eaa422ccc09f90dc350e9","observation_id":"121e9150-7d3d-4ed2-a67f-21e676c7155d","resolution":{"observed_at":"2026-05-22T07:14:43.352831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2503.09516","doi":"10.48550/arxiv.2503.09516","metadata_source":"pith","pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","venue":"cs.CL","work_id":"0e0b7549-2bc4-4574-aa7f-588ffa16eaae","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:25d69157497aa31c463f414698785f757212aebfeb243c1c30c69d2c9dde891c","observation_id":"000e768f-95b2-4ea4-9b1c-7d9006e0a1f7","resolution":{"observed_at":"2026-05-22T07:14:42.613636Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.1318","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory OS of AI agent","venue":null,"work_id":"601ee6ad-09cf-4713-b8f0-cbac91282f5a","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:242a6b29689d838a03c579e185ebe4db9d84ca9efdc6e5d21d45a5bb568f3a61","observation_id":"9ec9f7a7-6581-40da-a172-9268531c3ed2","resolution":{"observed_at":"2026-05-22T07:14:42.241512Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-22T07:53:27.319263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T07:53:27.319263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A human-inspired reading agent with gist memory of very long contexts","venue":null,"work_id":"1e08de5b-30b8-4352-8be4-5a34b2667553","year":2024},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:320e8cf291013071b5d953c1a3598c39c835b6cb826c108f4cc389c7af95d530","observation_id":"7e93b19c-a793-4a28-9048-f79f83ff6bef","resolution":{"observed_at":"2026-05-22T07:14:43.315001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hello again! LLM-powered personalized agent for long-term dialogue","venue":null,"work_id":"6469f872-c853-49d1-93e3-6d28d7ff6bb7","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:9829d32ca1c09eb3540bc453d057e79fa00b1d8bd682f1d03dfb5850b514bec1","observation_id":"ad9e4dee-8418-4a92-adbc-3077e769074f","resolution":{"observed_at":"2026-05-22T07:14:43.397485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"StructRAG: Boosting knowledge intensive reasoning of LLMs via inference-time hybrid information structurization","venue":null,"work_id":"03b67ca1-15d9-4d86-8879-63d2f6bd5049","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:5ff67f83d59bdf7e71c5960349307a8e20c2c73ae53d4cffc0e77260f6bfa032","observation_id":"f4f91aed-b793-4b01-94e8-d427ee99f693","resolution":{"observed_at":"2026-05-22T07:14:43.382850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1162/tacl_a_00638","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:27:45.037248Z","title":"Liu, Kevin Lin, John Hewitt, Ashwin Paranjape, Michele Bevilacqua, Fabio Petroni, and Percy Liang","venue":"Transactions of the Association for Computational Linguistics","work_id":"9c9c91f9-a321-4e33-8897-d66f6ad0f659","year":2024},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:7f2c662ddc24b243e32f52ba963071fd960203d60666daf005063283e0036b8e","observation_id":"3b023d38-1459-4e83-918c-0e455b44cf5a","resolution":{"observed_at":"2026-05-22T07:14:42.268455Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:34.34815+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:34.34815+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating very long-term conversational memory of LLM agents","venue":null,"work_id":"eb4b0bf7-8ff4-4513-907a-98516a04f9be","year":2024},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:a3574e1e99f47f2628751d09f969e5d1e2e3627c8fb88981388a080c76c9d8fc","observation_id":"ebc8388a-7004-4ef7-8a51-ca0ebc4a2800","resolution":{"observed_at":"2026-05-22T07:14:43.386301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards lifelong dialogue agents via timeline-based memory management","venue":null,"work_id":"35229141-575c-403b-be3c-60088b8969b7","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:5cf5b9bd2b9e61e982ed42d1e2e8b3bf4edee7cf1fc994f6a2d9c3a47997a2b7","observation_id":"1b3f97da-5f98-44ed-b665-0754d899882f","resolution":{"observed_at":"2026-05-22T07:14:43.393892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"URL https://aclanthology.org/2025","venue":null,"work_id":"7ef06787-8632-43c7-a57f-c5488479878a","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:6c13e1b777fcc8944cf438332ff5700d032729409030b295a50bf4cf981b41ea","observation_id":"743f32e2-7b70-4fbd-b5c0-43e70acc702d","resolution":{"observed_at":"2026-05-22T07:14:43.290760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08560","last_updated":"2024-02-12T18:59:46Z","snapshot_observed_at":"2026-08-03T06:31:15.541423Z","submitted_at":"2023-10-12T17:51:32Z","title":"MemGPT: Towards LLMs as Operating Systems","version":2},"cited_work":{"arxiv_id":"2310.08560","doi":"10.48550/arxiv.2310.08560","metadata_source":"pith","pith_arxiv_id":"2310.08560","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MemGPT: Towards LLMs as Operating Systems","venue":"cs.AI","work_id":"2698f5ad-c84c-40ca-b839-0912dae10ba2","year":2023},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"cited_paper":"/paper/2310.08560","citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:1decc115cea43f6a0f0c83721bcf2c7f91d3582ac760876bfe54eebd65c70b2f","observation_id":"6fd6118d-7133-42c9-bc17-70af9a2f83a9","resolution":{"observed_at":"2026-05-22T07:14:42.586716Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:49:35.543803+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:49:35.543803+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vicky Zhao, Lili Qiu, and Dongmei Zhang","venue":null,"work_id":"76500625-806f-4e92-9fd9-03c78184bc8d","year":2024},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:a011558417acdbf20a07ffea0253c78a2bb47d5f6ce4b8ae2c4589009e59f608","observation_id":"4a781d9c-e68e-40b1-a7f8-1584e6f1a429","resolution":{"observed_at":"2026-05-22T07:14:43.280404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vicky Zhao, Lili Qiu, and Jianfeng Gao","venue":null,"work_id":"b65c0119-e411-4720-a4e9-e4822531ba82","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:f3a9523b2c1db423734a8577222607eb1fb82b6e8d5f18e2646a82acb7733e93","observation_id":"f1d90ce5-9fe7-42fe-aa09-fcea4e65b7b0","resolution":{"observed_at":"2026-05-22T07:14:43.390016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T22:03:00.258416Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"cb2f98fd-e2a3-43fe-8a48-f229210a5ad9","year":2023},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:e81fe6a0648fc6dd857c0221e38e7697f4f4882ccc687cc54402991400c14e51","observation_id":"65c43476-86f6-466d-bae0-549a6c9b4096","resolution":{"observed_at":"2026-05-22T07:14:43.303837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From isolated conversations to hierarchical schemas: Dynamic tree memory representation for LLMs","venue":null,"work_id":"6f6c47c2-816b-44d9-9884-23304ecd67cb","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:1de752bd8433ef0d808964e51556958b16c4b811c9a69270a9867501f25ad3e8","observation_id":"563ea9fd-3266-44f8-9420-c30f8045af77","resolution":{"observed_at":"2026-05-22T07:14:43.297958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.16720","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:13:44.485296Z","title":"Beyond pipelines: A survey of the paradigm shift toward model-native agentic ai","venue":null,"work_id":"0be99430-4f16-44bf-b742-3fd3f99090ea","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:e9a14108b4c9692614a92660ef718e7d0a8a19728d12aeb11fb767a2d3982488","observation_id":"f35adffb-f1a3-4bb1-b135-11c76417fdd3","resolution":{"observed_at":"2026-05-22T07:14:42.571472Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:929d8dd13bd60d909c94dc5c7f9168579dfd3c91f6a39a7274815d0d1faf0d7c","observation_id":"52b63478-50d0-4120-ada9-db9a599ec3e7","resolution":{"observed_at":"2026-05-22T07:14:42.550928Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:a74f2ba7c86d2eb41310c95a7e3b174dafffe5ed901b96573a009a46c23f46a5","observation_id":"d6ec1e76-9f93-487c-b981-d3d1bd41ca31","resolution":{"observed_at":"2026-05-22T07:14:42.591379Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"REMem: Reasoning with episodic memory in language agent","venue":null,"work_id":"f2b260a1-37fb-440c-96f8-7901e5656abd","year":2026},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:dadcb4d16387cebce73265eed753468e9a22442c96a7ad5ff55bf669762fae22","observation_id":"5541c654-2fa8-4701-9043-822dab76bf99","resolution":{"observed_at":"2026-05-22T07:14:43.264828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.07478","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:09:40.689499Z","title":"Enhancing agentic rl with progressive reward shaping and value-based sampling policy optimization","venue":null,"work_id":"0889d9fc-65f0-4e95-a80d-900dfcaf72fd","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:2fe3f0d9e1666b58afb28f17249ea1d42bc5133c45c2bbe43aa45ae81267a9cb","observation_id":"442462eb-6a84-4179-93eb-0619b3136783","resolution":{"observed_at":"2026-05-22T07:14:42.597245Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.eacl-long.15","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"H-MEM: Hierarchical memory for high-efficiency long-term reasoning in LLM agents","venue":null,"work_id":"3c27f62c-d5df-4ce3-9710-f5c2d6a79c32","year":2026},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:745ee2c2095e392e9795005d21f304b5a90c41adf0fc41d788d6b58f190c5579","observation_id":"adc74125-a222-4f7b-9ed3-f75116bceb09","resolution":{"observed_at":"2026-05-22T07:14:42.256266Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-22T07:53:27.692521+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T07:53:27.692521+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In prospect and retrospect: Reflective memory management for long-term personalized dialogue agents","venue":null,"work_id":"e85d5665-48bc-4d94-802d-a4029df65323","year":null},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:37a3ed016ff2475b41baef3ea620196875809bac3118655dba4b59a4b2067a22","observation_id":"113ff078-094d-44b7-9b2e-320d365caccc","resolution":{"observed_at":"2026-05-22T07:14:43.321700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"URL https://aclanthology.org/2025","venue":null,"work_id":"af0165a7-4558-4ad8-aa57-ecc55ade59de","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:e9eff01eb75d5e6e9384340e80f0deeba87c767aa35b2fa7d904a5c7e7931e57","observation_id":"4b7b985b-7a31-44b3-bb66-c57cc6ac159c","resolution":{"observed_at":"2026-05-22T07:14:43.283489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TRL: Transformers Re- inforcement Learning","venue":null,"work_id":"3f14a484-f894-49b4-9953-ff757b46dfc3","year":2020},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:ed7cc7d7d6a83b797aa421c1c5d3c1661b67dce51856aff54b1aab2bedf43c6f","observation_id":"c86ef2ba-e0aa-4ec4-9651-3cc07b621e5c","resolution":{"observed_at":"2026-05-22T07:14:43.255245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.130193","doi":"10.1016/j.neucom.2025.130193","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Recursively summarizing enables long-term dialogue memory in large language models.Neurocomputing, 639:130193","venue":"Neurocomputing","work_id":"df7e2a4c-0056-4af2-9325-5b1c66dd6264","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:158ea1203ba2d7bc763b6aae09f0c195f669abd4d7b3a559bf054606a2a5df70","observation_id":"0a039c99-0b27-4384-a6ae-af3a8fdc773e","resolution":{"observed_at":"2026-05-22T07:14:42.273953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-22T07:53:28.223748+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T07:53:28.223748+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2024/917","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Beyond the limits: A survey of techniques to extend the context length in large language models","venue":null,"work_id":"8be7fbc2-ad74-4a25-a828-ca3c3d490f41","year":2024},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:72a4365382ad98fe9c245bbeb79252185e6852d68cacb7cf5a61255b8b25ad93","observation_id":"fad69038-f189-40a7-8e64-0d3031d270d8","resolution":{"observed_at":"2026-05-22T07:14:42.249118Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-22T07:53:28.691788+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T07:53:28.691788+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning with verifiable rewards implicitly incentivizes correct reasoning in base LLMs","venue":null,"work_id":"8cbe9060-bc4e-4874-8884-6f98b1749539","year":2026},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:00250411346fc1952c23280ba34af23fb43780cd87a2a49a0f2fca827009e4fe","observation_id":"d09889b3-53d1-47c9-bca7-d18e05434008","resolution":{"observed_at":"2026-05-22T07:14:43.258552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Long- memeval: Benchmarking chat assistants on long-term interactive memory","venue":null,"work_id":"060a66aa-77b7-40ab-ae69-456a395b8f05","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:aeee175213d75abaef7eca4f3ce29f43e8ea25a55605421926f1ada3918c7a7b","observation_id":"0790ef41-9d8d-4146-b3a7-03130eb40414","resolution":{"observed_at":"2026-05-22T07:14:43.318366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15965","last_updated":"2025-04-23T13:47:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T15:05:04Z","title":"From Human Memory to AI Memory: A Survey on Memory Mechanisms in the Era of LLMs","version":2},"cited_work":{"arxiv_id":"2504.15965","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.15965","snapshot_observed_at":"2026-07-10T23:37:42.877598Z","title":"From Human Memory to AI Memory: A Survey on Memory Mechanisms in the Era of LLMs","venue":"cs.IR","work_id":"56f08885-28c9-4956-88e1-91190c6ca650","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"cited_paper":"/paper/2504.15965","citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:af89d27b28450063e9909bffe34078c8866b8148bafb16390fae7d013b17948e","observation_id":"8c22e7dc-ca84-4232-8506-dd999ca5a5cd","resolution":{"observed_at":"2026-05-22T07:14:42.566026Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DaGRPO: Rectifying gradient conflict in reasoning via distinctiveness-aware group relative policy optimization","venue":null,"work_id":"a818db5d-7c24-4ca3-9ef0-cc3f3ea50965","year":2026},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:8bb26c9f40092b8c904000782b82aab5fff23bb276e1b3cae97bca6177c983ba","observation_id":"97149ad2-4f0a-4c8e-85fb-3a0e0ea2b094","resolution":{"observed_at":"2026-05-22T07:14:43.252015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From single to multi- granularity: Toward long-term memory association and selection of conversational agents","venue":null,"work_id":"c7cdb5c0-3b0c-44d1-8d41-08ece06ee35f","year":2026},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:376d5bc97cb6609eedef17c1661ebfb5720b5f2effc886176812eeb1d09eb396","observation_id":"7461bf18-2913-4027-8de2-46d7e68d5b58","resolution":{"observed_at":"2026-05-22T07:14:43.248715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"RECOMP: Improving retrieval-augmented LMs with context compression and selective augmentation","venue":null,"work_id":"94985e07-288c-44c0-9d82-87e65e83ea43","year":2024},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:89fd7675f54c7489b531bbc5494c4001ba5cc389027e0d947a40042f9b409b08","observation_id":"cd15d4a9-03c0-450a-8031-7ba62debb3dd","resolution":{"observed_at":"2026-05-22T07:14:43.261695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A-mem: Agentic memory for LLM agents","venue":null,"work_id":"8bc90c7d-7ed0-4434-b0e7-3f830b1fe9f4","year":2026},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:408bd1c7fca81624491763a2fcc9d0aadf5d3b4b7ac2e4da13c1d7f3e700a92a","observation_id":"cebe6c5f-9f90-4827-9cdd-816cf738090c","resolution":{"observed_at":"2026-05-22T07:14:43.286427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.18423","doi":"10.48550/arxiv.2511.18423","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"General agentic memory via deep research","venue":"arXiv (Cornell University)","work_id":"92430067-3994-46b0-a950-e1aa11df56d1","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:70785b6000c7bb89d72fcd64a98c2f4ff56ce1ebff80988d6719b205f4bc5f66","observation_id":"510e563e-b34f-4d48-a904-967024d11e1e","resolution":{"observed_at":"2026-05-22T07:14:42.545982Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19828","last_updated":"2026-01-14T14:21:21Z","snapshot_observed_at":"2026-07-06T22:19:28.487854Z","submitted_at":"2025-08-27T12:26:55Z","title":"Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2508.19828","doi":"10.48550/arxiv.2508.19828","metadata_source":"pith","pith_arxiv_id":"2508.19828","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning","venue":"cs.CL","work_id":"2a070440-2167-4398-be97-c2d4c3ee3541","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"cited_paper":"/paper/2508.19828","citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:d6cc11ca4bb7a0f5543badd387e7b1d01dfd06a7d113aaac6885c7237d18f6f2","observation_id":"34689446-ff67-4006-816b-fac4817aa373","resolution":{"observed_at":"2026-05-22T07:14:42.576513Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:49:35.802766+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:49:35.802766+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DAPO: An open-source LLM reinforcement learning system at scale","venue":null,"work_id":"8f4ae243-c97b-4c7a-b8e8-e84955118632","year":2026},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:0bfa24ae7a83701b97f53b02481037612eabaa3ca2c997c0682c7a9d7ec612cd","observation_id":"9c05502d-2c37-4fee-97c0-ae5b93f27659","resolution":{"observed_at":"2026-05-22T07:14:43.241802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:16:17.496047Z","title":"Does reinforcement learning really incentivize reasoning capacity in LLMs beyond the base model? InThe Thirty-ninth Annual Conference on Neural Information Processing Systems","venue":null,"work_id":"65aef5f9-6da8-49a8-8054-3da923aa4b74","year":2026},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:987e19ec6e88375ff1fa34809d604e9ac3255a9891e62dc17eb4936a72cb1394","observation_id":"2f88e147-0257-4fe5-87c6-2da701550591","resolution":{"observed_at":"2026-05-22T07:14:43.245220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The landscape of agentic reinforcement learning for llms: A survey.Transactions on Machine Learning Research, 2026","venue":null,"work_id":"19c489f7-af3d-4b42-a25f-b8ecd1d4e10c","year":2026},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:23efcb2a9662d8d1d85e101c6db9506558034078f7309a4aa30c93d7a5774490","observation_id":"d01dcc88-5d96-4cb0-9529-5b5809dc369c","resolution":{"observed_at":"2026-05-22T07:14:43.268187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"da7dcaba-d0f5-450e-bee9-635f925ff9eb","year":null},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:553fe2fb2e2c28fce38aed1785918a39da05b47b3c8aa6ec255b2891f011a919","observation_id":"f4a8eac5-67ec-451c-9d5a-0b8d054f4377","resolution":{"observed_at":"2026-05-22T07:14:43.294208Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Assomem: Scalable memory QA with multi-signal associative retrieval","venue":null,"work_id":"3f0d243d-870e-4829-82ce-5c4a57634b1e","year":2026},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:7601938620cecec1e9b346681693731553c02e330c866839f1def8f8dfc86a97","observation_id":"39a36bbe-e4e3-41f7-9ea3-61a42cd9406b","resolution":{"observed_at":"2026-05-22T07:14:43.376535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bridging intuitive associations and de- liberate recall: Empowering LLM personal assistant with graph-structured long-term mem- ory","venue":null,"work_id":"f24a2626-55bd-43d6-a3f2-4c9fba079892","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:6bafeef63d7606e8c3bec4048ffbc4705864cf5f829e8d1406db4e5b0e5dcc69","observation_id":"ff7adc53-86d0-4a7a-8096-a3a11eefd621","resolution":{"observed_at":"2026-05-22T07:14:43.369604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3748302","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A survey on the memory mechanism of large language model- based agents.ACM Transactions on Information Systems, 43(6):155:1–155:47","venue":"ACM Transactions on Information Systems","work_id":"523e1a9d-c782-4e01-9644-c33da60ddd2e","year":2025},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:4c696ed894b4797172e178967fbfd59d4be17834659ee72b21229b25c45c2842","observation_id":"61e9f2a5-52cb-4b8d-aa09-78d90bab3cb4","resolution":{"observed_at":"2026-05-22T07:14:42.245034Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-01T10:38:14.23452+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T10:38:14.23452+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v38i17.29946","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T17:37:13.769849Z","title":"Adversarial eval","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"43456f70-b374-4adb-97b5-6ec329c73793","year":2026},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:491d42cfe5cebbe37f7aeac41af81a34200068f488b5fcd6dbd78743c44bba03","observation_id":"09837a21-c24a-48ca-9276-02a270c3763b","resolution":{"observed_at":"2026-05-22T07:14:42.265150Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-01T10:38:14.072172+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T10:38:14.072172+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Consider each message one by one","venue":null,"work_id":"2ef16e50-9474-4be7-987b-9094d2d21716","year":null},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:87a76006c03b97bae1f981b1ce9e57d6c08e2a928c1f73ba652d7b764f6cd365","observation_id":"fb41c653-b54c-4ad8-a5b5-34659bcf3cd7","resolution":{"observed_at":"2026-05-22T07:14:43.372993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"msg_id\" to","venue":null,"work_id":"f9a18a54-4445-41ed-8aad-3bef2eaca117","year":null},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:488143d0991a418208b3bbca0c8fbb5a44565ade02eac5ece81f3ba29172a5e2","observation_id":"96467e33-a841-4828-a376-0f45038068de","resolution":{"observed_at":"2026-05-22T07:14:43.379974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"msg_id\" in","venue":null,"work_id":"bb7ff2fa-d254-4fe3-8ebb-1b1a5bff77da","year":null},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:ca9a7bd26d282797ede7855e444bbf206e3f33965a42db49bdc7de197194a778","observation_id":"5f3d49eb-8783-42b4-a00f-6099d9504248","resolution":{"observed_at":"2026-05-22T07:14:43.366222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"info\" self-contained: - Conduct reference resolution (pronouns, ellipsis, named entities) when the referent is unambiguous in its surrounding context. - Interpret","venue":null,"work_id":"d4f34a11-91f8-4fb6-8855-5e6d25373869","year":null},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:aabd02dd6e7ce4f3fe3b6a7b4ff945bf52ddb54386e736e02d10f420cdf04472","observation_id":"58958375-aa3e-481e-86ed-e9476384d6d6","resolution":{"observed_at":"2026-05-22T07:14:43.400953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"education field","venue":null,"work_id":"3dc4bf7d-984d-4ff4-8659-aea3451df706","year":null},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:558e4d7502b68c8c8486bc7637eaafa320de7ce1ea426d00a19f7c8666eae3a7","observation_id":"d86d5c8a-ae7a-4a1f-b59b-2db768f75160","resolution":{"observed_at":"2026-05-22T07:14:43.359857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"this message is useful because","venue":null,"work_id":"5a98a7be-cb99-460f-a3c6-eea16c9310a6","year":null},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:9f4e99a16531be5e541b2e381f23c1046fa4557b870fc450d9761a9bb1712b0d","observation_id":"8ab3b701-8b15-4929-9487-348f96dc776f","resolution":{"observed_at":"2026-05-22T07:14:43.363105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"useful_msg","venue":null,"work_id":"6d7afe68-e1ca-4301-9948-2027fcfb6a17","year":2023},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:929d615187bbea71fedd5dae3cdefc36b6ef4c12d3589500905cce9edc65aa28","observation_id":"f378dcb1-400b-4206-b6c5-136579a3e768","resolution":{"observed_at":"2026-05-22T07:14:43.330683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d499101b-e413-4538-bd8b-f95f5b54a8ff","year":null},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:2ca8ffa700210b2dc394888b6121e61dfa53e47eb94c44feabfc3d0449c49414","observation_id":"bc0f174d-6e45-49f0-b291-afd0b4675247","resolution":{"observed_at":"2026-05-22T07:14:43.356560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"user\", \"assistant","venue":null,"work_id":"c452f773-be32-49ab-9afc-15ec5b28c37f","year":2023},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:a12222b5052954458ca70f07492eebfb608439917162b6c017bd5d513e896edd","observation_id":"092fac47-1424-4ac4-a507-8b60dae3affd","resolution":{"observed_at":"2026-05-22T07:14:43.324420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5da73195-f074-4338-b6a9-01e535056124","year":null},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:155e01ec9ce7a9267c48af41dde451dd41b00707abd763b998133561f408fca0","observation_id":"f65934fb-ff73-4da0-8858-72131fd1620a","resolution":{"observed_at":"2026-05-22T07:14:43.327468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7978.0075","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I/we/my\" are from the perspective of the TARGET MESSAGE’s speaker. -","venue":null,"work_id":"7bc9d0f5-2865-48dc-a1ac-f5ebe7ef18cc","year":2023},"citing_paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-22T07:12:53.858708Z"},"links":{"citing_paper":"/paper/2605.22411"},"observation_digest":"sha256:a33c85952689c4213856905cd7f30d95f356c2001b8592adb9307521c0ad939f","observation_id":"a404c475-592e-4b98-878d-f647f5bf14af","resolution":{"observed_at":"2026-05-22T07:14:42.561019Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.22411","last_updated":"2026-05-21T12:36:46Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T15:34:14.363362Z","submitted_at":"2026-05-21T12:36:46Z","title":"DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":4,"verified_exact":23,"verified_fuzzy":41},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 0 inbound Pith citation observations for arXiv:2605.22411."}