{"as_of":"2026-08-06T03:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:02316e8113a22493f40eec30071598ffd6173f46385a52750a0ae363a25023a5","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T07:31:00.010342Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T10:07:16.700499Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-02T03:26:28.755836Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"cited_work":{"arxiv_id":"2605.30159","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.30159","snapshot_observed_at":"2026-07-02T03:26:28.755836Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","venue":"cs.AI","work_id":"8722da0e-248e-4d65-801c-177bda494802","year":2026},"citing_paper":{"arxiv_id":"2606.03503","last_updated":"2026-06-02T11:21:27Z","snapshot_observed_at":"2026-08-02T04:20:08.895288Z","submitted_at":"2026-06-02T11:21:27Z","title":"ThoughtFold: Folding Reasoning Chains via Introspective Preference Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T10:07:16.700499Z"},"links":{"cited_paper":"/paper/2605.30159","citing_paper":"/paper/2606.03503"},"observation_digest":"sha256:524dd2d5b9ad67148353b3283295f0be67ff14af4096c97ed9705ce5d40808b0","observation_id":"07c7eee8-2297-4021-9873-67667021732c","resolution":{"observed_at":"2026-07-02T03:26:28.757256Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.30159/citation-record","integrity":"/paper/2605.30159/integrity","json":"/paper/2605.30159/citation-record.json","paper":"/paper/2605.30159"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-02T07:32:11.339534Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":"2504.19413","doi":"10.48550/arxiv.2504.19413","metadata_source":"pith","pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","venue":"cs.CL","work_id":"a5aed26c-a248-48b6-a59e-f7693fcb180a","year":2025},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:9e88f4e3179ba0ddabd8b06a3ed7dda4589eaa54e86a5e177ec4add97ee87590","observation_id":"b585e253-a62f-420b-9a00-216649f204a1","resolution":{"observed_at":"2026-06-29T07:33:13.440771Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01456","last_updated":"2025-09-26T09:25:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-03T15:43:48Z","title":"Process Reinforcement through Implicit Rewards","version":2},"cited_work":{"arxiv_id":"2502.01456","doi":"10.48550/arxiv.2502.01456","metadata_source":"pith","pith_arxiv_id":"2502.01456","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Process Reinforcement through Implicit Rewards","venue":"cs.LG","work_id":"c31a2126-86f9-44f3-91f3-208d0fc1463a","year":2025},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2502.01456","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:f16a8cfaf5c602f412f67866259a4f619b10a9ce017b7cbd2b15fe936339410b","observation_id":"bebaa282-e6ff-49e3-91c6-b9c8ddb06350","resolution":{"observed_at":"2026-06-29T07:33:13.443443Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:3c2340f8da5eac8e8b5523d80f5e9fb30c52a4d57231ec79639296c1844f1b49","observation_id":"8452a397-d936-41a6-b52c-1f1547935804","resolution":{"observed_at":"2026-06-29T07:33:13.451103Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:fe585b458d6ac10bb192480e46fac01f8c5abeec177501a29c3a84766b95b7f5","observation_id":"04094eff-3cb8-4982-b4b2-1901071e3489","resolution":{"observed_at":"2026-06-29T07:33:13.427264Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.07670","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:47:48.310753Z","title":"Memory for autonomous llm agents: Mechanisms, evaluation, and emerging frontiers","venue":null,"work_id":"9aecac84-4c67-4c0c-80b2-942f93760de7","year":2026},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:3e017c0a0cf8bbc210200254f6ab4de4a0d14d0be0ac7c37c7d2d5fed43f9d22","observation_id":"359d6454-51cb-451a-89d6-ad8e082fec26","resolution":{"observed_at":"2026-06-29T07:33:13.446261Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:6f19fe6218b65ecf5fe74f79e3104e9ea1e6f4b919c152ce0ebf2e086c140c2d","observation_id":"98e01cf1-c8ee-41b9-944c-fc76ca98086e","resolution":{"observed_at":"2026-06-29T07:33:13.418528Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.10150","last_updated":"2026-04-29T10:02:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-11T10:17:38Z","title":"Rethinking Entropy Interventions in RLVR: An Entropy Change Perspective","version":4},"cited_work":{"arxiv_id":"2510.10150","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.10150","snapshot_observed_at":"2026-07-04T08:29:41.999322Z","title":"Rethinking Entropy Interventions in RLVR: An Entropy Change Perspective","venue":"cs.LG","work_id":"32e0712a-e9d7-451f-8c18-f895f13eab70","year":2025},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2510.10150","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:d0ab165a0a4626f8f2db7ce7c8313c8ab3004830113172c39ebf4142a30d6b9a","observation_id":"4df8dfc9-3156-404a-90ff-4d5ce39d6888","resolution":{"observed_at":"2026-06-29T07:33:13.417177Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2503.09516","doi":"10.48550/arxiv.2503.09516","metadata_source":"pith","pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","venue":"cs.CL","work_id":"0e0b7549-2bc4-4574-aa7f-588ffa16eaae","year":2025},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:6dad6b3b17891f66183537e08d8de5b89f1a94b22b6dcde1cfa8744c9ca272ba","observation_id":"4888566a-4858-4236-a375-faf78d8a3704","resolution":{"observed_at":"2026-06-29T07:33:13.419713Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":"2207.05221","doi":"10.1145/3618260.3649777","metadata_source":"pith","pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Models (Mostly) Know What They Know","venue":"cs.CL","work_id":"8ca58a10-da41-4f70-baae-7e449512e345","year":2022},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:792eb99a62f94fc4240eea3777b5ba6b7d961d58d271865b8403116d49906748","observation_id":"78574955-d4b7-4858-8373-56432812f4fe","resolution":{"observed_at":"2026-06-29T07:33:13.421934Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22101","last_updated":"2025-05-28T08:27:12Z","snapshot_observed_at":"2026-07-06T21:31:59.333003Z","submitted_at":"2025-05-28T08:27:12Z","title":"MemOS: An Operating System for Memory-Augmented Generation (MAG) in Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.22101","doi":"10.48550/arxiv.2505.22101","metadata_source":"pith","pith_arxiv_id":"2505.22101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MemOS: An operating system for memory-augmented generation","venue":"cs.CL","work_id":"62f802d2-2c22-4140-9b3d-b8b7220f772e","year":2025},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2505.22101","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:3b7b0941ade0f0733c2e6db75d2553a3b9feb0c01ee487a36385970deaced56f","observation_id":"632117b4-0a02-4cb0-bda5-82a73380ecf6","resolution":{"observed_at":"2026-06-29T07:33:13.424789Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.17407","doi":"10.48550/arxiv.2503.17407","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"ArXiv.org","work_id":"be8fd688-04f6-455b-90d8-ef53714c6510","year":2025},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:e2e9be67e3550103a477cbcf7265b71c447d0a6cadfa108e874f646bf7b7a218","observation_id":"35e0d7ff-494d-4f4f-9086-a51e9ba35b79","resolution":{"observed_at":"2026-06-29T07:33:13.449553Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08560","last_updated":"2024-02-12T18:59:46Z","snapshot_observed_at":"2026-08-03T06:31:15.541423Z","submitted_at":"2023-10-12T17:51:32Z","title":"MemGPT: Towards LLMs as Operating Systems","version":2},"cited_work":{"arxiv_id":"2310.08560","doi":"10.48550/arxiv.2310.08560","metadata_source":"pith","pith_arxiv_id":"2310.08560","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MemGPT: Towards LLMs as Operating Systems","venue":"cs.AI","work_id":"2698f5ad-c84c-40ca-b839-0912dae10ba2","year":2023},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2310.08560","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:f7c800b7d4a8e6699afca069d9bbb4c3ed2c1fe1450245f8a2be9e313dd00f1b","observation_id":"651aa359-ad3a-482a-80b2-e287fb96455c","resolution":{"observed_at":"2026-06-29T07:33:13.413069Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:49:35.543803+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:49:35.543803+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/0022-247x(65","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:33:12.802412Z","title":"Sufficientstatisticsintheoptimumcontrolofstochasticsystems","venue":null,"work_id":"e8742465-dafc-4690-8235-41705a6d2723","year":1965},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:e60e1c0494d37b3a8ed332907f85f623a41d1f1d55cd583a59dc2edc4eda5213","observation_id":"94f834d4-9b01-44a7-8798-b16d8535b2f7","resolution":{"observed_at":"2026-06-29T07:33:12.803942Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.10560","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T20:58:57.340683Z","title":"When to mem- orize and when to stop: Gated recurrent memory for long-context reasoning.arXiv preprint arXiv:2602.10560","venue":null,"work_id":"28b254a7-f83e-4e72-9dd3-823b857ac95e","year":2026},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:34741d7bd4028fba94877c61dc5004376e8bf83ae11d979a51943a432ab572c4","observation_id":"a017bad6-bd36-4321-8257-45c8144e4699","resolution":{"observed_at":"2026-06-29T07:33:13.410692Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1287/opre","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An Exact Solution Approach for Portfolio Op- timization Problems Under Stochastic and Integer Constraints","venue":"Operations Research","work_id":"0217f174-e3f0-48af-9e8f-5f05c213ab3e","year":2020},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:3f5692787c267725eda16e4e8f603ed60e15722e0fa59f49a628ee9544d8cc75","observation_id":"95236416-bdb3-4e50-8797-557039790449","resolution":{"observed_at":"2026-06-29T07:33:12.804635Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25911","last_updated":"2025-09-30T08:02:34Z","snapshot_observed_at":"2026-08-06T02:56:06.576393Z","submitted_at":"2025-09-30T08:02:34Z","title":"Mem-{\\alpha}: Learning Memory Construction via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2509.25911","doi":"10.48550/arxiv.2509.25911","metadata_source":"pith","pith_arxiv_id":"2509.25911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mem-{\\alpha}: Learning Memory Construction via Reinforcement Learning","venue":"cs.CL","work_id":"4643330b-80ff-49a5-bbb1-e618edaffe35","year":2025},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2509.25911","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:c30857ccbadbf06a86c0921fd51522902fa4f76c3715271481d3f9b320855757","observation_id":"aa27fdd6-a2aa-4ece-8a39-4bc4fe442977","resolution":{"observed_at":"2026-06-29T07:33:13.448579Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-17T20:50:53.619604+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T20:50:53.619604+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12110","last_updated":"2025-10-08T01:46:37Z","snapshot_observed_at":"2026-08-03T02:27:06.991396Z","submitted_at":"2025-02-17T18:36:14Z","title":"A-MEM: Agentic Memory for LLM Agents","version":11},"cited_work":{"arxiv_id":"2502.12110","doi":"10.48550/arxiv.2502.12110","metadata_source":"pith","pith_arxiv_id":"2502.12110","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A-MEM: Agentic Memory for LLM Agents","venue":"cs.CL","work_id":"3b98feb2-fdb1-479a-bbe4-2c298a4592e2","year":2025},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2502.12110","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:648c2d32ec985e9de2c55681a12b2d55ea09337c7c515d179a5a27f4175accc9","observation_id":"e17ebc96-e040-4f10-a35e-e316a78efe2e","resolution":{"observed_at":"2026-06-29T07:33:13.453403Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02259","last_updated":"2026-07-29T12:55:39Z","snapshot_observed_at":"2026-08-01T23:32:07.108143Z","submitted_at":"2025-07-03T03:11:50Z","title":"MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent","version":2},"cited_work":{"arxiv_id":"2507.02259","doi":"10.48550/arxiv.2507.02259","metadata_source":"pith","pith_arxiv_id":"2507.02259","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent","venue":"cs.CL","work_id":"ac66fe72-b869-4874-8a9d-c110b849da0c","year":2025},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2507.02259","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:19a27f7376b4b288c2b5b9fab1d1645e18f739ded658737bdb1d0fefd75e1838","observation_id":"a23a96b3-fd48-4893-9fcc-49dd1682cf3e","resolution":{"observed_at":"2026-06-29T07:33:13.455884Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07774","last_updated":"2026-04-17T07:11:03Z","snapshot_observed_at":"2026-08-04T07:44:45.294840Z","submitted_at":"2025-10-09T04:30:45Z","title":"Curing Miracle Steps in LLM Mathematical Reasoning with Rubric Rewards","version":3},"cited_work":{"arxiv_id":"2510.07774","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.07774","snapshot_observed_at":"2026-06-29T07:33:13.439883Z","title":"Curing Miracle Steps in LLM Mathematical Reasoning with Rubric Rewards","venue":"cs.CL","work_id":"bc268546-0e33-453c-bbf9-83ab1e15925e","year":2025},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2510.07774","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:51a4e631629dd99c3f30a7b7e13e0f2d4fa1ae34fdfa463f6c89882e2a2985c6","observation_id":"72c9f816-fa26-4953-b09a-8c18f05d28f8","resolution":{"observed_at":"2026-06-29T07:33:13.441071Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08827","last_updated":"2025-10-09T17:08:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-10T17:59:43Z","title":"A Survey of Reinforcement Learning for Large Reasoning Models","version":3},"cited_work":{"arxiv_id":"2509.08827","doi":"10.48550/arxiv.2509.08827","metadata_source":"pith","pith_arxiv_id":"2509.08827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Reinforcement Learning for Large Reasoning Models","venue":"cs.CL","work_id":"7618c14b-e527-4268-9926-d4f462ea9925","year":2025},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2509.08827","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:9a23dd5dab8ca4b4c54aa7f2399792ff46f3f00f33f70af9791eb30923793281","observation_id":"7e2bdf7f-a62d-40e0-bbfe-2779a55f5ccd","resolution":{"observed_at":"2026-06-29T07:33:13.446098Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:31:00.010342Z","title":"Deepresearcher: Scaling deep research via reinforcement learning in real-world environments","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:265ea87d6ab958735c757a7295cb0639e11dbcab23c24049cdafd885c436ad71","observation_id":"ae60c598-1e6c-45c4-9fae-cdfddec9e110","resolution":{"observed_at":"2026-06-29T07:31:00.010342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15841","last_updated":"2025-07-17T08:53:48Z","snapshot_observed_at":"2026-08-04T10:58:41.179508Z","submitted_at":"2025-06-18T19:44:46Z","title":"MEM1: Learning to Synergize Memory and Reasoning for Efficient Long-Horizon Agents","version":2},"cited_work":{"arxiv_id":"2506.15841","doi":"10.48550/arxiv.2506.15841","metadata_source":"pith","pith_arxiv_id":"2506.15841","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MEM1: Learning to Synergize Memory and Reasoning for Efficient Long-Horizon Agents","venue":"cs.CL","work_id":"43cfa793-fb98-4501-8224-4dfb9e56285c","year":2025},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"cited_paper":"/paper/2506.15841","citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:f24717b3a7fffb535bdd5498bef3039ca326b60de5ed3b353aac774e47d5cecf","observation_id":"fe5963fd-333f-4947-943d-ca58fb2be704","resolution":{"observed_at":"2026-06-29T07:33:13.435675Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:31:00.010342Z","title":"The key point is architectural: once the history is compressed into memory, downstream reasoning and action selection can only access the information preserved inm t","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:fd6a43ca0fa9a0312d46055193c5c095126a50bb5b27c74527e17aaf7e519db2","observation_id":"458f09ff-6840-40d5-9099-64b0f79ced31","resolution":{"observed_at":"2026-06-29T07:31:00.010342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8181.0382","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:33:13.431531Z","title":"Based on current memory, what is the answer to the question?","venue":null,"work_id":"568ae760-1737-40b6-a803-658cdebe4341","year":null},"citing_paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T07:31:00.010342Z"},"links":{"citing_paper":"/paper/2605.30159"},"observation_digest":"sha256:c4cc763b116e05a0c32736f4fe37dad9737e6eecc8cdfaf4a12ec82b148597f5","observation_id":"1e938751-8bf7-4b8c-9f8a-aa1ad74fe6a6","resolution":{"observed_at":"2026-06-29T07:33:13.433128Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.30159","last_updated":"2026-05-28T16:17:19Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-28T16:17:19Z","title":"Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":1,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":2,"verified_exact":17,"verified_fuzzy":0},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 1 inbound Pith citation observation for arXiv:2605.30159."}