{"as_of":"2026-08-07T08:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:943fe3da3ba350d17178916d051fdb72d76c85b06c35cf01d2080116875a3da3","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-03T20:12:06.882343Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T03:36:57.168246Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T03:45:55.520373Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"cited_work":{"arxiv_id":"2607.01480","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.01480","snapshot_observed_at":"2026-07-09T03:45:55.520373Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","venue":"cs.AI","work_id":"24ab54ed-d85a-44a1-8a4b-8a51dfae9528","year":2026},"citing_paper":{"arxiv_id":"2607.07663","last_updated":"2026-07-08T17:19:50Z","snapshot_observed_at":"2026-07-30T01:44:04.256851Z","submitted_at":"2026-07-08T17:19:50Z","title":"Recursive Self-Improvement in AI: From Bounded Self-Refinement to Autonomous Research Loops","version":1},"reference_index":113,"source":"pdf_text","source_observed_at":"2026-07-09T03:36:57.168246Z"},"links":{"cited_paper":"/paper/2607.01480","citing_paper":"/paper/2607.07663"},"observation_digest":"sha256:08dd2d262a5bf8e133031f306adfcf7fba9ffcdce4f7b9107f2a7e06d3027da9","observation_id":"08602f70-20ab-430b-9ad5-903980551299","resolution":{"observed_at":"2026-07-09T03:45:55.521846Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.01480/citation-record","integrity":"/paper/2607.01480/integrity","json":"/paper/2607.01480/citation-record.json","paper":"/paper/2607.01480"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.992790Z","title":"On-Policy Distillation of Language Models: Learning from Self-Generated Mistakes","venue":null,"work_id":"afa9c934-957d-4ff4-b564-c9c54d827620","year":2024},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:0762267b15352e75ed5e8e5c54ae4b737b85ed9ebe60b3cc9106163f390505df","observation_id":"fc4d51fe-6fb8-4581-a029-b5b8d121d135","resolution":{"observed_at":"2026-07-05T02:30:40.993998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12674","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T20:18:56.040189Z","title":"X-KD: General Experiential Knowledge Distillation for Large Language Models","venue":null,"work_id":"b657166d-43e5-4bab-8505-ca53e3f5a66b","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:4ee221da68305bf72ea5d3f50b50985728101e0ce79d3e42b61dd3c226bbcca5","observation_id":"fff6b2cd-6e04-4605-bd8e-9581ca7b4f5c","resolution":{"observed_at":"2026-07-03T20:18:56.042521Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.10923","last_updated":"2026-04-13T02:44:54Z","snapshot_observed_at":"2026-07-06T22:59:27.499664Z","submitted_at":"2026-04-13T02:44:54Z","title":"Mem$^2$Evolve: Towards Self-Evolving Agents via Co-Evolutionary Capability Expansion and Experience Distillation","version":1},"cited_work":{"arxiv_id":"2604.10923","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.10923","snapshot_observed_at":"2026-07-03T20:18:56.049801Z","title":"Mem$^2$Evolve: Towards Self-Evolving Agents via Co-Evolutionary Capability Expansion and Experience Distillation","venue":"cs.CL","work_id":"1bf77cdb-bf11-4416-b03c-4078461ad3ed","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2604.10923","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:09c4427ae623c726e7ceaf034538069aa1130e706a54794fe51225a8e2d94f4e","observation_id":"1d4b53f4-ab9d-411b-a908-49fa86d3301d","resolution":{"observed_at":"2026-07-03T20:18:56.051955Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2406.09098","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T16:57:24.572789Z","title":"2024 , url =","venue":null,"work_id":"dfc56081-298f-47d0-8530-94c9d51f071c","year":2024},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:46f8a44c9d9a6c2c44e5859f62c7566b5e08a916217c6afce9350d3af61457e4","observation_id":"87811c71-02d1-4b6d-879d-d3d75b05d6ad","resolution":{"observed_at":"2026-07-03T20:18:56.063464Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.977384Z","title":"MiniLLM: Knowledge Distillation of Large Language Models","venue":null,"work_id":"58278f60-df75-48d8-8a76-16d748c643d4","year":2024},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:805b7bc283c3d1abd4391d9e64bfa659a70b709b94ddcfdcfcfe9ee20102cd33","observation_id":"7ba9b806-7857-402c-bed6-1918f5806784","resolution":{"observed_at":"2026-07-05T02:30:40.978661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:3700e0bc23839505bef754645e688c54711072d6dad97474b4db573d27f1553c","observation_id":"0b1753ab-02ec-4f94-bc55-9673cd8230a0","resolution":{"observed_at":"2026-07-03T20:18:55.998872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.12002","last_updated":"2026-06-11T04:21:23Z","snapshot_observed_at":"2026-07-12T21:38:13.191362Z","submitted_at":"2026-04-13T19:46:55Z","title":"Self-Distillation Zero: Self-Revision Turns Binary Rewards into Dense Supervision","version":2},"cited_work":{"arxiv_id":"2604.12002","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.12002","snapshot_observed_at":"2026-07-10T01:46:41.091851Z","title":"Self-Distillation Zero: Self-Revision Turns Binary Rewards into Dense Supervision","venue":"cs.CL","work_id":"075fcc48-23c0-4231-bf6e-c629eb2a169b","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2604.12002","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:28e975c08e995f03ba96d597b12d58aadc1af5700a1b7525e4d7325822c58ca5","observation_id":"5680b1aa-4d1a-47fb-b781-767415228ee5","resolution":{"observed_at":"2026-07-03T20:18:56.022571Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:41.001691Z","title":"Distilling the Knowledge in a Neural Network","venue":null,"work_id":"41881a60-6d90-4558-8668-f75c37abef66","year":2015},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:3d4c4679ff3520c2c53b9f37224fdf993873b30a2607bbb788036b2d80ba5f44","observation_id":"089bd3e1-5eb0-4757-b04d-dca08dd5b761","resolution":{"observed_at":"2026-07-05T02:30:41.003031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05004","last_updated":"2026-02-13T18:53:32Z","snapshot_observed_at":"2026-07-06T22:09:08.864232Z","submitted_at":"2025-08-07T03:38:16Z","title":"R-Zero: Self-Evolving Reasoning LLM from Zero Data","version":4},"cited_work":{"arxiv_id":"2508.05004","doi":"10.48550/arxiv.2508.05004","metadata_source":"pith","pith_arxiv_id":"2508.05004","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"R-Zero: Self-Evolving Reasoning LLM from Zero Data","venue":"cs.LG","work_id":"45b39aae-1151-4087-9b48-dd16313e6306","year":2025},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2508.05004","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:2f09620bed1df69f1ae674b531a11a9a53ff463b6d251304d5d57a40e17bafa9","observation_id":"a11baa40-fae8-46b3-9765-17eafbc1ebf7","resolution":{"observed_at":"2026-07-03T20:18:56.024959Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:53:06.742139+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:53:06.742139+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20802","last_updated":"2026-02-16T14:49:34Z","snapshot_observed_at":"2026-07-29T19:52:32.104228Z","submitted_at":"2026-01-28T17:45:12Z","title":"Reinforcement Learning via Self-Distillation","version":2},"cited_work":{"arxiv_id":"2601.20802","doi":"10.48550/arxiv.2601.20802","metadata_source":"pith","pith_arxiv_id":"2601.20802","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reinforcement Learning via Self-Distillation","venue":"cs.LG","work_id":"b193541d-5853-4ea4-8e4b-8e4c08617eb6","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2601.20802","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:22dd4e6e2a3216db114c06f1904b99599986014095129e360c18ae50042a1326","observation_id":"bce8b0a5-814f-4bde-8d2b-34066addb28e","resolution":{"observed_at":"2026-07-03T20:18:56.034169Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-21T06:23:12.649775+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T06:23:12.649775+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":"2403.07974","doi":"10.1109/icsme52107.2021.00025","metadata_source":"pith","pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","venue":"cs.SE","work_id":"ea9e51ce-1e75-4182-92d8-4d25f70d2ee4","year":2024},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:439c4e043ce88722e887296a97293ccad9e66e48205a6f3077f4e3a223a0f222","observation_id":"4a69fee8-75c3-474f-ab0d-7a521c93678f","resolution":{"observed_at":"2026-07-03T20:18:55.992008Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.24472","last_updated":"2026-05-20T15:19:39Z","snapshot_observed_at":"2026-08-02T12:51:54.532525Z","submitted_at":"2026-03-25T16:14:52Z","title":"Why Does Self-Distillation (Sometimes) Degrade the Reasoning Capability of LLMs?","version":3},"cited_work":{"arxiv_id":"2603.24472","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.24472","snapshot_observed_at":"2026-07-10T00:26:39.269322Z","title":"Why Does Self-Distillation (Sometimes) Degrade the Reasoning Capability of LLMs?","venue":"cs.CL","work_id":"8df6a2d1-d890-48ae-af85-c11643a91097","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2603.24472","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:3cfaf764be13996bbca590122075f1aac5afd3317eb4a6a09f57bf320c3e3c5a","observation_id":"e6bbf87d-3bf1-408b-8cb8-8556994f040e","resolution":{"observed_at":"2026-07-03T20:18:56.102957Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:20:38.104733Z","title":"uttler, Mike Lewis, Wen-tau Yih, Tim Rockt","venue":null,"work_id":"c5084009-4428-4310-80e2-2144c3aa291f","year":2020},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:9c5be6a83227aeb0fea56b3a39b0b2e0e92e73dc6ef2bbeae5ba0cd2ceee26f2","observation_id":"d062eae2-1b50-4831-a1c4-1b7e6cd55aa2","resolution":{"observed_at":"2026-07-05T02:20:38.106111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13016","last_updated":"2026-04-15T17:48:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-14T17:54:28Z","title":"Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe","version":2},"cited_work":{"arxiv_id":"2604.13016","doi":"10.48550/arxiv.2604.13016","metadata_source":"pith","pith_arxiv_id":"2604.13016","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe","venue":"cs.LG","work_id":"42b43df0-4c82-493f-9d9b-1be8c116d9af","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2604.13016","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:5c7074f418b24f18e84d08fd49fac9cf97b833feb2aaff84e557e0d6bd5f4fd4","observation_id":"81047703-ce6d-4161-bb41-388488b2b128","resolution":{"observed_at":"2026-07-03T20:18:55.971108Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:20:38.106676Z","title":"Thinking Machines Lab: Con- nectionism","venue":null,"work_id":"7b66863b-6048-45b9-93f8-bf16f8c4db68","year":2025},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:ce0b5edf4afdba04cfa3848431f43181b2d3658bc213c213b3e868a1c1899b92","observation_id":"670ff9ac-a164-4ffe-a885-5d34d06be270","resolution":{"observed_at":"2026-07-05T02:20:38.108167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.02268","last_updated":"2026-05-15T09:15:24Z","snapshot_observed_at":"2026-07-06T22:51:44.663367Z","submitted_at":"2026-04-02T17:03:05Z","title":"SKILL0: In-Context Agentic Reinforcement Learning for Skill Internalization","version":2},"cited_work":{"arxiv_id":"2604.02268","doi":"10.48550/arxiv.2604.02268","metadata_source":"pith","pith_arxiv_id":"2604.02268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SKILL0: In-Context Agentic Reinforcement Learning for Skill Internalization","venue":"cs.LG","work_id":"e473fd3a-07f1-4cc2-b982-8e0582795882","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2604.02268","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:4a72bab8507704e0cc437b413a5fbfefa4eff6971913e01ab20fb80cf6d3e1ea","observation_id":"9fdb8892-ecc3-47de-8e4b-f93fcc0840ba","resolution":{"observed_at":"2026-07-03T20:18:56.006533Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:20:38.108906Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","venue":null,"work_id":"c8980f66-00ea-460a-bca5-7aff93ffec89","year":2023},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:836c0043f893784aeb9a24c97b5cf3d23944e763279ef5ab41119536fa31ac25","observation_id":"e7853188-04b8-42fc-9048-bc80633a380f","resolution":{"observed_at":"2026-07-05T02:20:38.110479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:73a68c3d17655a08d26f4b0b0178519f4b722ae56f8aa261572db22f4da7e068","observation_id":"6900ad8c-6747-4390-a81f-46f3692f5e2e","resolution":{"observed_at":"2026-07-03T20:18:56.017511Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25140","last_updated":"2026-03-16T20:49:28Z","snapshot_observed_at":"2026-08-02T12:08:17.149184Z","submitted_at":"2025-09-29T17:51:03Z","title":"ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory","version":2},"cited_work":{"arxiv_id":"2509.25140","doi":"10.48550/arxiv.2509.25140","metadata_source":"pith","pith_arxiv_id":"2509.25140","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory","venue":"cs.AI","work_id":"551218b8-a306-4c1e-8795-6232cc30192b","year":2025},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2509.25140","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:d4129456752e0a6c80142f8d5295e4fa552c1ccab0f6a4534ddeba95d841ad67","observation_id":"4817e270-b6ec-4d05-8370-dae361075871","resolution":{"observed_at":"2026-07-03T20:18:56.072054Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:34.995342+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:34.995342+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08560","last_updated":"2024-02-12T18:59:46Z","snapshot_observed_at":"2026-08-03T06:31:15.541423Z","submitted_at":"2023-10-12T17:51:32Z","title":"MemGPT: Towards LLMs as Operating Systems","version":2},"cited_work":{"arxiv_id":"2310.08560","doi":"10.48550/arxiv.2310.08560","metadata_source":"pith","pith_arxiv_id":"2310.08560","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MemGPT: Towards LLMs as Operating Systems","venue":"cs.AI","work_id":"2698f5ad-c84c-40ca-b839-0912dae10ba2","year":2023},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2310.08560","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:025b2218033f8407225018d807d2fb7fec5bfcffcd2ed4a463251cc4775e364d","observation_id":"674b87a2-8d5f-4abb-89f4-9ba64fda4437","resolution":{"observed_at":"2026-07-03T20:18:56.038402Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:49:35.543803+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:49:35.543803+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:20:38.065562Z","title":"Generative Agents: Interactive Simulacra of Human Behavior","venue":null,"work_id":"b77df2b0-fe79-4054-8fa4-ea879be0b589","year":2023},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:a1623ecf390af01a486cde26eebea0ce1a6ed5334671b689252f1a91b4099287","observation_id":"62124e6c-a77b-4658-85d2-67fb4a3746c3","resolution":{"observed_at":"2026-07-05T02:20:38.067274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:20:38.100543Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","venue":null,"work_id":"0d49f6ae-58d4-4eee-8588-da2fbdcfa9b1","year":2023},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:6927a21b81c7eeaf4409e326a3c76cad6ffe537640117927951fc58e56b1e413","observation_id":"bf280084-6390-44c1-ba84-3d8efc1888a4","resolution":{"observed_at":"2026-07-05T02:20:38.102087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:20:38.102561Z","title":"A Reduction of Imitation Learning and Structured Prediction to No-Regret Online Learning","venue":null,"work_id":"2c1931a8-1b53-4ea3-a33b-926068f41f80","year":2011},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:3459f9849e6a3c8326c6c36247bca3c3eeda50f62c5750fa82c28b729ef1ad02","observation_id":"fb573098-16fa-4032-8706-3fb825bfb784","resolution":{"observed_at":"2026-07-05T02:20:38.103740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.05433","last_updated":"2026-07-03T04:38:21Z","snapshot_observed_at":"2026-07-15T14:32:24.776402Z","submitted_at":"2026-03-05T17:54:40Z","title":"CRISP: Compressed Reasoning via Iterative Self-Policy Distillation","version":7},"cited_work":{"arxiv_id":"2603.05433","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.05433","snapshot_observed_at":"2026-07-03T20:18:56.074332Z","title":"CRISP: Compressed Reasoning via Iterative Self-Policy Distillation","venue":"cs.LG","work_id":"c5a99022-15b6-4d77-9850-23036df7a073","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2603.05433","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:33aa7de6d49d6843d73381ce18f2fdd4512629b94242674fc7cc8e549fabb362","observation_id":"29e02a43-0d98-434e-a366-a303f6903300","resolution":{"observed_at":"2026-07-03T20:18:56.076998Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:1af0e72686bd816b13486241862c93bee25d46460ccf1e2a50886b7b7bef517c","observation_id":"40cde8c1-6444-4e98-ba9c-c25ddaa38b10","resolution":{"observed_at":"2026-07-03T20:18:56.033961Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:8fa057653662447639a70e08b1921daa50f47b9ac8c89f8f3003c09a3e78f1da","observation_id":"e90a683d-a983-48bc-acc3-1cf3784e9dd7","resolution":{"observed_at":"2026-07-03T20:18:56.002504Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.19897","last_updated":"2026-01-27T18:59:08Z","snapshot_observed_at":"2026-07-06T22:43:12.468415Z","submitted_at":"2026-01-27T18:59:08Z","title":"Self-Distillation Enables Continual Learning","version":1},"cited_work":{"arxiv_id":"2601.19897","doi":"10.48550/arxiv.2601.19897","metadata_source":"pith","pith_arxiv_id":"2601.19897","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Distillation Enables Continual Learning","venue":"cs.LG","work_id":"e9aa25e3-870c-46c8-8270-e4e5948d09f0","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2601.19897","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:ae604a64552a21b12d01197c8df10c62a6ccb56c2dcb207ff45bd98d9a207b7e","observation_id":"bf1e3ccc-7beb-4018-89e8-53dc9d500b73","resolution":{"observed_at":"2026-07-03T20:18:56.026859Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:50.091537+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:50.091537+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.13949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:56:19.163734Z","title":"arXiv preprint arXiv:2602.13949 , year=","venue":null,"work_id":"7c5878c2-74d2-4af4-9b65-988f76ed7a89","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:1eab4059a92cc6ea507bcfd551dc09192cdd1534ef168b2c16630b44b40875a8","observation_id":"56208162-0e12-435e-9886-4b3fc49b2bce","resolution":{"observed_at":"2026-07-03T20:18:56.031192Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:20:38.111006Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","venue":null,"work_id":"0c7a260e-3445-4c47-8cfa-43b8e265ce47","year":2023},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:9bf4ef564d34a9a46e0d02488f0901f3f4ee6f5e9f7ba084010e4e6bd8a91997","observation_id":"a096af70-762f-4649-a1e8-ae31dee55dc7","resolution":{"observed_at":"2026-07-05T02:20:38.112836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.00626","last_updated":"2026-06-18T17:00:51Z","snapshot_observed_at":"2026-07-13T14:57:31.836214Z","submitted_at":"2026-04-01T08:32:34Z","title":"A Survey of On-Policy Distillation for Large Language Models","version":4},"cited_work":{"arxiv_id":"2604.00626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.00626","snapshot_observed_at":"2026-07-10T00:26:39.257599Z","title":"A Survey of On-Policy Distillation for Large Language Models","venue":"cs.LG","work_id":"f6aaea8e-1f0d-43e3-b28f-6066d3e0a66b","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2604.00626","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:4a9e524274bd71ae81a212c57876ef030fa06e961c56830f9a1644fa05980db1","observation_id":"3fece100-cff2-4eaf-91bf-0e0843dace55","resolution":{"observed_at":"2026-07-03T20:18:56.097509Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.16962","doi":"10.48550/arxiv.2512.16962","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2512.16962 , year=","venue":"arXiv (Cornell University)","work_id":"90120582-e1b6-45f2-af30-e61c82587d05","year":2025},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:dcd5de47cc7f741a4fb77a0b1b35766eaf56564eacb31074b6bb18a8cb127cf6","observation_id":"db5a2bff-2fdb-409b-b8b4-4d2825affed9","resolution":{"observed_at":"2026-07-03T20:18:56.047583Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-07T08:29:46.650400Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":"2305.16291","doi":"10.18653/v1/2023.emnlp-main.118","metadata_source":"pith","pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","venue":"cs.AI","work_id":"ffe0d207-86cf-4742-a100-e988ac8b9676","year":2023},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:874758156ef9f6b5a60cb5d42b9dbad6a92b3efd97a636467b3232c9b41bbf03","observation_id":"89180346-94e3-4128-8574-9f93e2463a5f","resolution":{"observed_at":"2026-07-03T20:18:56.052252Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.10674","last_updated":"2026-04-12T14:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T14:57:52Z","title":"Skill-SD: Skill-Conditioned Self-Distillation for Multi-turn LLM Agents","version":1},"cited_work":{"arxiv_id":"2604.10674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.10674","snapshot_observed_at":"2026-07-04T13:39:50.103028Z","title":"Skill-SD: Skill-Conditioned Self-Distillation for Multi-turn LLM Agents","venue":"cs.LG","work_id":"97dc38ac-2adb-4aaa-9fa4-16929254604e","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2604.10674","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:f64e1d902a5cedc9647be7e7c8d17898b03148a6d22e5395181b1531b3f3981d","observation_id":"92cfd3ce-54e4-479f-9536-bc24da8582a6","resolution":{"observed_at":"2026-07-03T20:18:55.981242Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.19672","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T11:44:51.222194Z","title":"Skillorchestra: Learning to route agents via skill transfer","venue":null,"work_id":"60938f44-f5bc-4e20-95f5-7804a28011f6","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:bd142aaf9c5dcc5f6579c556ba10723e0e7d672226c4166058cdb423cfd52bb2","observation_id":"1da99ab1-a6c3-4100-83d2-702a6600178c","resolution":{"observed_at":"2026-07-03T20:18:55.975149Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25911","last_updated":"2025-09-30T08:02:34Z","snapshot_observed_at":"2026-08-06T02:56:06.576393Z","submitted_at":"2025-09-30T08:02:34Z","title":"Mem-{\\alpha}: Learning Memory Construction via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2509.25911","doi":"10.48550/arxiv.2509.25911","metadata_source":"pith","pith_arxiv_id":"2509.25911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mem-{\\alpha}: Learning Memory Construction via Reinforcement Learning","venue":"cs.CL","work_id":"4643330b-80ff-49a5-bbb1-e618edaffe35","year":2025},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2509.25911","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:8ae866a8e5dd26e61b1b95be5ec420b37cc224e1b53238743a70ab244b2316b8","observation_id":"4d9917ee-8029-4bc9-b57f-4cead8e44db8","resolution":{"observed_at":"2026-07-03T20:18:56.027410Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-17T20:50:53.619604+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T20:50:53.619604+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:20:38.113797Z","title":"Q-learning","venue":null,"work_id":"9429caa8-0705-4077-b5c8-80204ffefa7d","year":1992},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:c4fbcf66ccd59751b072aaf4024bf25958ac7f7f998ec0653a32a7cc55bc7e2e","observation_id":"e9b1c90b-af14-4dc4-8d59-7e9a9cd62ed7","resolution":{"observed_at":"2026-07-05T02:20:38.114987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.16079","last_updated":"2026-05-16T02:57:47Z","snapshot_observed_at":"2026-08-05T00:54:36.690304Z","submitted_at":"2025-10-17T12:03:16Z","title":"EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle","version":3},"cited_work":{"arxiv_id":"2510.16079","doi":"10.48550/arxiv.2510.16079","metadata_source":"pith","pith_arxiv_id":"2510.16079","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle","venue":"cs.CL","work_id":"350af93c-7749-4477-8163-e35d2cac8d96","year":2025},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2510.16079","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:a005db47a86c7b6731fc77c6fc49466214bff41a788642f10bc4de033690345a","observation_id":"8aae3176-e03b-4f4a-896c-46b15aa18b42","resolution":{"observed_at":"2026-07-03T20:18:55.991514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.00444","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T20:18:56.010189Z","title":"TokMem: One-token procedural memory for large language models","venue":null,"work_id":"3cbde970-e172-4674-95b1-c249ffbc187b","year":2025},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:0e55086bea37c7d8eaf854e7f15dba983b21033aedc5b53beee56e5cf8e85cac","observation_id":"1faae88e-5ffe-406e-95e5-451a4bf81e3f","resolution":{"observed_at":"2026-07-03T20:18:56.011962Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.08234","last_updated":"2026-02-09T03:17:17Z","snapshot_observed_at":"2026-07-06T22:45:05.823859Z","submitted_at":"2026-02-09T03:17:17Z","title":"SkillRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2602.08234","doi":"10.48550/arxiv.2602.08234","metadata_source":"pith","pith_arxiv_id":"2602.08234","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SkillRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning","venue":"cs.LG","work_id":"536a9d0a-baed-4eb9-9a51-f2b585c3388b","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2602.08234","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:0f67f3d40354c5eb6dd0c2e9b3a1f76f6356dd04f12e587c90928052dad11466","observation_id":"723905de-d7a4-44d6-a1f5-e7a4a56d650f","resolution":{"observed_at":"2026-07-03T20:18:55.962509Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.11327","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T20:18:56.086750Z","title":"Smith, and Hannaneh Hajishirzi","venue":null,"work_id":"4c5c5d97-4154-4a7d-b246-c97295a8b08a","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:56bed2d20a42ca4232918fcf3382882cd02bd74e3b34a25b6879c55126e5dd70","observation_id":"81af51f9-74f0-4e9d-8337-3e4c2448dda2","resolution":{"observed_at":"2026-07-03T20:18:56.092025Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.991105Z","title":"A-mem: Agentic memory for llm agents","venue":null,"work_id":"01e5f10c-0906-49d7-aa14-462cfa81d00a","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:edaab55e6ec899337366071376f90d705b2061e438d6685197eb950cfbce0e3b","observation_id":"58d2b13a-a53e-4ab4-a6c1-b82e0b9f3eb0","resolution":{"observed_at":"2026-07-05T02:30:40.992228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19828","last_updated":"2026-01-14T14:21:21Z","snapshot_observed_at":"2026-07-06T22:19:28.487854Z","submitted_at":"2025-08-27T12:26:55Z","title":"Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2508.19828","doi":"10.48550/arxiv.2508.19828","metadata_source":"pith","pith_arxiv_id":"2508.19828","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning","venue":"cs.CL","work_id":"2a070440-2167-4398-be97-c2d4c3ee3541","year":2025},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2508.19828","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:c19803b55285ba62b5dfd24acada2b58dac14e41b3beb4dd9679b3182b9e7530","observation_id":"c1825435-f391-414d-8378-e3eb128426be","resolution":{"observed_at":"2026-07-03T20:18:56.110948Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:49:35.802766+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:49:35.802766+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:2c3bbad6ef329ba31d96afc4dae6cf7b59af6e16751ff77fe7164e601cc3f27f","observation_id":"7e6c3d50-1c1b-4e75-bfc6-4b4ab203f981","resolution":{"observed_at":"2026-07-03T20:18:56.055985Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.03128","last_updated":"2026-04-08T08:22:36Z","snapshot_observed_at":"2026-08-03T04:49:13.270533Z","submitted_at":"2026-04-03T15:50:07Z","title":"Self-Distilled RLVR","version":2},"cited_work":{"arxiv_id":"2604.03128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.03128","snapshot_observed_at":"2026-07-07T12:33:45.187943Z","title":"Self-Distilled RLVR","venue":"cs.LG","work_id":"935a34f3-b83d-4214-b6a0-ae2395b3d107","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2604.03128","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:9b44a4a488c2776dabdc0ec7355fd40435429f100473f11ff6109cd1f8f3ab8a","observation_id":"55154ca4-4ad4-4327-9cd8-dce7ce0a44ed","resolution":{"observed_at":"2026-07-03T20:18:56.016907Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.982694Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","venue":null,"work_id":"eb9d67bf-2d63-42c0-8d46-074de88cee83","year":2023},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:4ee1091a3f11e836345f9ffc27c5b37ed25113432985f70321d83de3ec20e6d5","observation_id":"a71b7b0a-151c-4b64-953d-91a58e966412","resolution":{"observed_at":"2026-07-05T02:30:40.983835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.16856","last_updated":"2026-06-29T12:13:29Z","snapshot_observed_at":"2026-07-13T23:28:27.562632Z","submitted_at":"2026-03-17T17:57:49Z","title":"Online Experiential Learning for Language Models","version":2},"cited_work":{"arxiv_id":"2603.16856","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.16856","snapshot_observed_at":"2026-07-07T12:33:45.190220Z","title":"Online experiential learning for language models","venue":"cs.CL","work_id":"3fb60853-ab99-4f3e-8f4c-27017c08f0be","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2603.16856","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:db58c4ff477b4be8f74bc3dfe9a09b960467f7061e9893ff4077f5c2eb67fe79","observation_id":"94f8087b-693c-4ce0-9cd8-3c3a9105ae97","resolution":{"observed_at":"2026-07-03T20:18:56.047601Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12275","last_updated":"2026-03-23T13:11:10Z","snapshot_observed_at":"2026-07-06T22:45:39.557598Z","submitted_at":"2026-02-12T18:58:28Z","title":"On-Policy Context Distillation for Language Models","version":2},"cited_work":{"arxiv_id":"2602.12275","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.12275","snapshot_observed_at":"2026-07-10T00:26:39.252472Z","title":"On-Policy Context Distillation for Language Models","venue":"cs.CL","work_id":"b56a7e15-d864-43f4-9212-59bc7ec70d21","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2602.12275","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:50e99d65c7c8b83311f30f38991c87c2271dd361361a2efd7edc43425d83f3b4","observation_id":"18e3537b-5c2c-40ae-80ac-bd6ca651053a","resolution":{"observed_at":"2026-07-03T20:18:56.020870Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.01885","last_updated":"2026-07-23T06:23:36Z","snapshot_observed_at":"2026-08-03T14:57:06.604444Z","submitted_at":"2026-01-05T08:24:16Z","title":"Agentic Memory: Learning Unified Long-Term and Short-Term Memory Management for Large Language Model Agents","version":3},"cited_work":{"arxiv_id":"2601.01885","doi":"10.48550/arxiv.2601.01885","metadata_source":"pith","pith_arxiv_id":"2601.01885","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Agentic Memory: Learning Unified Long-Term and Short-Term Memory Management for Large Language Model Agents","venue":"cs.CL","work_id":"4519e90e-26c9-43ef-a89b-c8e8a8378280","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2601.01885","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:402ce1be8837b9dfc7e164d87d396a345b2b4c4a0665c42b1dd61315b080a95a","observation_id":"d5bb9787-45e6-4721-88e4-957545d6e9a7","resolution":{"observed_at":"2026-07-03T20:18:55.999248Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.24704","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T05:36:01.242136Z","title":"Appagent: Multimodal agents as smartphone users","venue":null,"work_id":"9a080bd6-ce14-4b37-9c10-b026c507a4d7","year":2025},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:461e980d389dd771eefc37b0295a457004d4a000d2207408f69bb08cc684309f","observation_id":"83c2c239-5d14-401b-a70c-95c1ad02da25","resolution":{"observed_at":"2026-07-03T20:18:55.951347Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.01193","last_updated":"2026-06-24T22:44:36Z","snapshot_observed_at":"2026-08-02T16:28:38.685624Z","submitted_at":"2026-04-01T17:39:50Z","title":"Embarrassingly Simple Self-Distillation Improves Code Generation","version":2},"cited_work":{"arxiv_id":"2604.01193","doi":"10.48550/arxiv.2604.01193","metadata_source":"pith","pith_arxiv_id":"2604.01193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Embarrassingly simple self-distillation improves code generation","venue":"cs.CL","work_id":"c0ef109a-9f93-445a-beb2-16ed977cbebc","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2604.01193","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:34276c33a31bd87b478ecfe611b764b78b418712442da0bab8df4abfdd379389","observation_id":"f7b69478-4de6-403f-9bbc-fbe3c568c477","resolution":{"observed_at":"2026-07-03T20:18:55.984794Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":"2506.05176","doi":"10.1016/j.displa.2025.103255","metadata_source":"pith","pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","venue":"cs.CL","work_id":"bab684a8-d933-426c-a19e-2c855a0d1f59","year":2025},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:30da90788a6c4ef8829a20dd670073f6cf4a2155b718fa3a16f402cff5ce8bf5","observation_id":"b14c456a-aeb6-4ff6-8935-18dc82d63618","resolution":{"observed_at":"2026-07-03T20:18:56.067076Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.07885","last_updated":"2026-08-05T10:56:08Z","snapshot_observed_at":"2026-08-07T08:26:20.270738Z","submitted_at":"2026-02-08T09:37:25Z","title":"MemFly: On-the-Fly Memory Optimization via Information Bottleneck","version":2},"cited_work":{"arxiv_id":"2602.07885","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.07885","snapshot_observed_at":"2026-08-06T02:07:05.092025Z","title":"MemFly: On-the-Fly Memory Optimization via Information Bottleneck","venue":null,"work_id":"7994ab8b-334b-4233-b6c5-a6a9c4d78600","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2602.07885","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:82de967a85fc969588715eed0f81266db5198ce710bc5d4570a62f01eafe7765","observation_id":"06e1150e-1063-41cf-8c7b-612a00060226","resolution":{"observed_at":"2026-08-06T02:07:05.092025Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18734","last_updated":"2026-03-20T15:40:19Z","snapshot_observed_at":"2026-08-06T08:49:57.295985Z","submitted_at":"2026-01-26T17:56:50Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","version":3},"cited_work":{"arxiv_id":"2601.18734","doi":"10.18653/v1/2025.emnlp-main.125.https://aclanthology.org/2025.emnlp-main.125/","metadata_source":"pith","pith_arxiv_id":"2601.18734","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","venue":"cs.LG","work_id":"bae00e84-9b0d-433d-a066-20b951f0b4d0","year":2026},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2601.18734","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:82a4170e259b1e4cb429cf8c0e7e335d6b3aeccd044bb2163dec7583b01e2e42","observation_id":"d2d34747-665b-488b-a40c-6b988b835b79","resolution":{"observed_at":"2026-07-03T20:18:56.019411Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.975325Z","title":"Memorybank: Enhancing large language models with long-term memory","venue":null,"work_id":"db67d8e8-6021-4d59-8dfa-a95e78636121","year":2024},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:4ec809458ab4367023ed6f2c559d4ea790c3e2184c23790e58271de6e2c7ff48","observation_id":"bfdcb1ff-8825-482b-8d19-b400e993c334","resolution":{"observed_at":"2026-07-05T02:30:40.976558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.16153","last_updated":"2025-08-25T13:32:12Z","snapshot_observed_at":"2026-08-06T23:53:22.457977Z","submitted_at":"2025-08-22T07:25:30Z","title":"Memento: Fine-tuning LLM Agents without Fine-tuning LLMs","version":2},"cited_work":{"arxiv_id":"2508.16153","doi":"10.48550/arxiv.2508.16153","metadata_source":"pith","pith_arxiv_id":"2508.16153","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memento: Fine-tuning LLM Agents without Fine-tuning LLMs","venue":"cs.LG","work_id":"ed7d69aa-0e41-4f9f-99e1-2dfcbdd515a0","year":2025},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"cited_paper":"/paper/2508.16153","citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:8136fb6cab72bf5e510418fa566d6dcc42ecc36eef8cbb0a90bb27d48f9f067f","observation_id":"acaae7d4-6702-4255-a879-3460198171d9","resolution":{"observed_at":"2026-07-03T20:18:56.014458Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-22T15:52:34.518715+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T15:52:34.518715+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.979224Z","title":null,"venue":null,"work_id":"46a0e4be-ef57-4717-bf5b-b32a9807796b","year":null},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:cde294ff38d12618bf273bc3f63c69f99468f75f6bf13a6f812c0674a7454bb9","observation_id":"d0a3161e-ba21-41c9-ba8d-7fa83ab0c402","resolution":{"observed_at":"2026-07-05T02:30:40.980383Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.984380Z","title":"strategies","venue":null,"work_id":"4b417420-9d57-4c58-a825-93a529f70a13","year":null},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:30fb21840e09427240fef141b9bce7a3b568f8393677c367003868445eaea7c4","observation_id":"146ed652-00b0-4022-ac36-1c578f473177","resolution":{"observed_at":"2026-07-05T02:30:40.985478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.999323Z","title":null,"venue":null,"work_id":"9249b45f-e3dd-454c-a84c-c02baa8e9b8a","year":null},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:0792740c4854b21858dde57408576960823567bafe1323838165a10b66c0c3eb","observation_id":"f8500994-61ce-43ff-b86d-2d3dcf817c82","resolution":{"observed_at":"2026-07-05T02:30:41.001001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:41.005424Z","title":null,"venue":null,"work_id":"e6578336-9006-4eaa-8683-ea5722ecf613","year":null},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:716ee23caf373ee1fbfdef78445af6cf99d7f0e3928e24a3309ad31087bfa360","observation_id":"44e5f288-da0c-4c10-ac1c-c2149c6b69f5","resolution":{"observed_at":"2026-07-05T02:30:41.006527Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.994577Z","title":null,"venue":null,"work_id":"2d540a7d-1819-4da9-996e-41878d135cb5","year":null},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:7e8c7dada8006df6469fe0e5554dbdfa08f702b9f0d80dc92fb24de3c1f32390","observation_id":"c568cb7f-2553-475c-b470-619019826c99","resolution":{"observed_at":"2026-07-05T02:30:40.995573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.996152Z","title":null,"venue":null,"work_id":"08aaeae9-1149-4e38-9e44-6ccea10c3b52","year":null},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:c4040fc08123d45ef5985292a44a8f684539d4325783b99e5b0941cc4da29071","observation_id":"73a5f3c2-fca4-4cbe-8657-32b71e6e757a","resolution":{"observed_at":"2026-07-05T02:30:40.998728Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.980959Z","title":"behaviors","venue":null,"work_id":"a1e85976-5ecb-468f-8911-662b91a06760","year":null},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:57ef4382045a744921d4492d361bde1d269faa591be2d301687fd7c6c6e1270e","observation_id":"7ecde5b2-94bd-4ad0-b551-3ea4dae42b3e","resolution":{"observed_at":"2026-07-05T02:30:40.982118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.986124Z","title":null,"venue":null,"work_id":"9414f80e-7b98-4e6d-8610-d972fdc2f955","year":null},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:a078bc053e4c23173e9f1cc9ee9b14a037d7a7d6e25f9370cd661b444666816d","observation_id":"d981465f-f665-460c-bfa3-1b007ba4bb12","resolution":{"observed_at":"2026-07-05T02:30:40.987268Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:40.988905Z","title":null,"venue":null,"work_id":"7e3b1fb8-d227-4161-b604-a8b59afe8004","year":null},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:0203f44cc4f33aa6c53b33b51fc0c9896dde1f1db9cb1859d2283e1141afdca0","observation_id":"4c11d6a0-6440-4bcb-ad9c-f14fccb86cc7","resolution":{"observed_at":"2026-07-05T02:30:40.990581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:41.007051Z","title":null,"venue":null,"work_id":"02cf8bf5-0bbd-4310-a24e-24badc2ddfb3","year":null},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:1aa9883ee2f04ace9b3a51ea8d6d3fb2717e051b3ea5660e5ae97a90e6e5f0a1","observation_id":"566235dd-86cc-4878-8e32-c40995a704a1","resolution":{"observed_at":"2026-07-05T02:30:41.008095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:41.003801Z","title":"actions\": [ {","venue":null,"work_id":"1cae9db3-32a8-4af2-ab19-5361ac54e6ff","year":null},"citing_paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-03T20:12:06.882343Z"},"links":{"citing_paper":"/paper/2607.01480"},"observation_digest":"sha256:2dde538346916dcb391d524527b87bd8bff02dce866b2a5254470d448b5c492a","observation_id":"22875d9b-6d43-4d26-8fc9-36cb067fce14","resolution":{"observed_at":"2026-07-05T02:30:41.004833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.01480","last_updated":"2026-07-01T21:20:57Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-07T00:07:04.211507Z","submitted_at":"2026-07-01T21:20:57Z","title":"Procedural Memory Distillation: Online Reflection for Self-Improving Language Models"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":1,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":8,"verified_exact":35,"verified_fuzzy":17},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 1 inbound Pith citation observation for arXiv:2607.01480."}