{"as_of":"2026-08-05T14:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ba239890e0c09a643ebcb697050b196723d8ab22085ffc5888b8789c7260cf7a","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T04:57:12.923258Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.18002/citation-record","integrity":"/paper/2604.18002/integrity","json":"/paper/2604.18002/citation-record.json","paper":"/paper/2604.18002"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.19103670","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Zenodo (CERN European Organization for Nuclear Research)","work_id":"1a4a0146-d508-49e5-8639-028a49266b77","year":null},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:61dfde23fea1333d557ad23fe5861245b6a086e6235b0121d98c8331e4293f9a","observation_id":"a74fb348-de36-44e3-95f9-b9bd8ea9fddf","resolution":{"observed_at":"2026-05-10T05:00:37.078555Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0dee6cce-7bd8-45b7-b22c-e903f86b66d4","year":2024},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:999e9ec8764ccc67ab6c76b2dc6c7f391dfad2a46b61cf16c9aab6fbf2ebad3f","observation_id":"8f82aaa8-ad21-4b49-8f01-33a24900bab4","resolution":{"observed_at":"2026-05-22T01:15:54.333269Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":"2312.00752","doi":"10.48550/arxiv.2312.00752","metadata_source":"pith","pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","venue":"cs.LG","work_id":"4ee75248-1199-492c-a52f-6661e0f4adff","year":2023},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:3b95dbb512f7d570a4babe3b1dbb5c92d1a722fa92cf2e32ecd2b9aa2cbab7ea","observation_id":"f5ad8b8c-8d88-4761-b319-a8d6d9750e67","resolution":{"observed_at":"2026-05-10T11:00:04.710430Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-30T19:25:31.081761+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-30T19:25:31.081761+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08998","last_updated":"2023-08-21T10:23:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-17T14:12:48Z","title":"Reinforced Self-Training (ReST) for Language Modeling","version":2},"cited_work":{"arxiv_id":"2308.08998","doi":"10.1126/sciadv.abg6611","metadata_source":"pith","pith_arxiv_id":"2308.08998","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reinforced Self-Training (ReST) for Language Modeling","venue":"cs.CL","work_id":"db054f5c-62a3-405b-aae8-43e02c39f672","year":2023},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"cited_paper":"/paper/2308.08998","citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:958d585687fcfc6a64bf6aa9ea0c4792509a801dbef1526a913f517390accd56","observation_id":"8df2e25a-3b0b-4ecd-aed4-22434200854f","resolution":{"observed_at":"2026-05-10T11:00:04.698631Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:0c80a9ed07e9e7a5b4605ed89b1b29ca1bd8054bac89acebc73749e98d15da3d","observation_id":"081655ae-fb2c-4769-ae45-6475678da607","resolution":{"observed_at":"2026-05-10T11:00:04.695765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":"2203.15556","doi":"10.1098/rsta.2024.0522","metadata_source":"pith","pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training Compute-Optimal Large Language Models","venue":"cs.CL","work_id":"b2faf28d-86b7-429c-bc42-469458efc246","year":2022},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:83d269bb06627f2e72cb9ab72539fe56c25cea878c826ccd1e46458295e8b88f","observation_id":"b246d458-068b-4dc0-8f3c-4431f897eb4d","resolution":{"observed_at":"2026-05-10T16:01:32.444768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06180","last_updated":"2023-09-12T12:50:04Z","snapshot_observed_at":"2026-08-02T09:51:08.145755Z","submitted_at":"2023-09-12T12:50:04Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","version":1},"cited_work":{"arxiv_id":"2309.06180","doi":"10.18653/v1/2024.emnlp-main.20","metadata_source":"pith","pith_arxiv_id":"2309.06180","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","venue":"cs.LG","work_id":"0eb5eca2-2c11-4a77-a25a-18c331a50ed2","year":2023},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"cited_paper":"/paper/2309.06180","citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:cbb037ad9eab001b16b418b11321f6711f1c98b543c00acadfbfaec86aa047b6","observation_id":"969bc451-96bf-41e1-85d8-f8af4cfde9ca","resolution":{"observed_at":"2026-05-12T15:03:08.022500Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14469","last_updated":"2024-06-17T03:01:58Z","snapshot_observed_at":"2026-07-06T18:03:55.981890Z","submitted_at":"2024-04-22T17:42:58Z","title":"SnapKV: LLM Knows What You are Looking for Before Generation","version":2},"cited_work":{"arxiv_id":"2404.14469","doi":"10.48550/arxiv.2404.14469","metadata_source":"pith","pith_arxiv_id":"2404.14469","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SnapKV: LLM Knows What You are Looking for Before Generation","venue":"cs.CL","work_id":"4afe6cb0-dba4-42b6-b553-e685e5730d61","year":2024},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"cited_paper":"/paper/2404.14469","citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:2789fb067a55b0af3770136fb1b6730aa2cdbef0b2386f6bda10b7a23c5e22ee","observation_id":"4b65c936-365f-4ff5-9b53-c5d4bc0d9bc3","resolution":{"observed_at":"2026-05-13T12:57:43.256882Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:27.134462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:27.134462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-07-31T23:49:25.878472Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":"2512.02556","doi":"10.18653/v1/d18-1512","metadata_source":"pith","pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","venue":"cs.CL","work_id":"07c85cc5-4086-4abc-823b-6d0f4ff784d0","year":2025},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:092c954fe2c0d51bb56b0cb120043b22fa9d5fb020a99013ca38458cb61a2774","observation_id":"2b18eb95-b4f8-4731-aee8-f5fe235c72ea","resolution":{"observed_at":"2026-05-10T13:05:26.778195Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.13797","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Monea, Y","venue":null,"work_id":"ed58201b-e4c5-4fe0-9eef-ccdb348406d5","year":2025},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:5f22c3d5afe46276b8793d8b6074b0e2f47c3bd7c0bb4cf5e4a4abef03852c4c","observation_id":"1ddbf032-531d-4a4d-91db-0d33e6876131","resolution":{"observed_at":"2026-05-10T11:00:04.718047Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.15364","doi":"10.48550/arxiv.2504.15364","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kediff: Key similarity-based KV cache eviction for long-context LLM inference in resource-constrained environments","venue":"arXiv (Cornell University)","work_id":"88d9d4c4-afc1-412a-968d-d8c0feb878cc","year":2025},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:7e5b587399fe9fed605754e704f2193bf5e0a5ff4352a675fa737eeba067bfbf","observation_id":"5964d461-5796-4b7f-9cd0-a2d4370a5181","resolution":{"observed_at":"2026-05-10T11:00:04.720511Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:29.99463+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:29.99463+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00448","last_updated":"2025-04-14T10:11:13Z","snapshot_observed_at":"2026-07-06T17:10:21.098136Z","submitted_at":"2023-12-31T10:53:58Z","title":"Beyond Chinchilla-Optimal: Accounting for Inference in Language Model Scaling Laws","version":3},"cited_work":{"arxiv_id":"2401.00448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.00448","snapshot_observed_at":"2026-07-04T20:40:07.770901Z","title":"Beyond chinchilla-optimal: Ac- counting for inference in language model scaling laws","venue":null,"work_id":"9d425a0e-4f3c-4f59-8aaa-7d767450104a","year":2024},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"cited_paper":"/paper/2401.00448","citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:e861ee974a6382f1be842184ce1648ed9430477ab8827daf596254ab68875d39","observation_id":"0b594e6f-0561-4a20-8d49-ff6c1c112fdc","resolution":{"observed_at":"2026-05-10T11:00:04.723643Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"066fa640-0933-4bb2-826c-03c4c2946505","year":2025},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:97e488b86fea3830cbc6908bf4c2d7a2cabb225a4be3c1ea7c3dbf55eacb58e1","observation_id":"24997511-817f-47a8-ab60-198fa8d7989b","resolution":{"observed_at":"2026-05-22T01:15:54.341562Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:f9372b42598a4c44da0a2ba696db059103ae6bad135fa16c53a0120e428a2156","observation_id":"e6541010-ee70-40a0-a73b-101f436385dc","resolution":{"observed_at":"2026-05-10T11:00:04.726198Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"cited_work":{"arxiv_id":"2502.11089","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.11089","snapshot_observed_at":"2026-07-10T01:36:44.142264Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","venue":"cs.CL","work_id":"c74d35ec-94d3-48f5-a291-20cfad7c04a3","year":2025},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"cited_paper":"/paper/2502.11089","citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:579e35a53bd509214a355b74a4961f439994035d475ef00f031b321220b45c74","observation_id":"324cf019-ad3e-474c-a8a9-ae486e21c7c9","resolution":{"observed_at":"2026-05-16T23:46:30.294205Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":"2401.10020","doi":"10.48550/arxiv.2401.10020","metadata_source":"pith","pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Rewarding Language Models","venue":"cs.CL","work_id":"b3903c9e-1bc7-4267-a171-6311902be2a4","year":2024},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:0fffa2103f38f29225997fd5a59e55c8481872aa43edb6c841faaf6e17363e34","observation_id":"edb53ea2-d14a-4f08-a049-cd13b4ddc6ea","resolution":{"observed_at":"2026-05-13T12:01:42.779186Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:11.326851+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:11.326851+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"641c8d51-497d-4897-a786-dac916005a1c","year":2020},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:3023f20ac4a9366adbc5fc053d4a1edb084ef794206cbeb0674345490ced7da6","observation_id":"08b1e6b2-aacf-48b9-b32f-0f52b4996d96","resolution":{"observed_at":"2026-05-22T01:15:54.337542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The subtlety is that g is emitted deterministically at inference, so its probability is degenerate and admits no sampled log-probability","venue":null,"work_id":"d1314779-37ea-4464-8049-f23065be4c33","year":2024},"citing_paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T04:57:12.923258Z"},"links":{"citing_paper":"/paper/2604.18002"},"observation_digest":"sha256:edc7b37beb19178fbad6dd60e7ed2d96d3c1b93332c188b38548250e8f7b5f69","observation_id":"52c33c96-37e0-4a72-b5e6-3f6ac42db7d6","resolution":{"observed_at":"2026-05-22T01:15:54.329299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.18002","last_updated":"2026-04-20T09:26:28Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:04:59.629739Z","submitted_at":"2026-04-20T09:26:28Z","title":"Neural Garbage Collection: Learning to Forget while Learning to Reason"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":13,"verified_fuzzy":1},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2604.18002."}