{"as_of":"2026-08-07T01:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d5793ba6167e7aef350508d9cf18f0a74ed01d98eaa39b3997a0b7fe2fef023","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T10:45:46.618668Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.04969/citation-record","integrity":"/paper/2607.04969/integrity","json":"/paper/2607.04969/citation-record.json","paper":"/paper/2607.04969"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Phi-4 techni- cal report.arXiv preprint arXiv:2412.08905,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:08636eccd5587c23b5f7318f5798a3d833625a5bd5386572da58a2f759c5e7d2","observation_id":"0a1d000a-3215-432f-be92-848e41b96587","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Smollm2: When smol goes big–data-centric training of a small language model.arXiv preprint arXiv:2502.02737,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:f877912d4dc50f4b135ef44f30c9438cae96c9c105dc9af8d6e5617b1f53689a","observation_id":"21cff844-1be4-4e10-bcde-fd3fc1f8428f","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07372","last_updated":"2026-07-12T07:41:31Z","snapshot_observed_at":"2026-08-06T19:10:40.703812Z","submitted_at":"2026-01-12T09:54:49Z","title":"Conditional Memory via Scalable Lookup: A New Axis of Sparsity for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.07372","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Conditional memory via scalable lookup: A new axis of sparsity for large language models.arXiv preprint arXiv:2601.07372,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2601.07372","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:a489c61c435048c06c32f129de1339594992e33c3d8161eda8efc78732fc6f67","observation_id":"57b7f3bd-d63e-46e9-8f64-c6b2c8044616","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04235","last_updated":"2025-05-19T11:52:17Z","snapshot_observed_at":"2026-08-06T15:53:25.719127Z","submitted_at":"2025-02-06T17:19:55Z","title":"Reformulation for Pretraining Data Augmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04235","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Reformulation for pretraining data augmentation.arXiv preprint arXiv:2502.04235,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2502.04235","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:10a0fff75b2e95d8676cd500e39e5c6eff8b614350b105b41c875cf329b7f3bc","observation_id":"ac4162bd-e12c-4948-a030-39ba601e5c8c","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10487","last_updated":"2022-05-21T02:14:27Z","snapshot_observed_at":"2026-08-04T13:21:32.121470Z","submitted_at":"2022-05-21T02:14:27Z","title":"Scaling Laws and Interpretability of Learning from Repeated Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10487","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Scaling laws and inter- pretability of learning from repeated data.arXiv preprint arXiv:2205.10487,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2205.10487","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:d6343aec071000c2af322e5b7efa8f5e24394497ef79a30b1f3bb3d6b23457c9","observation_id":"0f37e195-1eca-4716-a8b1-1c6d23669b05","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Train- ing compute-optimal large language models.arXiv preprint arXiv:2203.15556,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:143b90b0729fba7b397e53f81cd7cf57b2d162a67ab2577d91c2abdef9c1e6fa","observation_id":"0736a376-dae2-4317-820f-6f4f87747bc7","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12364","last_updated":"2025-02-06T09:36:58Z","snapshot_observed_at":"2026-08-04T06:56:33.572912Z","submitted_at":"2024-11-19T09:24:34Z","title":"Ultra-Sparse Memory Network","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12364","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Ultra- sparse memory network.arXiv preprint arXiv:2411.12364,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2411.12364","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:11f5ca0c77d0880fdbdafb80a3b99a41b4f36ba8d7e96eab61c9ad91024592bf","observation_id":"e364a06c-7f2d-4cab-aeaf-bc5df9d406ab","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Ziyue Li, Chenrui Fan, and Tianyi Zhou","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:a4800d2ab040d1b1ccb797c4f800bb8ca34afdebed0f4af8d258b3bbb8225e3f","observation_id":"5b965e8a-d04d-415a-a662-6fe5946470a2","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Let’s verify step by step.arXiv preprint arXiv:2305.20050,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:8112472ff4bbf546800befa8e1fdfd9dd4e3dd1125fb5aed98aa1ff5b7f2a680","observation_id":"d0dfc0bd-c81c-49e7-a214-27aa69869332","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24832","last_updated":"2025-06-18T15:27:03Z","snapshot_observed_at":"2026-08-01T21:38:41.511664Z","submitted_at":"2025-05-30T17:34:03Z","title":"How much do language models memorize?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24832","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Smollm2: When smol goes big—data-centric training of a fully open small language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2505.24832","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:ed3ff53c482f9d3391c9e1e067d61a3038fb26f43285d74e735bd6d0fef9c457","observation_id":"7ddfe9df-2dac-499f-83e3-0f48e186728f","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-07-06T22:39:08.850289Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Olmo 3.arXiv preprint arXiv:2512.13961,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:88271a60df1231bb47421fb86b360411ee799c93ad1d251dd9c5bcd6934db472","observation_id":"016b0d27-4f1c-4fdf-9077-d0a313695566","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07263","last_updated":"2024-07-09T22:37:59Z","snapshot_observed_at":"2026-07-06T18:43:59.807904Z","submitted_at":"2024-07-09T22:37:59Z","title":"Reuse, Don't Retrain: A Recipe for Continued Pretraining of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07263","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Reuse, don’t retrain: A recipe for continued pretraining of language models.arXiv preprint arXiv:2407.07263,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2407.07263","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:aa7e14aeb0825decd59866214bfee40a04dcaaf18cb38e62eb121a7577447e60","observation_id":"5fb69b54-f28c-4bea-95ec-b9069f16e924","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01116","last_updated":"2023-06-01T20:03:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T20:03:56Z","title":"The RefinedWeb Dataset for Falcon LLM: Outperforming Curated Corpora with Web Data, and Web Data Only","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01116","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"The refinedweb dataset for falcon llm: outperforming curated corpora with web data, and web data only.arXiv preprint arXiv:2306.01116,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2306.01116","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:5b755388b523c2b6ad73693fa85a5e4615b8c692bd73e4d1bc3c6492dbabfe5d","observation_id":"9d5df397-5493-4268-bdaa-aa093e709d94","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09085","last_updated":"2022-11-16T18:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-16T18:06:33Z","title":"Galactica: A Large Language Model for Science","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09085","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Qwen3-coder-next technical report","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2211.09085","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:2ad0048dbeb78ca250bf2e78a0f4e6c771ed92a7ca9af1bacbe31212ddf52ec3","observation_id":"9f79dfb9-1d36-46f9-a59d-b50b33d7fb36","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Kimi k2: Open agentic intelligence.arXiv preprint arXiv:2507.20534,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:3ef31c84502af859f8668b11917c1b18fc9a534f89475805772c2b35c3930c31","observation_id":"c2f585ae-f956-40fb-ba97-e8247b0a8355","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01560","last_updated":"2024-10-05T03:54:22Z","snapshot_observed_at":"2026-07-06T19:26:02.193680Z","submitted_at":"2024-10-02T14:00:09Z","title":"OpenMathInstruct-2: Accelerating AI for Math with Massive Open-Source Instruction Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01560","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Openmathinstruct-2: Accelerating ai for math with massive open-source instruction data.arXiv preprint arXiv:2410.01560,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2410.01560","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:e9a5a751671173bc3c061bd4740c38168b49911de7b2dacd7b000d0211f2da45","observation_id":"72e0f637-ddf4-4168-bb56-6415d1dfcb4d","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-07-06T18:49:33.987133Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Generalization vs memorization: Tracing language models’ capabilities back to pretraining data.arXiv preprint arXiv:2407.14985,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:04250013c30753033d23d59ec7b638c77e8e0ee2bdd72b79c302de77d8740bb1","observation_id":"10a4e715-c655-4ca4-aee8-55fcf3ac4764","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Larger datasets can be repeated more: A theoretical analysis of multi-epoch scaling in linear regression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:a2e3816670ee06947c4032c5f9ee36e14c3667682d0011b4e26fbc5d7f685e4e","observation_id":"d13ccbe8-d9a3-40c6-90d6-4c078dd88cd3","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Nicolas Zucchet, Francesco d’Angelo, Andrew K Lampinen, and Stephanie CY Chan","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:376ecdd594beae375427b6ba6e5e674290c6435a52f5d9005637334c00e578c7","observation_id":"920c41c3-595b-4484-8567-053d0cb39d89","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22448","last_updated":"2025-07-30T07:55:33Z","snapshot_observed_at":"2026-08-06T11:43:58.532083Z","submitted_at":"2025-07-30T07:55:33Z","title":"Falcon-H1: A Family of Hybrid-Head Language Models Redefining Efficiency and Performance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.22448","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Falcon-h1: A family of hybrid-head language models redefining efficiency and performance.arXiv preprint arXiv:2507.22448,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2507.22448","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:c7fec3e4348c15e526c74c313e70e8b428c8ac02d9cc6b1c97815c9175d783cf","observation_id":"dff1143d-d849-420a-9631-c9316323ac43","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-11T10:45:45.626304Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2607.04969."}