{"as_of":"2026-08-07T08:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:de34ae682dbe4d14f8b3a74838ee3f5570722f6144ee31918caa0e670b141aef","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:43:18.024397Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.01326/citation-record","integrity":"/paper/2508.01326/integrity","json":"/paper/2508.01326/citation-record.json","paper":"/paper/2508.01326"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.619524Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":"c936f407-2e7f-4a32-8adf-3dda9417b9d1","year":null},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.360158Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:de941c462501c83d7697a43ac339e14e938796c0d8499f5dde8df8606a0e9859","observation_id":"79f74fa5-0bab-43ff-89a0-0a7ae353169f","resolution":{"observed_at":"2026-08-06T05:43:18.624163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:17.422442Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.422442Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:1a0dc42eb6b5d5188294eb061ffb87e0449c048e30dd054c8c3fe299b8033544","observation_id":"238770c2-8263-473a-8bba-c26e5679cf65","resolution":{"observed_at":"2026-08-06T05:43:17.422442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.596128Z","title":"N.; Prabhumoye, S.; Kamalu, J.; Satheesh, S.; Nyberg, E.; Patwary, M.; Shoeybi, M.; and Catanzaro, B","venue":null,"work_id":"89397f95-865f-4fd8-ad84-d28f27c4a869","year":2025},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.501050Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:40a514e5bd4a91011a6df2fb3bcaa555c414347167a62f63c2ee4ab7cfa67491","observation_id":"9e5bab42-a23e-44bf-944f-50ce343cc649","resolution":{"observed_at":"2026-08-06T05:43:18.600903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.582474Z","title":null,"venue":null,"work_id":"ff2afd34-e353-4f58-a8cc-ec02cba294e1","year":2019},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.579043Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:c6281304ea7fd167bbac29685babfd6e68aee1940612dc48da75160f5c158660","observation_id":"29e46cb3-a30b-4891-9524-db88a30b211b","resolution":{"observed_at":"2026-08-06T05:43:18.586528Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03398","last_updated":"2024-12-04T15:27:39Z","snapshot_observed_at":"2026-08-02T13:13:42.609108Z","submitted_at":"2024-12-04T15:27:39Z","title":"RedStone: Curating General, Code, Math, and QA Data for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03398","snapshot_observed_at":"2026-08-06T05:43:17.640566Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.640566Z"},"links":{"cited_paper":"/paper/2412.03398","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:5c3dd4ee32711609a91399f012dd40811c816fef4e45b6a8db301428b7b12674","observation_id":"8d97e217-668a-438d-a088-235ffe50bccf","resolution":{"observed_at":"2026-08-06T05:43:17.640566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.569127Z","title":null,"venue":null,"work_id":"1f7d56a3-e758-4cb9-8c34-6c6e6ab2095c","year":2025},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.718476Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:e3c6d4e6dbae6545ed943bad5def6756e303dedb26f4376513853b32df48b9bd","observation_id":"2a0e962a-676b-4797-9264-0dcfbf07fd6e","resolution":{"observed_at":"2026-08-06T05:43:18.573193Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.553998Z","title":null,"venue":null,"work_id":"c0fdff0b-5324-423c-9331-f2cee944d7e5","year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.772858Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:af9637402f7162c816c82a0248e4e70099c966058823f67d954da31e20057f25","observation_id":"2f91434f-8a57-4d9c-83fd-41f878210c2b","resolution":{"observed_at":"2026-08-06T05:43:18.559055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-06T05:43:17.823503Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.823503Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:bcc03183fb6f532c8cde0dc09baf630f7bc72bd21ca72c450f72bfbb2de2edb0","observation_id":"d7b96382-4e1a-441c-aa44-526c7f023338","resolution":{"observed_at":"2026-08-06T05:43:17.823503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T05:43:17.888607Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.888607Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:f7cb25abcc4ead5119dda4aafc2ac2bc77e9283c6536949db5e9fddad33d8c20","observation_id":"2eb8152f-108e-4392-a0dc-b5be12bc7bca","resolution":{"observed_at":"2026-08-06T05:43:17.888607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T05:43:17.893589Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.893589Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:7aa0200b5f371d7d4f799c1c37361e208e68764edf69988e020a4bb61927392f","observation_id":"94130791-ad55-4b46-8fc3-11f79e64938c","resolution":{"observed_at":"2026-08-06T05:43:17.893589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T05:43:17.898223Z","title":"L.; Liang, J.; Guo, J.; Ni, J.; Li, J.; Wang, J.; Chen, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.898223Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:6e9d40b56778d26aefcf26c90901f3c9c14d45b8c2c8d7ad4928b920ee28f870","observation_id":"798ad934-d7c9-4064-9149-9b34d17a4d4a","resolution":{"observed_at":"2026-08-06T05:43:17.898223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.539523Z","title":null,"venue":null,"work_id":"5cc73e8b-2ed4-4329-920e-9a40060acf65","year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.902561Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:01cf99c11c4809cbdef3eba37f3d3afad79a418296adb5ea86b14f094fc6bf63","observation_id":"b88cce04-2a42-44bf-bdce-c69ae18453a2","resolution":{"observed_at":"2026-08-06T05:43:18.543618Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.526052Z","title":null,"venue":null,"work_id":"0e448b1e-5b04-4be5-9afb-25fbb21df007","year":2019},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.906588Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:7d047bc7aa2a06193fc7b88a2068e98188457d8e998f06e7d80ed311d57c2d82","observation_id":"3954e2c4-4191-4b82-b739-10bedbcb7dd1","resolution":{"observed_at":"2026-08-06T05:43:18.530087Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T05:43:17.910572Z","title":"C.; Nikolaidis, C.; Allonsius, D.; Song, D.; Pintz, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.910572Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:3bee9cfbf1fabb05fa1335e181f4561781f59206403d66b83717935d6b6c38bd","observation_id":"4b4f2355-7925-436a-9b2f-f3a8c24f7e6c","resolution":{"observed_at":"2026-08-06T05:43:17.910572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-06T05:43:17.914725Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.914725Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:d6aa7d2cda7ef60e113ed8d46d25fd888c3a363c366ca01b15ffe4c4dff5ec79","observation_id":"f511d552-bd24-4782-9a4a-b08555bb82c5","resolution":{"observed_at":"2026-08-06T05:43:17.914725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.512342Z","title":null,"venue":null,"work_id":"6c7b7eec-b448-4437-a39d-1c408fc99c22","year":2021},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.918721Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:9f07025809de421d5f07e102112ba6652c36e61cf12ab3408ad15af7ff6e404f","observation_id":"d00723b9-be49-4940-8242-d058bb237439","resolution":{"observed_at":"2026-08-06T05:43:18.516510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20094","last_updated":"2025-05-08T00:24:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-28T17:59:01Z","title":"Scaling Synthetic Data Creation with 1,000,000,000 Personas","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20094","snapshot_observed_at":"2026-08-06T05:43:17.922492Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.922492Z"},"links":{"cited_paper":"/paper/2406.20094","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:c246be7efa745bc8a29ed4293c957d3c1d062a229cff2dd0d4581981f757d1c2","observation_id":"575892e0-359d-40dd-b333-bcc903e1e1d8","resolution":{"observed_at":"2026-08-06T05:43:17.922492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.498688Z","title":null,"venue":null,"work_id":"fd5a325f-79c3-459c-a7ce-0dcba351212c","year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.926507Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:247e8764d8cae8137efdbf399eee27ec7560827e2d9a8c138e563e586e35934b","observation_id":"7828b917-7e2f-4526-a1ee-06409f66c56c","resolution":{"observed_at":"2026-08-06T05:43:18.502761Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.484953Z","title":null,"venue":null,"work_id":"74b08275-54e0-4e76-9c24-867119bcbe60","year":2021},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.930979Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:249fa8f48dceb923f9b7aa89d2e6f4e619c2106ab5b878408f95876c1aad5675","observation_id":"882d6aa5-b514-4ff6-916e-25259a582ed1","resolution":{"observed_at":"2026-08-06T05:43:18.489195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:17.935176Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.935176Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:25a9eb1bf402ca9f8f870badd702a453d3d428835e0828e7443b2648cf31415c","observation_id":"9bd46dfb-6d4d-4465-a2cc-448b5e8ec37a","resolution":{"observed_at":"2026-08-06T05:43:17.935176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.462422Z","title":null,"venue":null,"work_id":"c97668cb-3737-474d-a4d9-707f900b4a8c","year":2023},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.939262Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:d79a6a164d8cab0a5e73812535157ce46a1f3e9d7b19e3166b25ba75c33a1c23","observation_id":"5d03ad7b-ffcd-471e-bb32-83a0a7d0b5ba","resolution":{"observed_at":"2026-08-06T05:43:18.466401Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.449161Z","title":null,"venue":null,"work_id":"5ca9f40a-b51f-4dcc-ac24-37ca24566e2a","year":2025},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.943464Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:7a580359116ade1b28183b54e9d9697f3c00db0c7c99b60f364e613f4be18e31","observation_id":"bf66800d-414c-4af9-84df-1344cc3aa1a7","resolution":{"observed_at":"2026-08-06T05:43:18.453309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.435650Z","title":null,"venue":null,"work_id":"cc001c7e-20ae-4631-9b07-79af70ee461d","year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.948408Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:86c43a43a6b30479ae09aac0fb2ebbc22fdaecc5a32667cf3c200c9f44180ae2","observation_id":"d51bbd73-88a5-4dfb-a563-9ffe0b73e5ce","resolution":{"observed_at":"2026-08-06T05:43:18.439581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06275","last_updated":"2016-09-01T10:56:45Z","snapshot_observed_at":"2026-07-06T05:04:25.691401Z","submitted_at":"2016-07-21T11:40:50Z","title":"Dataset and Neural Recurrent Sequence Labeling Model for Open-Domain Factoid Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06275","snapshot_observed_at":"2026-08-06T05:43:17.952226Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.952226Z"},"links":{"cited_paper":"/paper/1607.06275","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:24e8126e18724fc9e392e3a36b61d594109dbf2601249248aaad334b2d84cfea","observation_id":"eac285e1-0e6a-4f85-b88a-864c4d52ffd5","resolution":{"observed_at":"2026-08-06T05:43:17.952226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.422095Z","title":null,"venue":null,"work_id":"c388aa4c-e986-44ad-b216-782453ff883b","year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.956526Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:8347a68fcbf33ab2ffaff1a8d745f2783ba5fc360d204a88a206ad9f7962ef66","observation_id":"9bd068ed-e8d0-4e4d-a3a4-0dcafb48e84c","resolution":{"observed_at":"2026-08-06T05:43:18.426274Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.408477Z","title":null,"venue":null,"work_id":"f549fee2-9fa1-475e-9596-055d4d9271ce","year":2021},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.960436Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:fdd30f0173b8807982c0c0e8465de656fda98059c9947f58568975cdb6daff8d","observation_id":"3bfe9d6a-1785-4ad3-b534-3ecadf902b39","resolution":{"observed_at":"2026-08-06T05:43:18.412569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-07-06T20:15:22.511263Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-06T05:43:17.964372Z","title":"W.; Liu, J.; Malik, S.; Merrill, W.; Miranda, L","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.964372Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:fede8aff0659cb171a669045f07a2220197eed7da06df3a851745372b7dec2d1","observation_id":"a28123b8-e427-4432-b22d-cd957093d1eb","resolution":{"observed_at":"2026-08-06T05:43:17.964372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07263","last_updated":"2024-07-09T22:37:59Z","snapshot_observed_at":"2026-07-06T18:43:59.807904Z","submitted_at":"2024-07-09T22:37:59Z","title":"Reuse, Don't Retrain: A Recipe for Continued Pretraining of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07263","snapshot_observed_at":"2026-08-06T05:43:17.970063Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.970063Z"},"links":{"cited_paper":"/paper/2407.07263","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:dba71b5ecc14824d7437c286e31daa47ed9a68a69027c9ba4d1b7268d2ae3b08","observation_id":"1d71aaed-b70c-4a6c-aaeb-70cc9479450e","resolution":{"observed_at":"2026-08-06T05:43:17.970063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.393562Z","title":"B.; Lozhkov, A.; Mitchell, M.; Raffel, C.; Werra, L","venue":null,"work_id":"fbaa670b-1f3a-4f69-87ad-ce892b3c23b4","year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.974303Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:75aa4a542750850723dbc05a89345ec147e23109d7ee21ddc654f9f0aacf24a1","observation_id":"e4b6e2b6-38f2-47de-8da8-0f683a3a5134","resolution":{"observed_at":"2026-08-06T05:43:18.398730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T05:43:17.978339Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.978339Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:f71eca627c8815f0813c537649a84315aa903bed6feb595fb0e5a634215e601e","observation_id":"720d3af0-3d1e-44c5-ab21-cbe5cbceb286","resolution":{"observed_at":"2026-08-06T05:43:17.978339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.380161Z","title":"L.; Bhagavatula, C.; and Choi, Y","venue":null,"work_id":"d71f0172-f55a-4bca-93e6-f63caa7a798c","year":2021},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.982796Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:3a1e1cc67104fc3eed06c642c3a26befd7d8e53beee1f23512d7119656fb8157","observation_id":"a9ac494f-86dc-4e8a-a95b-453d4b15543d","resolution":{"observed_at":"2026-08-06T05:43:18.384264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T05:43:17.986876Z","title":"K.; Wu, Y.; and Guo, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.986876Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:44ae42d197d3160e763f9ac5fef2afef7c3668a290dc35dfd7c1b80a34f8cf68","observation_id":"013bde94-6e2a-44fc-b76e-ac1784dccc79","resolution":{"observed_at":"2026-08-06T05:43:17.986876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.363890Z","title":null,"venue":null,"work_id":"1f9f2664-1e74-4243-a9e6-4a572d0508b1","year":2025},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.991070Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:cfc2847d45556c9d8fa33b51a75c3c9202a6a15847cf82b38f745952f43258a4","observation_id":"f81ddd4f-f546-4d01-a1af-0bbfc0ea46af","resolution":{"observed_at":"2026-08-06T05:43:18.368512Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.349365Z","title":"W.; Chowdhery, A.; Le, Q.; Chi, E.; Zhou, D.; and Wei, J","venue":null,"work_id":"68ccbf90-5c8a-4eb6-8260-356c72cf194f","year":2023},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.995256Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:b0e20f37f553b69478c4429d2a2b904d5a78affa0e82f5cb95a5e9a4f533af4a","observation_id":"ce633c39-22b8-4fb6-af8e-6e92ac03464a","resolution":{"observed_at":"2026-08-06T05:43:18.353426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.335846Z","title":null,"venue":null,"work_id":"b562b5fc-7117-44dd-aad8-1b1e7cb9816b","year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:17.999298Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:4b37916ec570159a0ac890a43310fb1e8b7e28cede8a761d564981a42bb7001a","observation_id":"3a423114-7fff-40da-b277-1841b106b7a9","resolution":{"observed_at":"2026-08-06T05:43:18.340107Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20512","last_updated":"2025-06-25T14:58:13Z","snapshot_observed_at":"2026-08-06T22:44:10.264269Z","submitted_at":"2025-06-25T14:58:13Z","title":"OctoThinker: Mid-training Incentivizes Reinforcement Learning Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.20512","snapshot_observed_at":"2026-08-06T05:43:18.003368Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:18.003368Z"},"links":{"cited_paper":"/paper/2506.20512","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:d7d2eaf41d11248791bb9adf65e7dd58a2cc3bd7790a94155116156d432df36b","observation_id":"b8317bc3-54de-4590-a75c-37df5c60a5d1","resolution":{"observed_at":"2026-08-06T05:43:18.003368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.322948Z","title":null,"venue":null,"work_id":"19e66d43-465a-4b1e-adeb-782e8367296b","year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:18.007512Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:e7f56d68bec2fbab51862f8d1b60b727760038540cc114255d822bf1178758cf","observation_id":"4c50b4ce-6913-49bb-bd78-272b1bea094a","resolution":{"observed_at":"2026-08-06T05:43:18.326735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.309912Z","title":null,"venue":null,"work_id":"2279da19-e9f6-493f-8618-f6faa5d5d423","year":2019},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:18.011444Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:da005e81d67ff791199eb24bcaf65485c49405419beba8aeba6b77b48e203d42","observation_id":"425bb079-e8d5-4c07-9ed9-92cf4d07d082","resolution":{"observed_at":"2026-08-06T05:43:18.313760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19327","last_updated":"2024-07-10T16:55:47Z","snapshot_observed_at":"2026-08-06T06:05:02.911714Z","submitted_at":"2024-05-29T17:57:16Z","title":"MAP-Neo: Highly Capable and Transparent Bilingual Large Language Model Series","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19327","snapshot_observed_at":"2026-08-06T05:43:18.015462Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:18.015462Z"},"links":{"cited_paper":"/paper/2405.19327","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:7566b835c802451225351b53a4c30f208cc00f250bb79294e2e7eba041527fbd","observation_id":"e920973b-26f2-43ad-99d9-a0c335afcac7","resolution":{"observed_at":"2026-08-06T05:43:18.015462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02807","last_updated":"2025-04-03T17:52:07Z","snapshot_observed_at":"2026-07-06T21:03:50.078667Z","submitted_at":"2025-04-03T17:52:07Z","title":"MegaMath: Pushing the Limits of Open Math Corpora","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02807","snapshot_observed_at":"2026-08-06T05:43:18.020122Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:18.020122Z"},"links":{"cited_paper":"/paper/2504.02807","citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:ac77d267e7b9209c320c5e94f6715a9ee2de14a00e92f28bb05622641f4256b0","observation_id":"0463f911-4d86-4bbf-a55b-5f8430854840","resolution":{"observed_at":"2026-08-06T05:43:18.020122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:43:18.294645Z","title":null,"venue":null,"work_id":"72444e98-f104-48ed-b63e-bc052bb4b32e","year":2024},"citing_paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T05:43:18.024397Z"},"links":{"citing_paper":"/paper/2508.01326"},"observation_digest":"sha256:2c9641ff8541f11d241e6946aff0cc79a7d67bcd7c925b5e0115119edbe96f3f","observation_id":"0f9da73d-cd69-40b9-a3a1-12fb1fe31b38","resolution":{"observed_at":"2026-08-06T05:43:18.299584Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.01326","last_updated":"2025-08-02T11:37:16Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T05:43:13.832530Z","submitted_at":"2025-08-02T11:37:16Z","title":"Large-Scale Diverse Synthesis for Mid-Training"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2508.01326."}