{"as_of":"2026-08-21T10:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:01f26352b33e965bbd873e448790fe8613d075325c03da0d4f919837580ee221","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:53:35.074701Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09893/citation-record","integrity":"/paper/2608.09893/integrity","json":"/paper/2608.09893/citation-record.json","paper":"/paper/2608.09893"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.248351Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.248351Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:02e4b1e8a2ab0d36f0fa66827085df04b3e5fd5abd9b7274e682481287206784","observation_id":"53d75c85-cd28-404d-b3b5-13fc771c2541","resolution":{"observed_at":"2026-08-11T04:53:34.248351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.330331Z","title":"Large Language Models are Zero-Shot Reasoners , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.330331Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:7dd49dcabaf53fc88b0c5924be972f95718528edbe5e7a0bc861ef54228995cd","observation_id":"b2b46340-bc5e-4aa6-90c7-092b61336a8c","resolution":{"observed_at":"2026-08-11T04:53:34.330331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.335832Z","title":"The Eleventh International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.335832Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:4525e3d059ad3a136cd4ff1dc03a75ff6d8659685bd4586b8fbac62d4543f131","observation_id":"137ce7b9-9eb7-4dda-8f7f-ed94a04e853b","resolution":{"observed_at":"2026-08-11T04:53:34.335832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.341064Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.341064Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:1c3c24f9638e44a834cac6f234715613b2b38b4d25c4f604b744f53cf71b8e90","observation_id":"aa31f5b1-671d-4f63-b8ab-e90d1877a2a2","resolution":{"observed_at":"2026-08-11T04:53:34.341064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:35.642259Z","title":"2025 , primaryClass=","venue":null,"work_id":"19428895-2314-4bc2-b9be-77a6d6f0a8b8","year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.344763Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:5f6dceec2514eb932e27afd02ee50c87edd3b9d21155fcfdea808d789a64bfba","observation_id":"5234c5bb-1751-482b-89c0-d6ac9d5f1f10","resolution":{"observed_at":"2026-08-11T04:53:35.687803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.348707Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.348707Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:2e2e31b105be33fd553939656209483c4536290c01caf6c6f656d9d556cdae1a","observation_id":"7c90734a-9f93-43c9-b6c9-dfa2a23b712f","resolution":{"observed_at":"2026-08-11T04:53:34.348707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.353632Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.353632Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:c9d535d4dff7d60195e927204a8d11172d17c69e144e58718e0cc1f546f5f5aa","observation_id":"0f400de2-e299-41f1-89fc-e660be37dcd3","resolution":{"observed_at":"2026-08-11T04:53:34.353632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.742","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:35.173907Z","title":"Calc- X and Calcformers: Empowering Arithmetical Chain-of-Thought through Interaction with Symbolic Systems","venue":null,"work_id":"35cf57f2-d336-4add-aa24-50005493eccc","year":2023},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.357429Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:d67c70120f5e301db95559bf71d8b90176240d06a3feefb6b1d58d0799466929","observation_id":"d8ab783c-1e66-46f2-b0d3-d1a5396d44c3","resolution":{"observed_at":"2026-08-11T04:53:35.247360Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.361274Z","title":"Are NLP Models really able to Solve Simple Math Word Problems?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.361274Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:70dc2557b16104360617fc9addf8cd88cc4ffb2dc1125535be7331ca44a9324d","observation_id":"96d9c094-a1ee-45d9-9fcf-c9845994fa24","resolution":{"observed_at":"2026-08-11T04:53:34.361274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.365869Z","title":"OpenMathInstruct-1: A 1.8 Million Math Instruction Tuning Dataset , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.365869Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:4675062234200dee05cdce2f5872dc2f3d33485a01883b9dea78800c48c9bde6","observation_id":"3bdb191a-9ebf-4c55-b7c0-6ea52a3c015f","resolution":{"observed_at":"2026-08-11T04:53:34.365869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.370168Z","title":"OpenMathInstruct-2: Accelerating","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.370168Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:fcdebfc585c1ccd001a8a2fa1ef6ffa8dfde36c380061a0b1a71acc3f7479655","observation_id":"d5eb40da-79a5-4725-a6f2-efdf156811e1","resolution":{"observed_at":"2026-08-11T04:53:34.370168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.375009Z","title":"Hugging Face repository , howpublished =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.375009Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:2f0f6d788c005f1f9686145e0e6ab8dc7adc9b0e2a8cf755693c0fa15638f4cd","observation_id":"ba24f413-4092-46d0-b027-0419913559e1","resolution":{"observed_at":"2026-08-11T04:53:34.375009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:35.595679Z","title":"2024 , eprint=","venue":null,"work_id":"fd2d14d0-253a-4be4-be6d-9b284dd1bf58","year":2024},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.424018Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:02598e5f52a1eb0249200a8e2cd92ddadd4a132bfa8ee2d1cd7b7e286896d1fd","observation_id":"e75a434f-cb53-4795-9f78-67b91c1faffa","resolution":{"observed_at":"2026-08-11T04:53:35.600840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.506291Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.506291Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:20514592fd62d99294774da166512369e68e3af6e03d63867c20d2b7fccacd7c","observation_id":"e2dbfa1b-b8d4-41ae-910a-9ec58e22e1d0","resolution":{"observed_at":"2026-08-11T04:53:34.506291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.589586Z","title":"2025 , url=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.589586Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:ba8a22a695f7f6be112d59039f9a89eaf166de314dd51d3cbd88b95f1a505835","observation_id":"f169cc92-396c-462b-8a94-9bb5ae241067","resolution":{"observed_at":"2026-08-11T04:53:34.589586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.677168Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.677168Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:3a6211c1ae7fb3ecdeb2a40eef1667437b136f2066e67c39faf7379758469ec1","observation_id":"888d91ab-b146-4a52-abf5-83031fbac0aa","resolution":{"observed_at":"2026-08-11T04:53:34.677168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.686944Z","title":"The Impact of Reasoning Step Length on Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.686944Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:d4ce6f60fc330d32533001a520866608cac5b1c497c247a3442cb2dc45315096","observation_id":"f06168ac-42ea-4cca-bfa0-3da8dd959941","resolution":{"observed_at":"2026-08-11T04:53:34.686944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.692275Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.692275Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:2e9128d559ca0a72f2a461020b33e833474cef749e3cca1af688788866e5ee27","observation_id":"68e2db2c-a6c9-436f-9a9c-9544a968f5b5","resolution":{"observed_at":"2026-08-11T04:53:34.692275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.696496Z","title":"Measuring Chain of Thought Faithfulness by Unlearning Reasoning Steps","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.696496Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:5b4f312a1d26af79c35a39660b0c065f7e399ecacfe856121d2406cbe76cc3f7","observation_id":"b5b5f706-07fa-4406-93eb-e757f0eb7698","resolution":{"observed_at":"2026-08-11T04:53:34.696496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.700949Z","title":"Small Models Struggle to Learn from Strong Reasoners","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.700949Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:04835194200e4408423622ea55b7bdefa6a8f7201e84030f4e6123490dbd1dd5","observation_id":"56cea148-e132-4fda-9e35-32c5dc215f17","resolution":{"observed_at":"2026-08-11T04:53:34.700949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.705103Z","title":"Skip-Thinking: Chunk-wise Chain-of-Thought Distillation Enable Smaller Language Models to Reason Better and Faster","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.705103Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:d714cf0c215d8ad7470e959399a46669b52fd47928579cf73e3aea3a97d71c39","observation_id":"3852dcc3-2b7f-4cbc-83cb-ea0d7770e5a0","resolution":{"observed_at":"2026-08-11T04:53:34.705103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.708907Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.708907Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:55fe08bf7b4a19a0f8a9c216d58f8e16b6688bc550d2ccf34c4780220ceb2b90","observation_id":"f1398cf1-3658-4b3e-912a-e89f563d26f4","resolution":{"observed_at":"2026-08-11T04:53:34.708907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.713136Z","title":"2019 , eprint=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.713136Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:649f6fbb07ce08b62a641bd54c1a1c92478579122f435d7391fa2f15e54abb2b","observation_id":"17fec7bc-2409-46e6-aa50-3b3687df7418","resolution":{"observed_at":"2026-08-11T04:53:34.713136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.716849Z","title":"2017 , url=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.716849Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:cae0fe6533bc93fcd9f614045e93613feda25526de99f6868e92565b095ce424","observation_id":"71c245d4-a446-4f33-9305-442f07280888","resolution":{"observed_at":"2026-08-11T04:53:34.716849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:35.530677Z","title":"Proceedings of the 41st International Conference on Machine Learning , articleno =","venue":null,"work_id":"26ecb17c-8a96-4763-a4ec-ff4d0fbf7532","year":2024},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.720856Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:44078840adb52408ec25f7ee04fefc8253f420a32f0e6e0636d1fe4d7f5977a4","observation_id":"45cc8358-989e-465c-8a65-18b8ff389b0e","resolution":{"observed_at":"2026-08-11T04:53:35.536578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.725606Z","title":"L ong F orm: Effective Instruction Tuning with Reverse Instructions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.725606Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:7e0602ba0e701025716c7103e483a986b86dafda8754ad74be034a1807d55472","observation_id":"d08066e7-d24a-48e8-9fc2-6359bad027eb","resolution":{"observed_at":"2026-08-11T04:53:34.725606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.729674Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.729674Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:a554f948692290fd7673190d7a834d24961f0c427b3c37c8568ca5c485681baf","observation_id":"6ad8f900-5d02-432e-9b80-7444663ae768","resolution":{"observed_at":"2026-08-11T04:53:34.729674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.733337Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.733337Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:645dee9ab10b068cc69464153d32f7f6413f974f53a50e88bcc0aa96ed536c50","observation_id":"5893e21f-659c-4723-bf68-41c1b0fd4956","resolution":{"observed_at":"2026-08-11T04:53:34.733337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.760930Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.760930Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:31eff81ec0fe1899216a135b5b172335968076c29b4d0cf0e0eb7559b9a81161","observation_id":"b94f3e2d-1731-4ddc-bf4e-bd589338e70f","resolution":{"observed_at":"2026-08-11T04:53:34.760930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:35.490714Z","title":"2025 , eprint=","venue":null,"work_id":"6cbf6965-4412-4704-bcba-1648dbe5f62c","year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.832601Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:b2174dcc3be9178e7c0186419acb5ed9e3b9897ad4a2399e023c09c43c3f8978","observation_id":"af3a00d3-d708-4ee4-96fa-812d2ae9012d","resolution":{"observed_at":"2026-08-11T04:53:35.500875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:34.949172Z","title":"Forty-second International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:34.949172Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:fde1dc86876e942c75fbac1ee30a248d545f90220dd9048f12927bc61433f3e2","observation_id":"ea7ba01c-2fc0-4c2c-aa36-381832dd66be","resolution":{"observed_at":"2026-08-11T04:53:34.949172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:35.022703Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:35.022703Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:fb628517a533b180bd6b8516082fe8a6e483302d3f34d6cbc10df2639066a561","observation_id":"b61e29f6-c5e5-4e68-ade6-05c6c67230be","resolution":{"observed_at":"2026-08-11T04:53:35.022703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:35.348414Z","title":"2025 , eprint=","venue":null,"work_id":"8111002f-e551-4725-94b3-f08df2daf714","year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:35.027397Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:c3c2caa2ea7c85e50d99fe764e77a9564f75f76dce776c8e8a185d1fd5601c0f","observation_id":"04c16789-8a76-4cae-9918-e84aab1cb0e2","resolution":{"observed_at":"2026-08-11T04:53:35.397241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:35.032529Z","title":"A dapt T hink: Reasoning Models Can Learn When to Think","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:35.032529Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:c2e7834b2874ff9d7effd53eaaed86b65ab48c37d9fff9179e127276f21115b6","observation_id":"ff0e7904-207f-47b3-bf86-7b8aaa9d0437","resolution":{"observed_at":"2026-08-11T04:53:35.032529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:35.055435Z","title":"The Thirty-ninth Annual Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:35.055435Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:321f4b2afb74b5c52a76d62f22801ae3c98f278c4ab6a9753c450c5481d2620e","observation_id":"3afd2e3a-fb45-425e-a7be-e84a0c82c720","resolution":{"observed_at":"2026-08-11T04:53:35.055435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-15T22:38:53.825110Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-11T04:53:35.060603Z","title":"5: Scaling reinforcement learning with llms , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:35.060603Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:01f2388d4f237526d546588c53ad27da0e4653324a5770d4b3191aeaf9fdcd80","observation_id":"32d295b1-ea16-4f35-9027-c2427002701e","resolution":{"observed_at":"2026-08-11T04:53:35.060603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:53:35.066318Z","title":"DAST : Difficulty-Adaptive Slow-Thinking for Large Reasoning Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:35.066318Z"},"links":{"citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:0cd54dd82f49ec4ff519555f880d5e8a641d9480639e7a3cf4e6b86e2206863d","observation_id":"0b7f3ece-e1f8-4f3f-858d-d0fffcdafda1","resolution":{"observed_at":"2026-08-11T04:53:35.066318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20641","last_updated":"2025-05-23T02:41:43Z","snapshot_observed_at":"2026-08-18T04:48:01.868748Z","submitted_at":"2025-03-26T15:34:37Z","title":"Unlocking Efficient Long-to-Short LLM Reasoning with Model Merging","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20641","snapshot_observed_at":"2026-08-11T04:53:35.074701Z","title":"arXiv preprint arXiv:2503.20641 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T04:53:35.074701Z"},"links":{"cited_paper":"/paper/2503.20641","citing_paper":"/paper/2608.09893"},"observation_digest":"sha256:3db95320570016ad7735c8e8388d1128f32efd5106dc0cd79156159b74cf7944","observation_id":"30600242-316a-405b-a0ac-4c6a19081cc4","resolution":{"observed_at":"2026-08-11T04:53:35.074701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09893","last_updated":"2026-08-10T17:41:19Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-21T03:09:17.633206Z","submitted_at":"2026-08-10T17:41:19Z","title":"Fusion Training for Mathematical Generalization in Large Language Models"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2608.09893."}