{"as_of":"2026-08-16T18:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d4ec3f68040a1900a96e3dae922238b9fad0ef40241974bb01dbc729615e34a5","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:19:11.606064Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.10182/citation-record","integrity":"/paper/2505.10182/integrity","json":"/paper/2505.10182/citation-record.json","paper":"/paper/2505.10182"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-15T21:19:11.410604Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.410604Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:bbc7a4239f97ca755af0215edcb49adb6aedcf940da13580d26ff318b26c0a30","observation_id":"10935a2c-d8b7-430b-a008-5edbf15726fb","resolution":{"observed_at":"2026-08-15T21:19:11.410604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T21:19:11.416696Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.416696Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:e0b63af788d11478e58a4a83d9a6739375d5afe07aea3a21bcd52b8de5f9246f","observation_id":"acc68ba5-366c-49b2-b73d-6287cbcc7701","resolution":{"observed_at":"2026-08-15T21:19:11.416696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:12.291682Z","title":"Aime, February 2024","venue":null,"work_id":"e7407c83-35b3-4ad0-8997-8e27b9619cd3","year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.422492Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:7437a5597f55fb487971874f674af13c142781e5b5a41721452c0d147430a07e","observation_id":"bd2dbeb3-e572-494f-8fb7-a312f26a32ab","resolution":{"observed_at":"2026-08-15T21:19:12.296180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-16T07:06:07.822225Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-15T21:19:11.428367Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.428367Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:042f3a0535c4a6b7d591caf2732aa64ae6d73bf17425b54371d8245f8181ac13","observation_id":"1f87ae0c-bc24-4968-92de-088dedb01013","resolution":{"observed_at":"2026-08-15T21:19:11.428367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-08-14T11:38:51.383664Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-15T21:19:11.434569Z","title":"Cand \\` e s, and Tatsunori Hashimoto","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.434569Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:d824d30a0245ce37ac7b0faa1b9be3554a5264f07b45d4c13b42d8a1f295c188","observation_id":"dc5ec225-280e-4a51-b52a-356d3af8af6e","resolution":{"observed_at":"2026-08-15T21:19:11.434569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-15T21:19:11.440751Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.440751Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:0772b8033fc714916219c478a25de094b6741f10d8ae36da2ca899abe39a2626","observation_id":"9578c198-18fb-4377-b5d1-59258b3a66c5","resolution":{"observed_at":"2026-08-15T21:19:11.440751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:12.276660Z","title":"Openwebmath: An open dataset of high-quality mathematical web text","venue":null,"work_id":"433ee0e8-ac43-49c0-a93e-75ec3e3d335d","year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.447022Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:23f158496453ef7cebf16d9ecd69f12256f5fafe89f63f73af90499c21ea01b9","observation_id":"660c3e1f-2ddd-466f-909b-c386d3d1f956","resolution":{"observed_at":"2026-08-15T21:19:12.281867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-15T21:19:11.452909Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.452909Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:d460be866f8ebabf2c6008d60a0d7703a90945311ae18724619360b6f14f6c04","observation_id":"550d1d9b-df95-4b4e-a4fd-e6576a352641","resolution":{"observed_at":"2026-08-15T21:19:11.452909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:11.458743Z","title":"Reasoning to learn from latent thoughts","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.458743Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:f540b6eb1c13ef76aaa2422fc76584cf0ae4001aaf7233fdff9554c5f4d89d63","observation_id":"d709fb50-d897-4e9d-a236-3701e5e567ae","resolution":{"observed_at":"2026-08-15T21:19:11.458743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:12.262089Z","title":"Gemini 2.5: Our most intelligent ai model, March 2025","venue":null,"work_id":"ba19ffee-e7d4-4072-9c5b-c72ca38c7ef9","year":2025},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.463844Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:bd0c5d2a739535ee4de6f839c7d99b9bf7a57fe7ee9fb3c936a8965cfbcbb3fd","observation_id":"57a129c0-6cf9-432e-a53b-600507421aee","resolution":{"observed_at":"2026-08-15T21:19:12.266849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:11.469033Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen - Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.469033Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:dc23dcd4f0cb69ba606fcad3a6b1e2c4f698dc9fb9e7c18200c5de519880a9c5","observation_id":"04ed7a77-aa28-4a07-881e-16d59dbfad03","resolution":{"observed_at":"2026-08-15T21:19:11.469033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:11.474949Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.474949Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:a8ec929fc6e1edf3ba5c67c947019558a8e2b4ab549a0de2bc03ea29c126914c","observation_id":"3fbe24fd-43fa-4606-846f-2527260adec6","resolution":{"observed_at":"2026-08-15T21:19:11.474949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:11.480520Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.480520Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:cf3f6b40f1f2096fb74e4033a4da3f53465a510a0f10bf1fbbf3f444306a7c7f","observation_id":"77fc7e87-93c2-4f4a-bac7-1bfede272d7e","resolution":{"observed_at":"2026-08-15T21:19:11.480520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-11T13:10:23.709172Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-15T21:19:11.486677Z","title":"Stop overthinking: A survey on efficient reasoning for large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.486677Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:b9bdbb3d944ddb2f8b3f5a2b72125b223da526445260e22c9713ec6201008785","observation_id":"81d7a7f2-650f-4dbf-92b1-44a82584f7f7","resolution":{"observed_at":"2026-08-15T21:19:11.486677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-15T21:19:11.491911Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.491911Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:dbc9cccea16bb4e402c459f26ac60a7a88b0a757f278735a652a82a063081b3a","observation_id":"bbf07aed-0d64-4444-8cdf-b401d97a86fc","resolution":{"observed_at":"2026-08-15T21:19:11.491911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T21:19:11.497074Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.497074Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:a1176f895ca0db7cb47b3a3eb1bb8db5184d347228a41f445629596dbd7695dc","observation_id":"ca4dc4ef-4fa9-4bbc-80d2-c85a969d4c5a","resolution":{"observed_at":"2026-08-15T21:19:11.497074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13837","last_updated":"2025-11-24T06:11:04Z","snapshot_observed_at":"2026-08-14T14:03:15.178702Z","submitted_at":"2025-04-18T17:59:56Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13837","snapshot_observed_at":"2026-08-15T21:19:11.502454Z","title":"Does reinforcement learning really incentivize reasoning capacity in llms beyond the base model?, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.502454Z"},"links":{"cited_paper":"/paper/2504.13837","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:2211047e805341f5df419fa859ac04940eddb52bc4a4341083f66cd74ed4ad83","observation_id":"c1f83a44-f7f0-4fbd-8491-feaa3eb82968","resolution":{"observed_at":"2026-08-15T21:19:11.502454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-10T16:05:13.426341Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-15T21:19:11.507629Z","title":"T \" ulu 3: Pushing frontiers in open language model post-training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.507629Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:bbe21c30872f59a8e7ec53ba58b90193f574a9c6f24573ba609f87343b29351b","observation_id":"b65333f7-e15f-4063-a65d-c67fbcec0e07","resolution":{"observed_at":"2026-08-15T21:19:11.507629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19595","last_updated":"2025-08-17T21:21:08Z","snapshot_observed_at":"2026-08-16T12:47:00.491873Z","submitted_at":"2025-03-25T12:21:26Z","title":"Optimizing Language Models for Inference Time Objectives using Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19595","snapshot_observed_at":"2026-08-15T21:19:11.512505Z","title":"Optimizing language models for inference time objectives using reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.512505Z"},"links":{"cited_paper":"/paper/2503.19595","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:8be9c9f13cee0f222542c1416468926176d854041924d2a345ab7adeb5af59fb","observation_id":"e8bfabb7-6399-4b70-bf12-6879d01ef5dc","resolution":{"observed_at":"2026-08-15T21:19:11.512505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:11.519182Z","title":"Le, Ed H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.519182Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:576121a0bf78033ca3dcb4a4ac1f81cd09eb6e38ff6bd8d3cc32998db2b7a919","observation_id":"cb9c93bd-9054-481c-a540-25336f6abc1a","resolution":{"observed_at":"2026-08-15T21:19:11.519182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-08-14T10:00:52.343929Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-15T21:19:11.523971Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.523971Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:c67ba71ab4991998e808a134047bd20855b50f184a40d63297dcc5a2afea2cb3","observation_id":"a52351be-85b8-4af4-a86d-1257b5f78018","resolution":{"observed_at":"2026-08-15T21:19:11.523971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:11.529227Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.529227Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:0a28acc21ad92418746e94080df829b3339477317fd75488ccece8e69bab543b","observation_id":"22da0afe-aeca-4a94-a9b2-2585ab5bb26b","resolution":{"observed_at":"2026-08-15T21:19:11.529227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:11.533971Z","title":"Reflexion: language agents with verbal reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.533971Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:bb35ef83127934111866240757e482682a7dfbe6a06c028f519ce0239db6c934","observation_id":"6e1002fe-0b2d-432c-b59b-fa5056047efa","resolution":{"observed_at":"2026-08-15T21:19:11.533971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:12.191882Z","title":"Teaching large language models to self-debug","venue":null,"work_id":"d7a985b4-bfe6-42bf-91bc-e716380a2dfd","year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.538739Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:35e9b58cb374091cba63018cce3dd8648767e9e60f83b8b7feff3c77a338cc38","observation_id":"c0f1f884-ce5c-4c95-a944-61b2c418c69c","resolution":{"observed_at":"2026-08-15T21:19:12.197895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:12.175263Z","title":"Tree of thoughts: Deliberate problem solving with large language models","venue":null,"work_id":"7dc6ea20-8e9e-4534-bad9-bba21519fc16","year":2023},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.543299Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:f8d69ce9322cd568e6277850d2d0b51211809bbf49c2c85de079e2d46b9b38ed","observation_id":"38161081-f239-48aa-9d05-d36faf6491e7","resolution":{"observed_at":"2026-08-15T21:19:12.180488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06195","last_updated":"2024-08-12T14:42:13Z","snapshot_observed_at":"2026-08-16T13:26:59.693155Z","submitted_at":"2024-08-12T14:42:13Z","title":"Mutual Reasoning Makes Smaller LLMs Stronger Problem-Solvers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06195","snapshot_observed_at":"2026-08-15T21:19:11.548905Z","title":"Mutual reasoning makes smaller llms stronger problem-solvers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.548905Z"},"links":{"cited_paper":"/paper/2408.06195","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:9d8dcd00501371945a1894657a40aa73d6655187f473297d3e1a9353a3ce5ddd","observation_id":"ec9364ca-766b-46b8-b0f4-f1f4135196c9","resolution":{"observed_at":"2026-08-15T21:19:11.548905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:12.159212Z","title":null,"venue":null,"work_id":"feddcd07-77f0-4001-a33a-c0010e0276a0","year":2022},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.554899Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:60beb3c06461098374181c3e614f1058483583a84e0ae1cbd5fd9ba0d6f3c02c","observation_id":"d1fffe49-1e3e-4eba-bac4-7575d412aaae","resolution":{"observed_at":"2026-08-15T21:19:12.164558Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00812","last_updated":"2024-01-08T16:22:42Z","snapshot_observed_at":"2026-08-16T14:30:28.206858Z","submitted_at":"2024-01-01T16:51:20Z","title":"If LLM Is the Wizard, Then Code Is the Wand: A Survey on How Code Empowers Large Language Models to Serve as Intelligent Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00812","snapshot_observed_at":"2026-08-15T21:19:11.560898Z","title":"If llm is the wizard, then code is the wand: A survey on how code empowers large language models to serve as intelligent agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.560898Z"},"links":{"cited_paper":"/paper/2401.00812","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:30b33982ec097909b0253204310bd1a9bf04f0bdbf8b7e3196ead6c83ec4f7dd","observation_id":"1bee59f1-e5df-4a0f-8ae0-ddfa45bd44a5","resolution":{"observed_at":"2026-08-15T21:19:11.560898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10914","last_updated":"2024-08-20T14:58:13Z","snapshot_observed_at":"2026-08-16T13:25:10.790461Z","submitted_at":"2024-08-20T14:58:13Z","title":"To Code, or Not To Code? Exploring Impact of Code in Pre-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10914","snapshot_observed_at":"2026-08-15T21:19:11.565842Z","title":"Locatelli, Marzieh Fadaee, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.565842Z"},"links":{"cited_paper":"/paper/2408.10914","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:2276c9ffa08d46077d38539df5388c3b04ec5422d639df06a3bda45f019c5efe","observation_id":"ae71f412-ec7a-4448-8b74-119cf80e816c","resolution":{"observed_at":"2026-08-15T21:19:11.565842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04556","last_updated":"2025-02-25T17:31:36Z","snapshot_observed_at":"2026-08-16T13:20:39.792531Z","submitted_at":"2024-09-06T18:33:38Z","title":"How Does Code Pretraining Affect Language Model Task Performance?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04556","snapshot_observed_at":"2026-08-15T21:19:11.570810Z","title":"How does code pretraining affect language model task performance? ArXiv, abs/2409.04556, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.570810Z"},"links":{"cited_paper":"/paper/2409.04556","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:c8f2e17995a39f128471880078f751ea65f35954aa8864c650d727563825d2c3","observation_id":"3683302c-82a6-4084-b460-6c3e6781b608","resolution":{"observed_at":"2026-08-15T21:19:11.570810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21068","last_updated":"2024-05-31T17:56:33Z","snapshot_observed_at":"2026-08-16T13:47:19.365342Z","submitted_at":"2024-05-31T17:56:33Z","title":"Code Pretraining Improves Entity Tracking Abilities of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21068","snapshot_observed_at":"2026-08-15T21:19:11.576093Z","title":"Code pretraining improves entity tracking abilities of language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.576093Z"},"links":{"cited_paper":"/paper/2405.21068","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:b8c2a73ffd3824c39fc6b777386957840d2cbb2eafb028365c17723674663679","observation_id":"fbefbe97-23e9-49be-ab8d-c833b318209d","resolution":{"observed_at":"2026-08-15T21:19:11.576093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:12.143910Z","title":null,"venue":null,"work_id":"7249decd-f2b6-4fe4-906f-36d4930a1b5b","year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.581152Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:f4d864113bd96a529f903ce25b26c16fbdd4bca41b2134dd1240c013534c3e8a","observation_id":"d826bc08-d91e-479b-a6b7-b75cae84e445","resolution":{"observed_at":"2026-08-15T21:19:12.148624Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:12.128935Z","title":"Lexpam: Legal procedure awareness-guided mathematical reasoning","venue":null,"work_id":"7435fee2-51cc-4e4a-9961-c2012435e98c","year":2025},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.585727Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:f1c8ca960158a7a3afde53af39f72384161104807725a727e2b57305962cafdb","observation_id":"0a58e86e-7d0b-47b8-8cfc-4fe83a69b774","resolution":{"observed_at":"2026-08-15T21:19:12.133674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09629","last_updated":"2024-03-18T07:56:48Z","snapshot_observed_at":"2026-08-14T11:24:43.688110Z","submitted_at":"2024-03-14T17:58:16Z","title":"Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09629","snapshot_observed_at":"2026-08-15T21:19:11.590629Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.590629Z"},"links":{"cited_paper":"/paper/2403.09629","citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:90b23ebd0c006b81f68252a1cb9119030a96df7679788eaefd39df23eae205de","observation_id":"dfc13669-de20-484b-98f1-96764ec2fd00","resolution":{"observed_at":"2026-08-15T21:19:11.590629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:11.595792Z","title":"Explain yourself! leveraging language models for commonsense reasoning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.595792Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:a363e6f42ce656299fe191637691b620343256ac4016a1dcbf0d05e748a2824e","observation_id":"08057371-22ad-46e2-95fa-b7fb9928f5fa","resolution":{"observed_at":"2026-08-15T21:19:11.595792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.408","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:11.637207Z","title":"Reinstruct: Building instruction data from unlabeled corpus","venue":null,"work_id":"411c55e9-5f8d-474f-8c00-3b319df2a00d","year":2024},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.601337Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:2fc3ea4b7f67c14a568c70297357ba8d0ffbe773ca983ab935da5c0f111770fc","observation_id":"16c7d3b1-e8a8-440d-9d23-0ebbeb235ea9","resolution":{"observed_at":"2026-08-15T21:19:11.643936Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:19:12.114084Z","title":"Learning to reason and memorize with self-notes","venue":null,"work_id":"99a721be-c953-49a7-a3c3-041d65db7b00","year":2023},"citing_paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T21:19:11.606064Z"},"links":{"citing_paper":"/paper/2505.10182"},"observation_digest":"sha256:0762630c9bfba0e511dc19686a4b3834403295a8dad3f64ecfb6c8df09dd8018","observation_id":"5ac925d0-dcc3-4944-b8a6-fe5a411ea794","resolution":{"observed_at":"2026-08-15T21:19:12.119282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.10182","last_updated":"2025-05-15T11:29:01Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T21:12:28.591239Z","submitted_at":"2025-05-15T11:29:01Z","title":"Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":1,"verified_fuzzy":7},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2505.10182."}