{"as_of":"2026-08-10T20:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c9ad38d1881954e86c39dd9d072b3438d10dfe73508a7a8398a8b45c85703005","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T11:02:21.219099Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T14:26:28.554936Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"cited_work":{"arxiv_id":"2510.07364","doi":"10.48550/arxiv.2510.07364","metadata_source":"arxiv_reference","pith_arxiv_id":"2510.07364","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Base models know how to reason, thinking models learn when.arXiv preprint arXiv:2510.07364","venue":"Oxford University Research Archive (ORA) (University of Oxford)","work_id":"6b8f6f1f-0a24-48c7-af58-4a4206730999","year":2025},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2510.07364","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:3b8158feef6d1c82657fe3f9a8dab04eb7779b1011590cb3fed47350bcda5e68","observation_id":"7f4f41c3-ab0d-4596-85b5-9238bc1bff32","resolution":{"observed_at":"2026-07-08T02:18:39.926237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"cited_work":{"arxiv_id":"2510.07364","doi":"10.48550/arxiv.2510.07364","metadata_source":"arxiv_reference","pith_arxiv_id":"2510.07364","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Base models know how to reason, thinking models learn when.arXiv preprint arXiv:2510.07364","venue":"Oxford University Research Archive (ORA) (University of Oxford)","work_id":"6b8f6f1f-0a24-48c7-af58-4a4206730999","year":2025},"citing_paper":{"arxiv_id":"2604.06377","last_updated":"2026-05-05T18:37:43Z","snapshot_observed_at":"2026-07-06T22:54:53.308309Z","submitted_at":"2026-04-07T19:02:10Z","title":"The Master Key Hypothesis: Unlocking Cross-Model Capability Transfer via Linear Subspace Alignment","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-10T18:36:44.401045Z"},"links":{"cited_paper":"/paper/2510.07364","citing_paper":"/paper/2604.06377"},"observation_digest":"sha256:fe1141ffb2e0a5e5b9bb34e9ee18116af8ba4bbcacf1232afa173acca9565a91","observation_id":"d399df76-cd22-4049-ba18-1968a0de06f6","resolution":{"observed_at":"2026-07-08T02:18:39.926237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"cited_work":{"arxiv_id":"2510.07364","doi":"10.48550/arxiv.2510.07364","metadata_source":"arxiv_reference","pith_arxiv_id":"2510.07364","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Base models know how to reason, thinking models learn when.arXiv preprint arXiv:2510.07364","venue":"Oxford University Research Archive (ORA) (University of Oxford)","work_id":"6b8f6f1f-0a24-48c7-af58-4a4206730999","year":2025},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2510.07364","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:541d6e4357f61a9ae96bb5089056466d749fd54e9bbc127181625c5b3ed69cfd","observation_id":"7cc2956a-a5c8-4a4d-821c-3d138f211e59","resolution":{"observed_at":"2026-07-08T02:18:39.926237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"cited_work":{"arxiv_id":"2510.07364","doi":"10.48550/arxiv.2510.07364","metadata_source":"arxiv_reference","pith_arxiv_id":"2510.07364","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Base models know how to reason, thinking models learn when.arXiv preprint arXiv:2510.07364","venue":"Oxford University Research Archive (ORA) (University of Oxford)","work_id":"6b8f6f1f-0a24-48c7-af58-4a4206730999","year":2025},"citing_paper":{"arxiv_id":"2605.16874","last_updated":"2026-05-16T08:33:31Z","snapshot_observed_at":"2026-08-01T16:12:13.947960Z","submitted_at":"2026-05-16T08:33:31Z","title":"Reasoning Can Be Restored by Correcting a Few Decision Tokens","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T20:56:48.771058Z"},"links":{"cited_paper":"/paper/2510.07364","citing_paper":"/paper/2605.16874"},"observation_digest":"sha256:d13a2ff8f18a207d8eb9109722e1325dfdb327d9f4032ccb84f8bceb276b3f12","observation_id":"e5dec56b-668c-4708-ba7f-fdc9ff2eb852","resolution":{"observed_at":"2026-07-08T02:18:39.926237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"cited_work":{"arxiv_id":"2510.07364","doi":"10.48550/arxiv.2510.07364","metadata_source":"arxiv_reference","pith_arxiv_id":"2510.07364","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Base models know how to reason, thinking models learn when.arXiv preprint arXiv:2510.07364","venue":"Oxford University Research Archive (ORA) (University of Oxford)","work_id":"6b8f6f1f-0a24-48c7-af58-4a4206730999","year":2025},"citing_paper":{"arxiv_id":"2605.17187","last_updated":"2026-05-16T22:52:11Z","snapshot_observed_at":"2026-07-06T23:28:12.114488Z","submitted_at":"2026-05-16T22:52:11Z","title":"PluRule: A Benchmark for Moderating Pluralistic Communities on Social Media","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-20T14:05:14.737146Z"},"links":{"cited_paper":"/paper/2510.07364","citing_paper":"/paper/2605.17187"},"observation_digest":"sha256:fa0399cbb22865df762b133a9329514626445851ed261082b3abb43e525136b0","observation_id":"195ba5f1-433b-4b2c-97d2-0637bb9b16d4","resolution":{"observed_at":"2026-07-08T02:18:39.926237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"cited_work":{"arxiv_id":"2510.07364","doi":"10.48550/arxiv.2510.07364","metadata_source":"arxiv_reference","pith_arxiv_id":"2510.07364","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Base models know how to reason, thinking models learn when.arXiv preprint arXiv:2510.07364","venue":"Oxford University Research Archive (ORA) (University of Oxford)","work_id":"6b8f6f1f-0a24-48c7-af58-4a4206730999","year":2025},"citing_paper":{"arxiv_id":"2606.18284","last_updated":"2026-06-10T02:04:29Z","snapshot_observed_at":"2026-07-06T23:53:45.117607Z","submitted_at":"2026-06-10T02:04:29Z","title":"Breaking the Solver Bottleneck: Training Task Generators at the Learnable Frontier","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-06-27T10:36:09.211639Z"},"links":{"cited_paper":"/paper/2510.07364","citing_paper":"/paper/2606.18284"},"observation_digest":"sha256:ce7ba2d978bb4dc89160ba60157a5037da98a0b732f50878541334c18ac4057b","observation_id":"bd81b3c2-5a95-4d83-b2b7-812af7fc19db","resolution":{"observed_at":"2026-07-08T02:18:39.926237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:06.757576+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.07364","snapshot_observed_at":"2026-08-02T06:37:43.179908Z","title":"arXiv preprint arXiv:2510.07364 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12447","last_updated":"2026-07-24T07:10:23Z","snapshot_observed_at":"2026-08-04T12:28:32.750580Z","submitted_at":"2026-07-14T07:24:32Z","title":"The Computational Basis of Confidence in Large Language Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-02T06:37:43.179908Z"},"links":{"cited_paper":"/paper/2510.07364","citing_paper":"/paper/2607.12447"},"observation_digest":"sha256:371652c386507400f2500e7e4307c1247f990febb4a731ce8a802f988cb3dfde","observation_id":"60b3868d-6486-4b1e-904b-f17458cb1d46","resolution":{"observed_at":"2026-08-02T06:37:43.179908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.07364","snapshot_observed_at":"2026-08-01T15:16:20.782109Z","title":"Base models know how to reason, thinking models learn when, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18532","last_updated":"2026-07-20T21:56:22Z","snapshot_observed_at":"2026-08-08T01:52:33.147531Z","submitted_at":"2026-07-20T21:56:22Z","title":"Reasoning Fine-Tuning Induces Persistent Latent Policy States","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-01T15:16:20.782109Z"},"links":{"cited_paper":"/paper/2510.07364","citing_paper":"/paper/2607.18532"},"observation_digest":"sha256:1fae3b7314c2b81dc9aa9b7c46418b6d46a4e31a164e57e6a7b950a70fee10c5","observation_id":"de19a86b-b3f8-46dc-a0c7-27e2c4d16e13","resolution":{"observed_at":"2026-08-01T15:16:20.782109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.07364","snapshot_observed_at":"2026-08-03T14:26:28.554936Z","title":"Base Models Know How to Reason , Thinking Models Learn When , October 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29062","last_updated":"2026-07-31T06:30:45Z","snapshot_observed_at":"2026-08-07T20:37:39.222608Z","submitted_at":"2026-07-31T06:30:45Z","title":"On the Generalization of Steering Vectors for Chain-of-Thought Faithfulness","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-03T14:26:28.554936Z"},"links":{"cited_paper":"/paper/2510.07364","citing_paper":"/paper/2607.29062"},"observation_digest":"sha256:f8d6f5054805b6092e4de1fbe1154fb263b0215078277ce95a2741ae9e58c2a0","observation_id":"4ae320cc-2bde-4fb9-a198-efb44e562140","resolution":{"observed_at":"2026-08-03T14:26:28.554936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2510.07364/citation-record","integrity":"/paper/2510.07364/integrity","json":"/paper/2510.07364/citation-record.json","paper":"/paper/2510.07364"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.14491","last_updated":"2023-10-23T01:47:29Z","snapshot_observed_at":"2026-08-03T08:20:20.915196Z","submitted_at":"2023-10-23T01:47:29Z","title":"Towards a Mechanistic Interpretation of Multi-Step Reasoning Capabilities of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14491","snapshot_observed_at":"2026-08-04T11:02:19.268527Z","title":"Dan Hendrycks, Collin Burns, Saurav Kadavath, Akul Arora, Steven Basart, Eric Tang, Dawn Song, and Jacob Steinhardt","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:19.268527Z"},"links":{"cited_paper":"/paper/2310.14491","citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:92a33fe526f103db45f7118a7c89d373f0bbd76770d0d5b83273d1c2aad8dcac","observation_id":"740541c3-6c6f-4e83-ad26-c07c5f4babe8","resolution":{"observed_at":"2026-08-04T11:02:19.268527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13752","last_updated":"2025-06-16T17:57:05Z","snapshot_observed_at":"2026-08-09T05:35:21.916120Z","submitted_at":"2025-06-16T17:57:05Z","title":"Steering LLM Thinking with Budget Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13752","snapshot_observed_at":"2026-08-04T11:02:19.357455Z","title":"Alireza Makhzani and Brendan Frey","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:19.357455Z"},"links":{"cited_paper":"/paper/2506.13752","citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:8fe7f968aec53f7f87af9552e8cc4c56e46325d57a727c993a2e21a6c5f1025d","observation_id":"4b16991c-8e69-4564-a6ee-1b923cd49c90","resolution":{"observed_at":"2026-08-04T11:02:19.357455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20571","last_updated":"2025-10-24T10:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-29T09:24:30Z","title":"Reinforcement Learning for Reasoning in Large Language Models with One Training Example","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20571","snapshot_observed_at":"2026-08-04T11:02:19.585843Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:19.585843Z"},"links":{"cited_paper":"/paper/2504.20571","citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:6134c55cbe21ccab81fc8a749c168f915c29bea2c1dda2852608b981faad1712","observation_id":"8483788b-ad20-4095-8610-8555719921a9","resolution":{"observed_at":"2026-08-04T11:02:19.585843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13837","last_updated":"2025-11-24T06:11:04Z","snapshot_observed_at":"2026-07-06T21:11:34.701779Z","submitted_at":"2025-04-18T17:59:56Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13837","snapshot_observed_at":"2026-08-04T11:02:19.719607Z","title":"What *job* is this sentence doing in the reasoning trace?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:19.719607Z"},"links":{"cited_paper":"/paper/2504.13837","citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:3050cbb90042184d97acaca42b442b4d0519b694151256961fe46d3cd2b99b5a","observation_id":"3cdc1875-7972-423b-ba5e-f9fc350bd443","resolution":{"observed_at":"2026-08-04T11:02:19.719607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:02:20.383585Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":111,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:20.383585Z"},"links":{"citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:b37ce36e02e69d14a76a1b83277f9d8f23dcbbbbe0a07ae358ed7f265957f3bb","observation_id":"c610c644-e136-40fc-b87b-153153e56535","resolution":{"observed_at":"2026-08-04T11:02:20.383585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:02:20.527927Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":122,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:20.527927Z"},"links":{"citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:1d77a395d612c3bdbc9b66ef30ad4bfd264d46d5b5bf2149daed56bd2f0c11a9","observation_id":"c907159b-5518-490f-a3a8-7b66e1c0dbae","resolution":{"observed_at":"2026-08-04T11:02:20.527927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:02:20.676937Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":133,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:20.676937Z"},"links":{"citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:cdc31a1e5f6cafa3e5d271f4ad9ca70e187d8a3328933056bed8ad48dce7c5dd","observation_id":"45a1c8ae-b196-4733-9a62-c6871c804c89","resolution":{"observed_at":"2026-08-04T11:02:20.676937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:02:20.804697Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":144,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:20.804697Z"},"links":{"citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:218d84c4baf17449df9e0354bec570f828fd2f54683b7da4813037160ca44072","observation_id":"a865c254-b6b8-4f42-af67-95fb4f3a1c66","resolution":{"observed_at":"2026-08-04T11:02:20.804697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:02:19.825468Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":151,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:19.825468Z"},"links":{"citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:1879010e952ba7bf594a9863b8d76858283bf855fed2bd5dab4f09ee834d288b","observation_id":"59f0f5b2-4211-4e2a-a551-20694957dd2e","resolution":{"observed_at":"2026-08-04T11:02:19.825468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:02:20.880981Z","title":"explanation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":155,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:20.880981Z"},"links":{"citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:72c997fb1c44d560ecf9a0f4392fe977f76b6991a4f454185afb8b15120d0419","observation_id":"8ddbc7f0-e077-4915-b6cc-a9b5a5cb935d","resolution":{"observed_at":"2026-08-04T11:02:20.880981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:02:19.927054Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":162,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:19.927054Z"},"links":{"citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:5b6d1b4ed13eb7fabe777d93282862537e05e36714dca633f311595de3a1349b","observation_id":"1413c08e-ca2f-4f32-81f4-e3a4bf459540","resolution":{"observed_at":"2026-08-04T11:02:19.927054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:02:20.074744Z","title":"Importantly, a sentence might not match a description word-for-word, but it might serve the same underlying purpose","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":173,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:20.074744Z"},"links":{"citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:fd4c3e1a022312ccd0dc96674934f6f1937ffabf24eb61b5e416af5ddc4e7049","observation_id":"d418a04d-2625-4b29-9e31-2936943c08b7","resolution":{"observed_at":"2026-08-04T11:02:20.074744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:02:20.180318Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":184,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:20.180318Z"},"links":{"citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:38204cb3a8d09cca19bfaad28684dd26988950ef2a83af5b845f1ebb1d2cdc80","observation_id":"ca2aed2f-2aed-45ff-9351-272d20b1c2f9","resolution":{"observed_at":"2026-08-04T11:02:20.180318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:02:20.288862Z","title":"Yes\" or","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":195,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:20.288862Z"},"links":{"citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:ea00066fedfc8e6ef73f5433140d446ca4ceb4935e3bf0c50a6b17ba1838435d","observation_id":"64a4e6e5-8ee8-4913-859a-f8e9d8bacd22","resolution":{"observed_at":"2026-08-04T11:02:20.288862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:02:20.975228Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":201,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:20.975228Z"},"links":{"citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:1bf2f32646c084c3b9f555111a57448049ce6c0dcd5211a23e9ed358d98977fb","observation_id":"f09e280a-1237-4c93-8a1a-b110da2bedff","resolution":{"observed_at":"2026-08-04T11:02:20.975228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:02:21.098857Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":212,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:21.098857Z"},"links":{"citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:8a0b572010a97a2f65bca77fbdfdae73f8c9475aa1fe634c85d891b6f2765d32","observation_id":"9775ccb9-7201-417a-b30e-716ccdf127a8","resolution":{"observed_at":"2026-08-04T11:02:21.098857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:02:21.219099Z","title":"explanation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":223,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:21.219099Z"},"links":{"citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:755a136a0ed15fb03302d0e7082f4e79e594c74b2bc5e10e81636ddcde12f14e","observation_id":"22b60e12-fb16-41de-9170-0a4ca70b1b77","resolution":{"observed_at":"2026-08-04T11:02:21.219099Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-04T11:02:19.521799Z","title":"13 Under review as a conference paper at ICLR 2026 Constantin Venhoff, Iván Arcuschin, Philip Torr, Arthur Conmy, and Neel Nanda","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:19.521799Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:efa1536367ea16fcc3486313a9e268acc1a9447386894323db030676d5618f89","observation_id":"01843e60-9200-40e1-90ec-e7c20e8951c7","resolution":{"observed_at":"2026-08-04T11:02:19.521799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18862","last_updated":"2025-08-12T23:58:47Z","snapshot_observed_at":"2026-08-10T10:18:15.982918Z","submitted_at":"2025-02-26T06:13:01Z","title":"One-shot Optimized Steering Vectors Mediate Safety-relevant Behaviors in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18862","snapshot_observed_at":"2026-08-04T11:02:19.184818Z","title":"Josh Engels","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T11:02:19.184818Z"},"links":{"cited_paper":"/paper/2502.18862","citing_paper":"/paper/2510.07364"},"observation_digest":"sha256:c82c82eaee5b9da00d75e2ff6eaade2fe3650b752ab0790ab000412e37a82baf","observation_id":"9bb47991-4e45-42aa-8edf-9142bc1ecd67","resolution":{"observed_at":"2026-08-04T11:02:19.184818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.07364","last_updated":"2026-07-07T14:19:58Z","latest_version":4,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-04T11:02:17.680858Z","submitted_at":"2025-10-08T17:58:28Z","title":"Base Models Know How to Reason, Thinking Models Learn When"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 9 inbound Pith citation observations for arXiv:2510.07364."}