{"as_of":"2026-08-07T07:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8be1081a651c5be54526b80614edc865f442b252de08560a686483a994ae40e9","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:46:01.590792Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:12:10.059856Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12759","snapshot_observed_at":"2026-08-04T09:12:10.059856Z","title":"Logit arithmetic elicits long reasoning capabilities without training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.17045","last_updated":"2026-06-01T07:19:41Z","snapshot_observed_at":"2026-08-04T09:12:02.562884Z","submitted_at":"2025-10-19T23:17:13Z","title":"Video Reasoning without Training","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T09:12:10.059856Z"},"links":{"cited_paper":"/paper/2507.12759","citing_paper":"/paper/2510.17045"},"observation_digest":"sha256:d78e71c71d019153432a5c2980750e6d2d73c2a2f060ce90a2f07e0d4370716a","observation_id":"3832b309-32bc-404f-8095-26e1c51ab8a8","resolution":{"observed_at":"2026-08-04T09:12:10.059856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.12759/citation-record","integrity":"/paper/2507.12759/integrity","json":"/paper/2507.12759/citation-record.json","paper":"/paper/2507.12759"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-06T16:45:56.445386Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.445386Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:fcbf27c1726227c73fbaadc5f8f49ad6e711978ae3fc4d4ca9e40422ff96548c","observation_id":"21997aab-3d1a-4cb8-b179-e2f83a94a126","resolution":{"observed_at":"2026-08-06T16:45:56.445386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-06T16:45:56.493664Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.493664Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:aad803a2fa7cad6be4b99a79a51bfea90acf3114df4865a4c4a17a461a528f53","observation_id":"f6c26582-69dd-4d78-b5a2-713aefe9aad1","resolution":{"observed_at":"2026-08-06T16:45:56.493664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-06T16:45:56.582452Z","title":"Do NOT think that much for 2+3=? on the overthinking of o1-like llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.582452Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:bd81462dda95d8753bbbcad404c7d70006d7804aab397d6d3e90fdd8ad8b8fd9","observation_id":"12c0f1fe-df2f-42d6-a4e0-8ffaec5705d1","resolution":{"observed_at":"2026-08-06T16:45:56.582452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:04.194669Z","title":"Glass, and Pengcheng He","venue":null,"work_id":"f6c9c419-5f52-4d8e-9e65-a0255bb3b295","year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.671514Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:145aac29dd16f1678f53df88dd13c379fa7b34753a15b16061c0684c354c55c4","observation_id":"de9cfe34-37b3-43fc-ab64-454abe207e69","resolution":{"observed_at":"2026-08-06T16:46:04.279684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T16:45:56.752932Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.752932Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:df5406cea25330a59ad812379aa7204dabc66c542b3def66a1db66dd1ba360cd","observation_id":"a9939c19-8436-4e7b-b368-9e44db16b45e","resolution":{"observed_at":"2026-08-06T16:45:56.752932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:56.817307Z","title":"Reinforcement learning for reasoning in small llms: What works and what doesn't","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.817307Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:3620855ab50d19cf789d9c7e9d857677ae931e37a0d4124e1d97a37ccb3bb9dc","observation_id":"2c64b3b2-1519-44f8-8d23-cfdb3e01f7ff","resolution":{"observed_at":"2026-08-06T16:45:56.817307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T16:45:56.908594Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.908594Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:1d07fcd4eeae880b63a645469c97a6f8d9083295bd5407b49f76d7af49844899","observation_id":"683c4a71-7ef6-48e9-b07e-7feec6730d36","resolution":{"observed_at":"2026-08-06T16:45:56.908594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:04.066432Z","title":"On giant's shoulders: Effortless weak to strong by dynamic logits fusion","venue":null,"work_id":"3c30cf13-aff9-4c5d-9ea2-bccdded1f63a","year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:56.978033Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:8693a62261f2a11411d18b055bd7cd902926c18a8f34c00cc0d82a2b4f009416","observation_id":"8f246712-f3af-47f5-9297-06a5801a5a63","resolution":{"observed_at":"2026-08-06T16:46:04.110157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.964222Z","title":"On giant's shoulders: Effortless weak to strong by dynamic logits fusion","venue":null,"work_id":"d32de0ec-d2b3-4fa9-8b7e-113ff0944cba","year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.091755Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:68ae02dbc428ec8df57488fa25afd2b576e16e0fded06170a85f8476c95a5af6","observation_id":"72107da5-6899-40ae-b762-4edcbbd86c67","resolution":{"observed_at":"2026-08-06T16:46:04.001284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01307","last_updated":"2025-08-15T15:21:46Z","snapshot_observed_at":"2026-07-06T20:45:32.493589Z","submitted_at":"2025-03-03T08:46:22Z","title":"Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01307","snapshot_observed_at":"2026-08-06T16:45:57.160987Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.160987Z"},"links":{"cited_paper":"/paper/2503.01307","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:8b6bfa8c39c0ab5d1017ed4993dc10d0c88c222aef0e5848797f242706e7b946","observation_id":"70215125-4178-4489-98dd-6b7077763c63","resolution":{"observed_at":"2026-08-06T16:45:57.160987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:57.244757Z","title":"Measuring mathematical problem solving with the MATH dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.244757Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:51d11f680a94a4105dc2d2a92beed7b3d671e606b118b68eef805517b74fcfcd","observation_id":"9b39ac8c-3f01-4e6e-a3fb-269e31ca2629","resolution":{"observed_at":"2026-08-06T16:45:57.244757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06457","last_updated":"2024-08-14T02:41:48Z","snapshot_observed_at":"2026-07-06T17:28:02.037844Z","submitted_at":"2024-02-09T15:02:56Z","title":"V-STaR: Training Verifiers for Self-Taught Reasoners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06457","snapshot_observed_at":"2026-08-06T16:45:57.308861Z","title":"Courville, Alessandro Sordoni, and Rishabh Agarwal","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.308861Z"},"links":{"cited_paper":"/paper/2402.06457","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:6cf327627bf158a7c18b5e0bee579d456b7846ad554cb123debeb4eaf25eb23e","observation_id":"f2f772cb-6146-4cc0-9396-c32185c08b19","resolution":{"observed_at":"2026-08-06T16:45:57.308861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:57.397518Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen - Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.397518Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:532f879729ad03b6bd74d0d5ca0311e0d4ec50fa23806eabf093038b35ceec0e","observation_id":"02eb302f-a275-47bb-a55e-eeeb33530590","resolution":{"observed_at":"2026-08-06T16:45:57.397518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.801123Z","title":"Huang, Wenxuan Zhou, Fei Wang, Fred Morstatter, Sheng Zhang, Hoifung Poon, and Muhao Chen","venue":null,"work_id":"bf1e088c-08a4-41f2-842b-1a22d6727468","year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.492658Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:a1fbc957238a26c89104d8a00e3ab76c517e53bcca3b1f12a7900e12acc8bff7","observation_id":"0573bae5-1f12-4cf5-bfb5-eb62573307aa","resolution":{"observed_at":"2026-08-06T16:46:03.887735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.1022","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:02.165694Z","title":"GRACE: discriminator-guided chain-of-thought reasoning","venue":null,"work_id":"7aef63c3-3c4d-4676-a552-6f6b80b06837","year":2023},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.588142Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:5bf9de210a99586a08d161cee4a8ccf5deb7b066a8470dfb054630da24171603","observation_id":"6df1b769-c361-48cb-89dc-a0ddd3936064","resolution":{"observed_at":"2026-08-06T16:46:02.242062Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2504.16828","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:02.025489Z","title":"Process reward models that think","venue":null,"work_id":"3ceb0c3b-4e0c-43b8-96fc-2d45118afee7","year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.681278Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:c983ec55abbd7eb0087a124b7e4292b13f91d1917cb2b37297fd2e56564cfaf6","observation_id":"3621be0a-5760-4cd0-acf6-9e790bf65ca4","resolution":{"observed_at":"2026-08-06T16:46:02.097358Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-07-06T19:55:37.400185Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-06T16:45:57.751295Z","title":"Miranda, Alisa Liu, Nouha Dziri, Shane Lyu, Yuling Gu, Saumya Malik, Victoria Graf, Jena D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.751295Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:959cdcb941210124165e2601946e0352dca20f313dc1c4cc98ab33cbf94c1d0e","observation_id":"3cf58925-69cf-438d-894e-8ad8100b90dc","resolution":{"observed_at":"2026-08-06T16:45:57.751295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.683401Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":"9b8ec0a7-6e03-4669-a131-09bd0fc640c0","year":2023},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.833649Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:8705dbb212312aee02c51be1a34cb2d98a13a5bdec40f969caa0da43400e45b2","observation_id":"30810393-db81-491d-b1e5-367ac46a5321","resolution":{"observed_at":"2026-08-06T16:46:03.730256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07374","last_updated":"2025-02-18T05:20:33Z","snapshot_observed_at":"2026-07-06T20:34:39.536540Z","submitted_at":"2025-02-11T08:48:48Z","title":"LLMs Can Easily Learn to Reason from Demonstrations Structure, not content, is what matters!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07374","snapshot_observed_at":"2026-08-06T16:45:57.928076Z","title":"Patil, Matei Zaharia, Joseph E","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:57.928076Z"},"links":{"cited_paper":"/paper/2502.07374","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:9694f40ecfe0c464ff50fd601d905eaaaba013e981f8c9e3cc21619bb507c523","observation_id":"a2c1abac-b546-4a5d-91d8-a572085d039e","resolution":{"observed_at":"2026-08-06T16:45:57.928076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:58.052123Z","title":"Contrastive decoding: Open-ended text generation as optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.052123Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:f10dcf439df6b7a1c388d6cd78056dd6a97ce3b05f8832b5f6bea84f3e4938ff","observation_id":"9b47a880-1dc7-4fec-a121-dbaa9425df30","resolution":{"observed_at":"2026-08-06T16:45:58.052123Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19324","last_updated":"2025-06-26T03:14:46Z","snapshot_observed_at":"2026-07-06T20:29:07.258163Z","submitted_at":"2025-01-31T17:19:57Z","title":"Reward-Guided Speculative Decoding for Efficient LLM Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19324","snapshot_observed_at":"2026-08-06T16:45:58.173827Z","title":"Reward-guided speculative decoding for efficient LLM reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.173827Z"},"links":{"cited_paper":"/paper/2501.19324","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:827a1b79a82fa26f0868bfe9822fb3695644368ba7cad17b0daa4d6be9ec238b","observation_id":"c7e65240-89f6-420b-8825-cc760c589dcf","resolution":{"observed_at":"2026-08-06T16:45:58.173827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:58.268945Z","title":"Let's verify step by step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.268945Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:7cceaddfd47c2f7fad24b3ae35f9f4bb2e2700c22b9ff880234d90f74dd81426","observation_id":"b3105c22-e2b1-4ff2-92fc-b78830b46e74","resolution":{"observed_at":"2026-08-06T16:45:58.268945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:58.360990Z","title":"Smith, and Yejin Choi","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.360990Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:ea19dd8d8c5a72a5957e92931383d37e7c492cb7fb5fc9357628a5202b61dc8a","observation_id":"f5267fe8-49f1-4b47-b047-d02ad14612b3","resolution":{"observed_at":"2026-08-06T16:45:58.360990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08565","last_updated":"2024-08-23T05:21:44Z","snapshot_observed_at":"2026-07-06T17:16:17.240820Z","submitted_at":"2024-01-16T18:49:55Z","title":"Tuning Language Models by Proxy","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08565","snapshot_observed_at":"2026-08-06T16:45:58.459933Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.459933Z"},"links":{"cited_paper":"/paper/2401.08565","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:54db9d2d1466de4ba93f25e4b3ca947f1e9c669c8f6d3a762b6f59b57dda648b","observation_id":"48185574-370d-49dd-8c9f-6ea8dab5867c","resolution":{"observed_at":"2026-08-06T16:45:58.459933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-06T16:45:58.575606Z","title":"Understanding r1-zero-like training: A critical perspective","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.575606Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:eceb4fcf586d134e50a94bb252142e2eee90a2933249ffcf8918097bb173e5bb","observation_id":"d1c89f52-4375-4116-8259-c195484abd60","resolution":{"observed_at":"2026-08-06T16:45:58.575606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.560709Z","title":"Tang, Manan Roongta, Colin Cai, Jeffrey Luo, Li Erran Li, Raluca Ada Popa, and Ion Stoica","venue":null,"work_id":"3f4e0835-5c5f-45d3-ac61-da01cbfc704b","year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.670703Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:b2470fddb06f68b07d09c33e993dea8f8a3289c2501b41eb8851bb2f2d350b8c","observation_id":"de81d482-37a6-48e5-a4fc-1cd76d878270","resolution":{"observed_at":"2026-08-06T16:46:03.615685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.455942Z","title":null,"venue":null,"work_id":"48ba967c-1c97-4482-bdfe-3f92789a43b9","year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.747530Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:1c403ef311a0bae1d4ab7726503fc3cc28f1568a0de8645495250c3865ebbd04","observation_id":"6cfea145-9d9b-4e0e-807a-7a4f0c3969ac","resolution":{"observed_at":"2026-08-06T16:46:03.498018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-06T16:45:58.836736Z","title":"Cand \\` e s, and Tatsunori Hashimoto","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.836736Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:d0d3bd8e273703c83144aa7872291b1917cc561823ba0fa2db716ef1fc005e6c","observation_id":"4e47f8da-12a8-42af-b74d-bf6a60355d36","resolution":{"observed_at":"2026-08-06T16:45:58.836736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.342437Z","title":"Learning to reason with LLMs , September 2024","venue":null,"work_id":"04d3df09-5a1f-4d2a-a04e-5f713b2c198d","year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.904810Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:3927acf0fad5c913cbc50983b5d89f9255c2d69a644b92839a6959f29fae2d79","observation_id":"08f789f8-0a12-4fc8-b284-41784ef7ce7c","resolution":{"observed_at":"2026-08-06T16:46:03.388308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.200710Z","title":"OpenAI o3 and o4-mini System Card","venue":null,"work_id":"1cc7efab-57b0-4c8c-b5e4-5adc3bc645fb","year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.004718Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:ead2f42c2217756f8b0c854238f217064fda45daf615efc5cbb306f427a7c6e2","observation_id":"a6b54b39-9210-4384-ac66-08f1b3aa6d00","resolution":{"observed_at":"2026-08-06T16:46:03.272016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.180","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:01.773350Z","title":"Comblm: Adapting black-box language models through small fine-tuned models","venue":null,"work_id":"45d5fca0-4f60-491d-a60d-96fa13c0208c","year":2023},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.088869Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:dd3d0f38ad76a735049e0498c0718d411a1f5d00358b7c15716ec13b7f6aa725","observation_id":"4c76ae28-7628-4c96-a283-74aff655653e","resolution":{"observed_at":"2026-08-06T16:46:01.825336Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:03.071364Z","title":"Qwen3: Think Deeper, Act Faster | Qwen , April 2025","venue":null,"work_id":"817cbc06-4994-4acf-b4fa-d6dd984814d4","year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.154950Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:d94ae1d72bbcaab49c16d93ab78d46c6e38ec857fafa5c9ab24baa98017df6da","observation_id":"840be525-fc0a-4339-8be2-f5cfaa0a7ec1","resolution":{"observed_at":"2026-08-06T16:46:03.125136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:59.275958Z","title":"Manning, Stefano Ermon, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.275958Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:6cf104e302d31da9070218b94ee0cf30f6b2cef69f036fc8da28ef04a6972e07","observation_id":"310ce96a-aba3-4598-a222-1e967718ed69","resolution":{"observed_at":"2026-08-06T16:45:59.275958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T16:45:59.339469Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.339469Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:1c25f0a7c859ab7f30126448f5ebe25285927c243d2e245c3ce7df514c93da3c","observation_id":"3b16074f-bd1c-418b-9eb6-a96d2e40d9a3","resolution":{"observed_at":"2026-08-06T16:45:59.339469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:59.448540Z","title":"Trusting your evidence: Hallucinate less with context-aware decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.448540Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:f97cb12d8bf94853a0d847bd222364b622732591133aac850d1e7e143860de53","observation_id":"f117e112-6122-43f6-a1cb-58c24846e449","resolution":{"observed_at":"2026-08-06T16:45:59.448540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-06T16:45:59.557416Z","title":"Scaling LLM test-time compute optimally can be more effective than scaling model parameters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.557416Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:56412c1f7e7cf410cb8a6b2fb4bfe3adc825e131a17ddeb92d5e7648434e4cbf","observation_id":"86ee16f0-2eb0-4833-9c2c-61f33e7445a3","resolution":{"observed_at":"2026-08-06T16:45:59.557416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11314","last_updated":"2025-06-11T03:55:09Z","snapshot_observed_at":"2026-08-06T22:44:08.693516Z","submitted_at":"2025-03-14T11:30:37Z","title":"Unlocking General Long Chain-of-Thought Reasoning Capabilities of Large Language Models via Representation Engineering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11314","snapshot_observed_at":"2026-08-06T16:45:59.645017Z","title":"Unlocking general long chain-of-thought reasoning capabilities of large language models via representation engineering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.645017Z"},"links":{"cited_paper":"/paper/2503.11314","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:62d2de3919e24286124cab5c8988a5fd7783680ff99ea2e270cf39ed3783b803","observation_id":"52fc4979-7cf7-4065-99ee-5faba847a214","resolution":{"observed_at":"2026-08-06T16:45:59.645017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:59.731670Z","title":"Qwq-32b: Embracing the power of reinforcement learning, March 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.731670Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:5d86cc4d5cd6bce06a8d83f26b7b910cb7cba45f4e70d1bb6b9d9a69bffbd3db","observation_id":"dab5bc7a-86df-4001-a0f0-1f33cda3ed40","resolution":{"observed_at":"2026-08-06T16:45:59.731670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:59.800747Z","title":"Gram: A generative foundation reward model for reward generalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.800747Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:975b9dbc0bd209af505df68ebbcb4b4556765e7b8eff71232bf1e06f2eaad821","observation_id":"7a204399-44e7-4aee-bac5-befa0570377e","resolution":{"observed_at":"2026-08-06T16:45:59.800747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:59.879033Z","title":"Math-shepherd: Verify and reinforce llms step-by-step without human annotations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.879033Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:33950a184d8f10adbfa27fded14ea4b6053844af32160abda2519559c72e5408","observation_id":"4d807b13-d1dd-4180-8de4-03d264afaa1a","resolution":{"observed_at":"2026-08-06T16:45:59.879033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:02.923031Z","title":"Chain-of-thought reasoning without prompting","venue":null,"work_id":"8bd3262b-c6ff-4466-8906-c9a54ff3b29c","year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.973845Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:ea5ace159012f0fcaa8cd3aa5c18256074da81da35c8c4fc36ea4edeaaccebb5","observation_id":"0a44f2d9-2071-4928-8e47-1f899fa880d6","resolution":{"observed_at":"2026-08-06T16:46:02.991227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:02.800659Z","title":"Le, Ed H","venue":null,"work_id":"f9d19dfa-2fde-4491-8fd1-bb73b36a0624","year":2023},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.066822Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:ee110895e031ddd0b1dd316ec68e5141c60f05b1613eff6e03f63ee008d1b197","observation_id":"5feaae47-f273-4fef-a58b-f96b94a4dbb5","resolution":{"observed_at":"2026-08-06T16:46:02.845097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20571","last_updated":"2025-10-24T10:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-29T09:24:30Z","title":"Reinforcement Learning for Reasoning in Large Language Models with One Training Example","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20571","snapshot_observed_at":"2026-08-06T16:46:00.145099Z","title":"Reinforcement learning for reasoning in large language models with one training example","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.145099Z"},"links":{"cited_paper":"/paper/2504.20571","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:c25c48699612a9cabb79efad36b9c3ea66b84db078abd790d7fb0a5d4b83df28","observation_id":"2516df83-9dad-4a49-b11f-032b8b455817","resolution":{"observed_at":"2026-08-06T16:46:00.145099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:00.198876Z","title":"Chi, Quoc V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.198876Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:1ef2176ae9817d04bfc4beb6d5c430dde749350da1eb861e0c41baf19e2d6060","observation_id":"2528988e-4912-4c24-8b27-f7042a856eb2","resolution":{"observed_at":"2026-08-06T16:46:00.198876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:02.670871Z","title":"Self-evaluation guided beam search for reasoning","venue":null,"work_id":"d0a7edcf-1ce3-4ece-8f9e-85beb18228d1","year":2023},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.278181Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:01062ae84f27ef09b36e97b24f775f57029fefe9c52e6977b5c043bb30f83921","observation_id":"7e621c17-b2d2-44fd-866a-9e7f7dd2ef07","resolution":{"observed_at":"2026-08-06T16:46:02.724881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11284","last_updated":"2025-01-20T05:44:01Z","snapshot_observed_at":"2026-08-06T13:30:45.600197Z","submitted_at":"2025-01-20T05:44:01Z","title":"RedStar: Does Scaling Long-CoT Data Unlock Better Slow-Reasoning Systems?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11284","snapshot_observed_at":"2026-08-06T16:46:00.345444Z","title":"Redstar: Does scaling long-cot data unlock better slow-reasoning systems? CoRR, abs/2501.11284, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.345444Z"},"links":{"cited_paper":"/paper/2501.11284","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:867d0e52ba777d7a794e72e36694f14be4d86dd0452fb536adf1248750017587","observation_id":"b8cd5682-e691-4445-a0c9-5039ab6d027c","resolution":{"observed_at":"2026-08-06T16:46:00.345444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T16:46:00.453742Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.453742Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:c1e16bca87e8771d4bdd1014d61b3b7624ddcc2bc5c1478eb1c1f3ec97e13ff3","observation_id":"1a7c90e7-3566-4dcf-b080-56aefd0a6be4","resolution":{"observed_at":"2026-08-06T16:46:00.453742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-06T16:46:00.536206Z","title":"Qwen2.5-math technical report: Toward mathematical expert model via self-improvement","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.536206Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:bda0c2ff449911400916d78a77945ba05104bbb420a8386690f82dfe4b0a5165","observation_id":"5f69db3d-332f-4eee-8f94-050a76d6dc61","resolution":{"observed_at":"2026-08-06T16:46:00.536206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12329","last_updated":"2026-06-02T22:05:11Z","snapshot_observed_at":"2026-07-06T21:10:31.989050Z","submitted_at":"2025-04-12T21:25:32Z","title":"Speculative Thinking: Enhancing Small-Model Reasoning with Large Model Guidance at Inference Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12329","snapshot_observed_at":"2026-08-06T16:46:00.618572Z","title":"Speculative thinking: Enhancing small-model reasoning with large model guidance at inference time","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.618572Z"},"links":{"cited_paper":"/paper/2504.12329","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:bc88c1793a5f904ba5342e6b41bbd32eb009d161c379d5a54d8a96de547bbdf7","observation_id":"7d94f4e8-e7dc-4d79-a4e4-9fb7ed4b21c4","resolution":{"observed_at":"2026-08-06T16:46:00.618572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-06T16:46:00.686246Z","title":"LIMO: less is more for reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.686246Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:8debfb5ec1025b1fb322729a61a09a32c8c9a5884cdbb7fe03213a151269c8b1","observation_id":"1d121914-4e0e-4a78-b5b5-dce25e4aa682","resolution":{"observed_at":"2026-08-06T16:46:00.686246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-06T16:46:00.730849Z","title":"DAPO: an open-source LLM reinforcement learning system at scale","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.730849Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:3d3f70c91aae8a2c543dd1ea1c9725766a382a7aa8c770448460837abd010982","observation_id":"b8b882c6-825e-46c9-b0d5-87a17175121c","resolution":{"observed_at":"2026-08-06T16:46:00.730849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13837","last_updated":"2025-11-24T06:11:04Z","snapshot_observed_at":"2026-07-06T21:11:34.701779Z","submitted_at":"2025-04-18T17:59:56Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13837","snapshot_observed_at":"2026-08-06T16:46:00.822409Z","title":"Does reinforcement learning really incentivize reasoning capacity in llms beyond the base model? arXiv preprint arXiv:2504.13837, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.822409Z"},"links":{"cited_paper":"/paper/2504.13837","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:b6bff8c0ee17b3eb313864f9017a8d4a6c23f347553755a71cfb5a152653e665","observation_id":"dc8ecd4c-f1e4-4f32-823c-db3c9e3cf9c6","resolution":{"observed_at":"2026-08-06T16:46:00.822409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13837","last_updated":"2025-11-24T06:11:04Z","snapshot_observed_at":"2026-07-06T21:11:34.701779Z","submitted_at":"2025-04-18T17:59:56Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13837","snapshot_observed_at":"2026-08-06T16:46:00.912514Z","title":"Does reinforcement learning really incentivize reasoning capacity in llms beyond the base model? CoRR, abs/2504.13837, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.912514Z"},"links":{"cited_paper":"/paper/2504.13837","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:22877d95d0f0f945e80647b5ccf6156f23090123e0110238d11cdb1ab5685954","observation_id":"4b1d8fbd-71c1-478d-9eeb-d4041f9c5445","resolution":{"observed_at":"2026-08-06T16:46:00.912514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:02.550753Z","title":"Generative verifiers: Reward modeling as next-token prediction","venue":null,"work_id":"b16dc597-ed04-4ca8-90aa-d2b51e9aac08","year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.984525Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:bec65ba0645ea606a54f9aa6aab97cdfaa603cdfd6e8718f9105a4416ec1f85a","observation_id":"4f63ac81-53f5-45a3-b5dd-0df1df80a4c0","resolution":{"observed_at":"2026-08-06T16:46:02.603535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:01.063828Z","title":"Small language models need strong verifiers to self-correct reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.063828Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:c571f46789857adcf49afebbade0529ecbe787802ae6cb103303541bdcf077fc","observation_id":"db22c645-3a9d-4449-ae2f-e80f46d7454a","resolution":{"observed_at":"2026-08-06T16:46:01.063828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17256","last_updated":"2025-07-23T18:43:18Z","snapshot_observed_at":"2026-07-06T17:22:41.286422Z","submitted_at":"2024-01-30T18:48:37Z","title":"Weak-to-Strong Jailbreaking on Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17256","snapshot_observed_at":"2026-08-06T16:46:01.155732Z","title":"Weak-to-strong jailbreaking on large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.155732Z"},"links":{"cited_paper":"/paper/2401.17256","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:9e42b3caabe8ecc2f5d533018ff4e63360c18b018b020a10dc3205531ae73084","observation_id":"2687ee65-1b68-46c1-91c9-905b049d5d40","resolution":{"observed_at":"2026-08-06T16:46:01.155732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-07-31T01:46:18.583556Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17697","snapshot_observed_at":"2026-08-06T16:46:01.206824Z","title":"Activation control for efficiently eliciting long chain-of-thought ability of language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.206824Z"},"links":{"cited_paper":"/paper/2505.17697","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:c04705ea7f483984a3c9095253ee88219f0165bfd4bae795ca2a1a4c892b4947","observation_id":"35d16542-ddcf-4da5-ab10-74fa647dbe5e","resolution":{"observed_at":"2026-08-06T16:46:01.206824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-06T16:46:01.298001Z","title":"Byun, Zifan Wang, Alex Mallen, Steven Basart, Sanmi Koyejo, Dawn Song, Matt Fredrikson, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.298001Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:9842c8484fc937bcc2077dcbdf9d868d81569db5975a991f7084196aa4e2e3ac","observation_id":"8a7f6206-36ff-4e1b-905e-4c83ef8e8ff2","resolution":{"observed_at":"2026-08-06T16:46:01.298001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:01.378453Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.378453Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:e55036426f980a8391a8d133e2ff6e6baf606ce6c3c6b0ccf42f8cc814b6d376","observation_id":"a1851c04-4c34-4986-ba23-3b96d3de57a1","resolution":{"observed_at":"2026-08-06T16:46:01.378453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:01.466254Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.466254Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:027fe31d7006b7a5b4f88e5351fb87154d9a5a0c50eda01e155966b895d1dd49","observation_id":"dde975b2-07f5-4502-ab2f-bc6bc3920c34","resolution":{"observed_at":"2026-08-06T16:46:01.466254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:01.530230Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.530230Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:7c4d9ffdcdc0d6e8965f58582d783373ababf8649cdedc60a4af7f584ba6582f","observation_id":"ae5ffced-7fb6-493b-ab02-3f51676a415a","resolution":{"observed_at":"2026-08-06T16:46:01.530230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:01.590792Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.590792Z"},"links":{"citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:72192d1a1362525a3cab84a25ed38adc64e0d5359ee2bc98d18c98037fbe3d54","observation_id":"c720fe2c-13ba-4858-bcc3-25f0e614f163","resolution":{"observed_at":"2026-08-06T16:46:01.590792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T16:36:45.067293Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":3,"verified_fuzzy":13},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 1 inbound Pith citation observation for arXiv:2507.12759."}