{"as_of":"2026-08-08T05:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf709362b7694d045abccbd357db288e51edcd240d5028d09115e138f81313ce","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:46:19.068265Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:46:01.206824Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17697","snapshot_observed_at":"2026-08-06T16:46:01.206824Z","title":"Activation control for efficiently eliciting long chain-of-thought ability of language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12759","last_updated":"2025-07-17T03:31:36Z","snapshot_observed_at":"2026-08-07T21:57:01.893066Z","submitted_at":"2025-07-17T03:31:36Z","title":"Logit Arithmetic Elicits Long Reasoning Capabilities Without Training","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.206824Z"},"links":{"cited_paper":"/paper/2505.17697","citing_paper":"/paper/2507.12759"},"observation_digest":"sha256:041075e8024b85c086018ad72ef23b4d28b0dadd807952036b56a5d2ce9a5d98","observation_id":"35d16542-ddcf-4da5-ab10-74fa647dbe5e","resolution":{"observed_at":"2026-08-06T16:46:01.206824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"cited_work":{"arxiv_id":"2505.17697","doi":"10.48550/arxiv.2505.17697","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17697","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"monitorability tax","venue":"arXiv (Cornell University)","work_id":"683453e9-f4be-4884-989f-2065a7ed32d4","year":2025},"citing_paper":{"arxiv_id":"2604.19149","last_updated":"2026-04-21T06:55:17Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T06:55:17Z","title":"How Do Answer Tokens Read Reasoning Traces? Self-Reading Patterns in Thinking LLMs for Quantitative Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-10T02:40:28.718556Z"},"links":{"cited_paper":"/paper/2505.17697","citing_paper":"/paper/2604.19149"},"observation_digest":"sha256:ab9d60d9e2c2eac1df717ebe4bd2c62d317dfa913070ec1cc5fb6ac1819b2d8b","observation_id":"4c83d2c6-46e2-487f-8a52-dcfd307ef04f","resolution":{"observed_at":"2026-05-10T02:43:24.271450Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"cited_work":{"arxiv_id":"2505.17697","doi":"10.48550/arxiv.2505.17697","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17697","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"monitorability tax","venue":"arXiv (Cornell University)","work_id":"683453e9-f4be-4884-989f-2065a7ed32d4","year":2025},"citing_paper":{"arxiv_id":"2605.07021","last_updated":"2026-05-20T02:19:39Z","snapshot_observed_at":"2026-08-02T16:20:14.264105Z","submitted_at":"2026-05-07T23:05:50Z","title":"Behavior Cue Reasoning: Monitorable Reasoning Improves Efficiency and Safety through Oversight","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-11T00:54:25.549158Z"},"links":{"cited_paper":"/paper/2505.17697","citing_paper":"/paper/2605.07021"},"observation_digest":"sha256:ad61850c4d3b6e6b7f006eb3b3ff2e6073e72ed4b8437e40c18c2471e92f8877","observation_id":"cc8530d0-91bb-4a13-94f0-af3e59b18185","resolution":{"observed_at":"2026-05-11T05:00:56.558182Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"cited_work":{"arxiv_id":"2505.17697","doi":"10.48550/arxiv.2505.17697","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17697","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"monitorability tax","venue":"arXiv (Cornell University)","work_id":"683453e9-f4be-4884-989f-2065a7ed32d4","year":2025},"citing_paper":{"arxiv_id":"2605.07021","last_updated":"2026-05-20T02:19:39Z","snapshot_observed_at":"2026-08-02T16:20:14.264105Z","submitted_at":"2026-05-07T23:05:50Z","title":"Behavior Cue Reasoning: Monitorable Reasoning Improves Efficiency and Safety through Oversight","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-21T08:29:09.122055Z"},"links":{"cited_paper":"/paper/2505.17697","citing_paper":"/paper/2605.07021"},"observation_digest":"sha256:3815e65f4151e17db3cffdcf5db4e792443425a6e59203f74938b294d604e807","observation_id":"34b3be45-69f3-4bf4-85d5-579ae8baf3e0","resolution":{"observed_at":"2026-05-21T08:29:52.710579Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"cited_work":{"arxiv_id":"2505.17697","doi":"10.48550/arxiv.2505.17697","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17697","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"monitorability tax","venue":"arXiv (Cornell University)","work_id":"683453e9-f4be-4884-989f-2065a7ed32d4","year":2025},"citing_paper":{"arxiv_id":"2606.06188","last_updated":"2026-06-04T13:59:07Z","snapshot_observed_at":"2026-07-06T23:46:05.829177Z","submitted_at":"2026-06-04T13:59:07Z","title":"The Tell-Tale Norm: $\\ell_2$ Magnitude as a Signal for Reasoning Dynamics in Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-28T02:07:49.501480Z"},"links":{"cited_paper":"/paper/2505.17697","citing_paper":"/paper/2606.06188"},"observation_digest":"sha256:cdc20b475be2134f9b3ddbdf22967e56232689d96b977289d580ff456b984e03","observation_id":"cd84f755-6010-41a1-bfe5-ef48de2732e7","resolution":{"observed_at":"2026-07-02T12:26:56.898852Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"cited_work":{"arxiv_id":"2505.17697","doi":"10.48550/arxiv.2505.17697","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17697","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"monitorability tax","venue":"arXiv (Cornell University)","work_id":"683453e9-f4be-4884-989f-2065a7ed32d4","year":2025},"citing_paper":{"arxiv_id":"2606.18089","last_updated":"2026-07-05T17:40:26Z","snapshot_observed_at":"2026-07-12T13:34:39.011240Z","submitted_at":"2026-06-16T15:55:28Z","title":"From Reasoning Traces to Reusable Modules: Understanding Compositional Generalization in Language Model Reasoning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-06-27T01:13:11.483599Z"},"links":{"cited_paper":"/paper/2505.17697","citing_paper":"/paper/2606.18089"},"observation_digest":"sha256:e113ff4bea8091d06b16bf46ec8dce3899469989236c3f6403f15b3359f90a28","observation_id":"daf9a472-aa0c-4a06-87e8-08ac9422204f","resolution":{"observed_at":"2026-07-03T20:38:55.955665Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17697/citation-record","integrity":"/paper/2505.17697/integrity","json":"/paper/2505.17697/citation-record.json","paper":"/paper/2505.17697"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:46:13.105366Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:13.105366Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:1459139e716867b46e8f5ed0404038eb2a4e9d004d7b9cf9b8fcde1dd4c7f64f","observation_id":"36d688b8-fbc4-4866-b1d6-b43e0f961024","resolution":{"observed_at":"2026-08-07T14:46:13.105366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:21.633493Z","title":"Qwq: Reflect deeply on the boundaries of the unknown","venue":null,"work_id":"dcbcbf11-d50b-45bf-ab8c-5ca8ac50a94d","year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:13.207712Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:fbf88d99c49208c52e23c70153d95ded103bf50c2aefff87b11e11cdbd68ba32","observation_id":"701cc41c-f125-4704-a7bc-2d5fd15515eb","resolution":{"observed_at":"2026-08-07T14:46:21.711879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T14:46:13.321636Z","title":"Openai o1 system card.arXiv preprint arXiv:2412.16720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:13.321636Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:113dd5beca769b1800a8122620ba9d40e3ba5720832d0d5847031f0203b5e159","observation_id":"d9a3552a-6555-442a-8abc-c1ed9e71a78c","resolution":{"observed_at":"2026-08-07T14:46:13.321636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T14:46:13.429068Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:13.429068Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:7e8f8a4ee8548bfecf244c684babb9e0ed0e72f9b5b2ecee6b5e16bc1478d6f5","observation_id":"f9f00f70-0be5-4c96-a0a4-5e869a232ef2","resolution":{"observed_at":"2026-08-07T14:46:13.429068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:13.517449Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:13.517449Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:3150beed081876cadc262dca64f77e99100532455b94769aa591bcc2e7df635c","observation_id":"cf57bf20-1cae-4bb9-bec5-79632e29f28a","resolution":{"observed_at":"2026-08-07T14:46:13.517449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11284","last_updated":"2025-01-20T05:44:01Z","snapshot_observed_at":"2026-08-06T13:30:45.600197Z","submitted_at":"2025-01-20T05:44:01Z","title":"RedStar: Does Scaling Long-CoT Data Unlock Better Slow-Reasoning Systems?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11284","snapshot_observed_at":"2026-08-07T14:46:13.583355Z","title":"Redstar: Does scaling long-cot data unlock better slow-reasoning systems?arXiv preprint arXiv:2501.11284, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:13.583355Z"},"links":{"cited_paper":"/paper/2501.11284","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:a552398d072da2b40706fb32513f158fa504ba6d29e885beaffe10c84b29670f","observation_id":"e35523a1-55af-462e-9760-58367039a88f","resolution":{"observed_at":"2026-08-07T14:46:13.583355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03373","last_updated":"2025-02-05T17:13:32Z","snapshot_observed_at":"2026-07-06T20:31:41.231839Z","submitted_at":"2025-02-05T17:13:32Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03373","snapshot_observed_at":"2026-08-07T14:46:13.708971Z","title":"Demystifying long chain-of-thought reasoning in llms.arXiv preprint arXiv:2502.03373, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:13.708971Z"},"links":{"cited_paper":"/paper/2502.03373","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:3ef0ac50e57b504dae455caa64a914a460e0183176553d800eb1de101b2cc87a","observation_id":"d59b155b-ab1b-4502-8b9e-7c452f59feca","resolution":{"observed_at":"2026-08-07T14:46:13.708971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06023","last_updated":"2024-07-24T18:40:36Z","snapshot_observed_at":"2026-07-31T10:52:02.949801Z","submitted_at":"2024-07-08T15:17:46Z","title":"Distilling System 2 into System 1","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06023","snapshot_observed_at":"2026-08-07T14:46:13.808759Z","title":"Distilling system 2 into system 1.arXiv preprint arXiv:2407.06023, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:13.808759Z"},"links":{"cited_paper":"/paper/2407.06023","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:0b9247db5c555d717c0e929135cf8ba2bf4fd1e370c694f11d89b2e506b6cc18","observation_id":"d19e77e3-b165-4f9c-935d-a732ad3f57ad","resolution":{"observed_at":"2026-08-07T14:46:13.808759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08555","last_updated":"2024-04-16T00:22:16Z","snapshot_observed_at":"2026-08-01T22:10:49.555742Z","submitted_at":"2024-04-12T15:54:15Z","title":"RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08555","snapshot_observed_at":"2026-08-07T14:46:13.968664Z","title":"Rlhf deciphered: A critical analysis of reinforcement learning from human feedback for llms.arXiv preprint arXiv:2404.08555, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:13.968664Z"},"links":{"cited_paper":"/paper/2404.08555","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:5359afd49718807d7fe16175cc0ef74d8908ed5042c03fe64b930bb77ee59cb5","observation_id":"6778c7a6-ea67-44ee-9d54-63587336a030","resolution":{"observed_at":"2026-08-07T14:46:13.968664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05302","last_updated":"2023-10-07T07:01:26Z","snapshot_observed_at":"2026-08-04T23:38:14.844517Z","submitted_at":"2023-04-11T15:53:40Z","title":"RRHF: Rank Responses to Align Language Models with Human Feedback without tears","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05302","snapshot_observed_at":"2026-08-07T14:46:14.038195Z","title":"Rrhf: Rank responses to align language models with human feedback without tears.arXiv preprint arXiv:2304.05302, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:14.038195Z"},"links":{"cited_paper":"/paper/2304.05302","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:3ed9b4f59a664f863f6b43660e08b5a272d93aa87d12e273bfc87ac5c3d3b314","observation_id":"2caefea0-b55d-452a-8080-eaa84af2ac0d","resolution":{"observed_at":"2026-08-07T14:46:14.038195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03057","last_updated":"2022-10-06T17:03:34Z","snapshot_observed_at":"2026-07-06T14:00:37.875054Z","submitted_at":"2022-10-06T17:03:34Z","title":"Language Models are Multilingual Chain-of-Thought Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03057","snapshot_observed_at":"2026-08-07T14:46:14.171691Z","title":"Language models are multilingual chain-of-thought reasoners.arXiv preprint arXiv:2210.03057, 2022","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:14.171691Z"},"links":{"cited_paper":"/paper/2210.03057","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:cfdb90c2fff673fd50809ccbafa506a2817f790f786f913758a306452c865314","observation_id":"2e98105a-f30d-421a-848d-ea70f25e3e97","resolution":{"observed_at":"2026-08-07T14:46:14.171691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:14.291241Z","title":"Activation addition: Steering language models without optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:14.291241Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:c612cd251ad658a3cef2ef2b823e5144c3c7ad542c6aff9af25e399c2d2ba1af","observation_id":"b8f2f4c1-817e-4334-be8b-6206c7404489","resolution":{"observed_at":"2026-08-07T14:46:14.291241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14680","last_updated":"2022-10-12T18:01:23Z","snapshot_observed_at":"2026-08-03T05:22:23.916601Z","submitted_at":"2022-03-28T12:26:00Z","title":"Transformer Feed-Forward Layers Build Predictions by Promoting Concepts in the Vocabulary Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14680","snapshot_observed_at":"2026-08-07T14:46:14.386599Z","title":"Transformer feed-forward layers build predictions by promoting concepts in the vocabulary space.arXiv preprint arXiv:2203.14680, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:14.386599Z"},"links":{"cited_paper":"/paper/2203.14680","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:0e8548ce5fa0589bc8f1012e6d80dbb740977713ce60d6ee57c836815b4239b5","observation_id":"2781fba5-15c9-4c84-a301-30e30491663f","resolution":{"observed_at":"2026-08-07T14:46:14.386599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:14.491489Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:14.491489Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:55c6f574eb20a4b3e3a0e4a3032df733edfa1229026dc210c68abdcdf50c4f51","observation_id":"76685b9a-5938-436a-b38b-df1d8f68c71b","resolution":{"observed_at":"2026-08-07T14:46:14.491489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:14.670460Z","title":"Qwen2.5: A party of foundation models, September 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:14.670460Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:3812c0a807ea40eb172b2dd77671720c33f2985b62b0fc2ce0b7953e3ca74e56","observation_id":"238c0110-8952-468a-81f8-8b1d5f942611","resolution":{"observed_at":"2026-08-07T14:46:14.670460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19206","last_updated":"2025-03-28T02:10:05Z","snapshot_observed_at":"2026-08-07T16:39:47.680195Z","submitted_at":"2025-03-24T23:11:56Z","title":"Overtrained Language Models Are Harder to Fine-Tune","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19206","snapshot_observed_at":"2026-08-07T14:46:14.770089Z","title":"Overtrained language models are harder to fine-tune.arXiv preprint arXiv:2503.19206, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:14.770089Z"},"links":{"cited_paper":"/paper/2503.19206","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:46f7cca5c72c3e5f953f3ceaaaa4d7ea78300fc7951ff05a9ab5a1b144e5fefc","observation_id":"6e5e0c71-5c6d-4352-acfc-10689d82e566","resolution":{"observed_at":"2026-08-07T14:46:14.770089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:14.870601Z","title":"Gpqa: A graduate-level google-proof q&a benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:14.870601Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:40b09fd62a77d0fc1a848f75d85b144ff611ca42f9adfcf9fba2d180bd8e7921","observation_id":"45c2478c-69d3-497f-aa5a-a2f9123d7010","resolution":{"observed_at":"2026-08-07T14:46:14.870601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07374","last_updated":"2025-02-18T05:20:33Z","snapshot_observed_at":"2026-08-07T21:53:35.875689Z","submitted_at":"2025-02-11T08:48:48Z","title":"LLMs Can Easily Learn to Reason from Demonstrations Structure, not content, is what matters!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07374","snapshot_observed_at":"2026-08-07T14:46:14.997716Z","title":"Llms can easily learn to reason from demonstrations structure, not content, is what matters!arXiv preprint arXiv:2502.07374, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:14.997716Z"},"links":{"cited_paper":"/paper/2502.07374","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:98b5227c8fb9fe7b04915f4d7df2511798c8a41489088b98a828c918ec75ac05","observation_id":"fd34cbf1-6d0f-44d7-ada5-35e0c1095c0b","resolution":{"observed_at":"2026-08-07T14:46:14.997716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-07T14:46:15.092652Z","title":"Limo: Less is more for reasoning.arXiv preprint arXiv:2502.03387, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:15.092652Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:17521439ef77d3b419f588bf69cef0145de8e8aa33c019cbdfc81d029a021fb5","observation_id":"1ab3989a-e047-4c12-957f-fa7cb8dbd755","resolution":{"observed_at":"2026-08-07T14:46:15.092652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T04:13:14.044604Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T14:46:15.191974Z","title":"Evaluating large language models trained on code.arXiv preprint arXiv:2107.03374, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:15.191974Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:378fb7a860f3bcbf05e17ae75d5e9a03aee17473103a931b34009b1f24b6b16d","observation_id":"9d7efaae-f87d-4c6f-a382-ff80d6cabbca","resolution":{"observed_at":"2026-08-07T14:46:15.191974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:15.315911Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:15.315911Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:f61ad6c17b3e39d0f564aff9f644ac66dfda6af382d490fbcf7101d60f93adbf","observation_id":"f288f5b7-ea06-464d-9600-ba29aff74b18","resolution":{"observed_at":"2026-08-07T14:46:15.315911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:46:15.448809Z","title":"Gpt-4 technical report.ArXiv, abs/2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:15.448809Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:5b61c3b630e2846786084d7d090b8cae0d67012dfc0f73ea81f0334c2babba6e","observation_id":"ab6d0c12-ebd9-439e-8b5a-2901f19f96c6","resolution":{"observed_at":"2026-08-07T14:46:15.448809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:21.378304Z","title":"The claude 3 model family: Opus, sonnet, haiku","venue":null,"work_id":"5e4617d3-3e18-40a3-b935-1682067afff0","year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:15.520832Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:8805122c56cafb12dd7fc97308d8e70787301082a18cac070dd5d16028cdc1a4","observation_id":"18be4a2f-44f8-4893-a669-79215528f10b","resolution":{"observed_at":"2026-08-07T14:46:21.455235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T14:46:15.637146Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context.ArXiv, abs/2403.05530, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:15.637146Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:d034e8d882b180743e2e39dff7c6bf59e20c8bdac9f37ee3f30075a30f44295f","observation_id":"d16fd9b0-42e2-4641-8ce9-02e041e43145","resolution":{"observed_at":"2026-08-07T14:46:15.637146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T14:46:15.763798Z","title":"Qwen3 Technical Report.arXiv e-prints, page arXiv:2505.09388, May 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:15.763798Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:b6107f1d301fd737865936fdb200f353fdcfa66287fe3a7772d9b7ccc6c47aec","observation_id":"74687a73-7780-467c-b8bb-ba7342c4fe3d","resolution":{"observed_at":"2026-08-07T14:46:15.763798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:21.228306Z","title":"The claude 3 model family: Opus, sonnet, haiku","venue":null,"work_id":"2a1133c7-f5a2-455b-8ebd-a86a4a1aad7a","year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:15.844741Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:5f3e5e878fbb79b04e01423f3c98df0a04ddab8b83d5777764ff9b09869d34f4","observation_id":"7a3f8a75-d6d7-495f-847e-ebb409b358d8","resolution":{"observed_at":"2026-08-07T14:46:21.302997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:21.089743Z","title":"Gemini 2.5: Our most intelligent ai model","venue":null,"work_id":"cc8e3984-7fa2-4274-afd5-a0c276178c87","year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:15.963151Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:f479b715a5402df7cc965e148821b67ab5c9bf9436999c69054c67e9e8ba6cd9","observation_id":"a52540cb-3136-40f1-9737-d157728bb96e","resolution":{"observed_at":"2026-08-07T14:46:21.136324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:16.088948Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:16.088948Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:4737cdf44e050c78218fbd93762f4d6aed8903b548468cb983299032eda0ef58","observation_id":"d58b01ac-6ffd-40bc-99e7-ddeb6c51d6a1","resolution":{"observed_at":"2026-08-07T14:46:16.088948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:16.218380Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:16.218380Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:40812b7fc036cd72089bde4160cbd7b1fe459a90da14c98628b9b725241e6c54","observation_id":"882703b5-905e-4b4c-930c-1981a69dabf2","resolution":{"observed_at":"2026-08-07T14:46:16.218380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:20.878868Z","title":"Tree of thoughts: Deliberate problem solving with large language models.Ad- vances in neural information processing systems, 36:11809–11822, 2023","venue":null,"work_id":"deb80e79-0e29-48ba-a332-4b1ade1cb6a3","year":2023},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:16.302316Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:98edbde77e56d4fa5cb5eac7810d1e0a1a588650c887554e7575fc82f9de49e9","observation_id":"1a8d7e7c-9318-410a-aa65-476247317808","resolution":{"observed_at":"2026-08-07T14:46:20.998651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.14858","last_updated":"2022-07-01T02:15:12Z","snapshot_observed_at":"2026-08-05T15:41:22.691461Z","submitted_at":"2022-06-29T18:54:49Z","title":"Solving Quantitative Reasoning Problems with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.14858","snapshot_observed_at":"2026-08-07T14:46:16.437950Z","title":"Solving quantitative reasoning problems with language models.ArXiv, abs/2206.14858, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:16.437950Z"},"links":{"cited_paper":"/paper/2206.14858","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:bbd6ebfff2c91efcc1ed838e75e58bc3ebb987e28b47f1a2926f617f3faae2cc","observation_id":"ec49cccf-7992-40b4-a64d-5ecc9d347567","resolution":{"observed_at":"2026-08-07T14:46:16.437950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10631","last_updated":"2024-03-15T19:14:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-16T17:54:07Z","title":"Llemma: An Open Language Model For Mathematics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10631","snapshot_observed_at":"2026-08-07T14:46:16.510056Z","title":"Jiang, Jia Deng, Stella Biderman, and Sean Welleck","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:16.510056Z"},"links":{"cited_paper":"/paper/2310.10631","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:7c5c364d6529eb95ae21b592a03e9e24313774617ea65b5ed566b3e3f782d169","observation_id":"a5d9e47d-c398-45cc-954c-412e79e193a6","resolution":{"observed_at":"2026-08-07T14:46:16.510056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T14:46:16.580693Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:16.580693Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:42b0487da1fb9298cb44d60bd7b6a61dd5c1c612ab673194494fe5752ee5c27d","observation_id":"dbc6d12e-8114-4a66-9b0d-888f4d731bb3","resolution":{"observed_at":"2026-08-07T14:46:16.580693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:20.627531Z","title":"Singhal, Shekoofeh Azizi, Tao Tu, Said Mahdavi, Jason Wei, Hyung Won Chung, Nathan Scales, Ajay Kumar Tanwani, Heather J","venue":null,"work_id":"7137891e-8f12-483c-b3cc-63415d46fde7","year":2022},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:16.653546Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:15ffeb7afc1bf5bb93c7f867e006ba0cdc5a69b2dee8f3ab5d07d4d73b7ee88c","observation_id":"a95c3f4c-3b47-43b8-8326-63362f7f26a0","resolution":{"observed_at":"2026-08-07T14:46:20.777524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09085","last_updated":"2022-11-16T18:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-16T18:06:33Z","title":"Galactica: A Large Language Model for Science","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09085","snapshot_observed_at":"2026-08-07T14:46:16.779929Z","title":"Hartshorn, Elvis Saravia, Andrew Poulton, Viktor Kerkez, and Robert Stojnic","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:16.779929Z"},"links":{"cited_paper":"/paper/2211.09085","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:19e06f897db8cacab737a01861aabfbae48abfd1c5faa1e0cc33ad3b1621c1ba","observation_id":"91e36603-5648-411d-9b06-5a3191e0e7d6","resolution":{"observed_at":"2026-08-07T14:46:16.779929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10435","last_updated":"2023-01-27T15:30:27Z","snapshot_observed_at":"2026-08-07T01:22:26.004756Z","submitted_at":"2022-11-18T18:56:13Z","title":"PAL: Program-aided Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10435","snapshot_observed_at":"2026-08-07T14:46:16.840640Z","title":"Pal: Program-aided language models.arXiv preprint arXiv:2211.10435, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:16.840640Z"},"links":{"cited_paper":"/paper/2211.10435","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:46120cd5a87c3a788e382d0f0eba238450629a28be72ac7371eb16569e08f470","observation_id":"24585f50-901c-4667-a70e-ff14201be228","resolution":{"observed_at":"2026-08-07T14:46:16.840640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:20.340139Z","title":"Contrastive decoding: Open-ended text generation as optimization","venue":null,"work_id":"ed97dcec-92e7-4fe3-ab07-34d21141c9fb","year":2022},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:16.936286Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:d232753948ef9c510101f3e6b80deb391571ab6e6847ed669ffa3e13096c9c90","observation_id":"6e4a432b-3084-432d-86e8-53c2b39fbcdc","resolution":{"observed_at":"2026-08-07T14:46:20.470870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14992","last_updated":"2023-10-23T07:24:28Z","snapshot_observed_at":"2026-07-06T15:32:25.931739Z","submitted_at":"2023-05-24T10:28:28Z","title":"Reasoning with Language Model is Planning with World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14992","snapshot_observed_at":"2026-08-07T14:46:17.041421Z","title":"Reasoning with language model is planning with world model.arXiv preprint arXiv:2305.14992, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:17.041421Z"},"links":{"cited_paper":"/paper/2305.14992","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:498c6ac7439d269c60f76e650f414eb954c53acfe8dcfe21e5208d96071f2e1e","observation_id":"e3072380-ce34-40b6-b81c-d04493c30428","resolution":{"observed_at":"2026-08-07T14:46:17.041421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04519","last_updated":"2025-01-08T14:12:57Z","snapshot_observed_at":"2026-08-04T20:57:22.329262Z","submitted_at":"2025-01-08T14:12:57Z","title":"rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04519","snapshot_observed_at":"2026-08-07T14:46:17.111371Z","title":"rstar-math: Small llms can master math reasoning with self-evolved deep thinking.arXiv preprint arXiv:2501.04519, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:17.111371Z"},"links":{"cited_paper":"/paper/2501.04519","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:c65a7b5bed11fae00471f6d18da1ad64c274cec5e5f5821afa52755b614ce6c3","observation_id":"8694828c-2bb2-4f8b-acde-9d3ae93b6fb4","resolution":{"observed_at":"2026-08-07T14:46:17.111371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-07T14:46:17.185091Z","title":"Self-consistency improves chain of thought reasoning in language models.arXiv preprint arXiv:2203.11171, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:17.185091Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:9ec6087db7d706c2fcb47f5ada3bfd830ea4acea71a53462df1789b192477740","observation_id":"a604b63f-412b-4c28-8665-61ba43c4067f","resolution":{"observed_at":"2026-08-07T14:46:17.185091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06592","last_updated":"2024-12-11T22:59:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-05T19:25:40Z","title":"Improve Mathematical Reasoning in Language Models by Automated Process Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06592","snapshot_observed_at":"2026-08-07T14:46:17.253752Z","title":"Improve mathematical reasoning in language models by automated process supervision.arXiv preprint arXiv:2406.06592, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:17.253752Z"},"links":{"cited_paper":"/paper/2406.06592","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:0d71bbe7f8bad233407c4dace9306bbb628e7de5f75979e596d5904097aed843","observation_id":"df669bc7-cd76-47eb-a157-6b28c25709b5","resolution":{"observed_at":"2026-08-07T14:46:17.253752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12288","last_updated":"2024-09-02T17:12:48Z","snapshot_observed_at":"2026-07-06T18:32:44.452493Z","submitted_at":"2024-06-18T05:49:24Z","title":"An Investigation of Neuron Activation as a Unified Lens to Explain Chain-of-Thought Eliciting Arithmetic Reasoning of LLMs","version":3},"cited_work":{"arxiv_id":"2406.12288","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.12288","snapshot_observed_at":"2026-08-07T14:46:19.703541Z","title":"An Investigation of Neuron Activation as a Unified Lens to Explain Chain-of-Thought Eliciting Arithmetic Reasoning of LLMs","venue":"cs.AI","work_id":"c480e30f-e82e-4dcf-aadc-b24474f484ae","year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:17.386513Z"},"links":{"cited_paper":"/paper/2406.12288","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:da8019c60d6baa16613b40ffc5bde2cb537cbba39dd3a49b10c8844b08da5d67","observation_id":"f2aaea01-99ee-49a8-a32a-c7a4b00cad30","resolution":{"observed_at":"2026-08-07T14:46:19.783962Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11314","last_updated":"2025-06-11T03:55:09Z","snapshot_observed_at":"2026-08-07T17:04:15.538727Z","submitted_at":"2025-03-14T11:30:37Z","title":"Unlocking General Long Chain-of-Thought Reasoning Capabilities of Large Language Models via Representation Engineering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11314","snapshot_observed_at":"2026-08-07T14:46:17.456419Z","title":"Unlocking general long chain-of-thought reasoning capabilities of large language models via representation engineering.arXiv preprint arXiv:2503.11314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:17.456419Z"},"links":{"cited_paper":"/paper/2503.11314","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:bc0e949a4c7376e9f9adc3c4c318dc86dd68c200d60fe4be7d5f71c90a200846","observation_id":"5a9080bb-fe0a-4a60-b29a-2bdaf9a9141c","resolution":{"observed_at":"2026-08-07T14:46:17.456419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:17.507037Z","title":"Adaptive group policy optimization: Towards stable training and token-efficient reasoning.arXiv preprint arXiv:2503.15952, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:17.507037Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:7a79e9f313f8ea46e28210779487f4ab270d394b0ec2583ae0d0a2540020f4e6","observation_id":"280d9557-3591-4f8e-bb70-b23d8bb717bd","resolution":{"observed_at":"2026-08-07T14:46:17.507037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01652","last_updated":"2025-01-30T21:04:01Z","snapshot_observed_at":"2026-07-06T20:30:26.881629Z","submitted_at":"2025-01-30T21:04:01Z","title":"Hybrid Group Relative Policy Optimization: A Multi-Sample Approach to Enhancing Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01652","snapshot_observed_at":"2026-08-07T14:46:17.575076Z","title":"Hybrid group relative policy optimization: A multi-sample approach to enhancing policy optimization.arXiv preprint arXiv:2502.01652, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:17.575076Z"},"links":{"cited_paper":"/paper/2502.01652","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:30dd7d72731af44037e272cc01b9cbed5a69f61e4d2cc98eaf6febe9397e2dcb","observation_id":"e7818414-6f38-458f-88c9-6ff2bb6c12b0","resolution":{"observed_at":"2026-08-07T14:46:17.575076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23829","last_updated":"2025-04-01T14:48:02Z","snapshot_observed_at":"2026-08-07T21:53:39.516862Z","submitted_at":"2025-03-31T08:22:49Z","title":"Crossing the Reward Bridge: Expanding RL with Verifiable Rewards Across Diverse Domains","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23829","snapshot_observed_at":"2026-08-07T14:46:17.653974Z","title":"Expanding rl with verifiable rewards across diverse domains.arXiv preprint arXiv:2503.23829, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:17.653974Z"},"links":{"cited_paper":"/paper/2503.23829","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:7b5a14102a4d12bb215671ae87b2e81093ff2be08bb8d1155b06f2620de8185a","observation_id":"73c61492-c207-493b-b743-8d840017c1c7","resolution":{"observed_at":"2026-08-07T14:46:17.653974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01943","last_updated":"2025-08-07T23:04:55Z","snapshot_observed_at":"2026-08-08T04:08:24.938705Z","submitted_at":"2025-04-02T17:50:31Z","title":"OpenCodeReasoning: Advancing Data Distillation for Competitive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01943","snapshot_observed_at":"2026-08-07T14:46:17.745772Z","title":"Opencodereasoning: Advancing data distillation for competitive coding.arXiv preprint arXiv:2504.01943, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:17.745772Z"},"links":{"cited_paper":"/paper/2504.01943","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:bba4f29c5418848bef61dfea3576552762ba216ef8fe674c74162c95702b3b30","observation_id":"56129202-155c-4b44-b60c-5f814e81e76f","resolution":{"observed_at":"2026-08-07T14:46:17.745772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-07T14:46:17.819907Z","title":"Math-shepherd: Verify and reinforce llms step-by-step without human annotations.arXiv preprint arXiv:2312.08935, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:17.819907Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:63b2939cc5edf3379679cdc272896b5347fc1eff48da873b685a8c20c0e65bfb","observation_id":"a1e2b873-a893-4c88-b3fd-dbeb39faed09","resolution":{"observed_at":"2026-08-07T14:46:17.819907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15240","last_updated":"2025-02-22T10:21:46Z","snapshot_observed_at":"2026-07-06T19:06:41.697671Z","submitted_at":"2024-08-27T17:57:45Z","title":"Generative Verifiers: Reward Modeling as Next-Token Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15240","snapshot_observed_at":"2026-08-07T14:46:17.879108Z","title":"Generative verifiers: Reward modeling as next-token prediction.arXiv preprint arXiv:2408.15240, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:17.879108Z"},"links":{"cited_paper":"/paper/2408.15240","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:7226f252610f8bc7270654378eaf4776d7f5bdd4216572372ae03b674b3ae422","observation_id":"08a11087-c695-4a85-9fc5-b371f3689e75","resolution":{"observed_at":"2026-08-07T14:46:17.879108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19411","last_updated":"2025-02-26T18:55:42Z","snapshot_observed_at":"2026-08-07T17:45:14.260418Z","submitted_at":"2025-02-26T18:55:42Z","title":"Code to Think, Think to Code: A Survey on Code-Enhanced Reasoning and Reasoning-Driven Code Intelligence in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19411","snapshot_observed_at":"2026-08-07T14:46:17.955106Z","title":"Code to think, think to code: A survey on code-enhanced reasoning and reasoning-driven code intelligence in llms.arXiv preprint arXiv:2502.19411, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:17.955106Z"},"links":{"cited_paper":"/paper/2502.19411","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:4f9e1ec2ca22854b907df3624ed7ec074871dad1aa47b561ad0de1ba3a22dfb3","observation_id":"de830069-0ffe-4f12-9223-cbcb7e7b65ad","resolution":{"observed_at":"2026-08-07T14:46:17.955106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01904","last_updated":"2025-02-05T09:17:01Z","snapshot_observed_at":"2026-08-08T00:29:08.656523Z","submitted_at":"2025-01-03T17:14:16Z","title":"Virgo: A Preliminary Exploration on Reproducing o1-like MLLM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01904","snapshot_observed_at":"2026-08-07T14:46:18.053402Z","title":"Virgo: A preliminary exploration on reproducing o1-like mllm.arXiv preprint arXiv:2501.01904, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:18.053402Z"},"links":{"cited_paper":"/paper/2501.01904","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:86c6d559d48ee7447cbdc96b946f853f0dd36dd228c1446ce1cef2c0fa5f8ad1","observation_id":"687e9e94-984b-4701-8346-dee63e3cf51e","resolution":{"observed_at":"2026-08-07T14:46:18.053402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16042","last_updated":"2024-01-17T04:07:06Z","snapshot_observed_at":"2026-08-08T04:58:14.317234Z","submitted_at":"2023-09-27T21:53:56Z","title":"Towards Best Practices of Activation Patching in Language Models: Metrics and Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16042","snapshot_observed_at":"2026-08-07T14:46:18.130716Z","title":"Towards best practices of activation patching in language models: Metrics and methods.arXiv preprint arXiv:2309.16042, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:18.130716Z"},"links":{"cited_paper":"/paper/2309.16042","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:beb1d90103e52697cecccd867b001167adc37aa7d82f92be4391d4ec0d51f417","observation_id":"6b8f1d57-e4d7-438e-b76e-6815bbb8b4cb","resolution":{"observed_at":"2026-08-07T14:46:18.130716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14913","last_updated":"2021-09-05T17:32:27Z","snapshot_observed_at":"2026-08-07T23:50:29.977330Z","submitted_at":"2020-12-29T19:12:05Z","title":"Transformer Feed-Forward Layers Are Key-Value Memories","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.14913","snapshot_observed_at":"2026-08-07T14:46:18.259222Z","title":"Transformer feed-forward layers are key-value memories.arXiv preprint arXiv:2012.14913, 2020","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:18.259222Z"},"links":{"cited_paper":"/paper/2012.14913","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:1978384cd84b7bc1e9ffb0e6c3c8b511705ab6651299c55f0344432e17b116b6","observation_id":"dc743eb7-19c7-462e-849b-906f7c8757b2","resolution":{"observed_at":"2026-08-07T14:46:18.259222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08696","last_updated":"2022-03-10T02:28:59Z","snapshot_observed_at":"2026-08-05T12:39:09.493409Z","submitted_at":"2021-04-18T03:38:26Z","title":"Knowledge Neurons in Pretrained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08696","snapshot_observed_at":"2026-08-07T14:46:18.445140Z","title":"Knowledge neurons in pretrained transformers.arXiv preprint arXiv:2104.08696, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:18.445140Z"},"links":{"cited_paper":"/paper/2104.08696","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:20c807cb1f125bfedfd7ac3a11b15a7a017993b79df31208ebe49ca176c701b0","observation_id":"fd8655f5-1f3f-47ba-b36d-2ec22f393a16","resolution":{"observed_at":"2026-08-07T14:46:18.445140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-07T14:46:18.554798Z","title":"Discovering latent knowledge in language models without supervision.arXiv preprint arXiv:2212.03827, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:18.554798Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:892e80c936c489d5daa23ceabe8643c246914f5009fdcd6540a27c84af5dbef6","observation_id":"65ded547-b1db-4eed-9e2a-beba40408413","resolution":{"observed_at":"2026-08-07T14:46:18.554798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T14:46:18.715283Z","title":"Qwen2.5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:18.715283Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:c9c417cf659502d5f675d202a35938b80a18dd9e34fa4aba86a86a9d0c7acb25","observation_id":"97eb0a9c-ef87-4b91-82f6-c5293fd136d3","resolution":{"observed_at":"2026-08-07T14:46:18.715283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:46:18.900360Z","title":"Osworld: Benchmarking multimodal agents for open-ended tasks in real computer environments, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:18.900360Z"},"links":{"citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:cf7fba67a2be5c95332cbad05e3739615373f3116653fb5b401dca5416e176b8","observation_id":"b6f0ae5f-8eb5-4980-9248-8ede6b81bc37","resolution":{"observed_at":"2026-08-07T14:46:18.900360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-07T14:46:19.068265Z","title":"Wait, I see the mistake here,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:46:19.068265Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2505.17697"},"observation_digest":"sha256:3f5159e7ec6a6a38f72258b602e377c77f83ad8ff45fed3e648e68e2ceb16182","observation_id":"dcc5a936-bb88-4679-b1aa-b062bec97917","resolution":{"observed_at":"2026-08-07T14:46:19.068265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17697","last_updated":"2025-05-23T10:07:18Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T21:54:30.483014Z","submitted_at":"2025-05-23T10:07:18Z","title":"Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":1,"verified_fuzzy":7},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 6 inbound Pith citation observations for arXiv:2505.17697."}