{"as_of":"2026-08-19T09:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ece562dd2e6b501a225eb9b39be810082a80a131fffeb7bbfba50989b5c98b91","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:54:57.709810Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03401/citation-record","integrity":"/paper/2608.03401/integrity","json":"/paper/2608.03401/citation-record.json","paper":"/paper/2608.03401"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:57.520782Z","title":"Chain-of-thought prompting elicits reasoning in large language models.Advances in neural information processing systems, 35:24824–24837, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.520782Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:b8d7c379ec54dadd462b79f77e7aab6a0ce5eecd45d4a00f52c3593901769762","observation_id":"92641dc7-739a-4599-b6d1-071a1a3108c5","resolution":{"observed_at":"2026-08-15T14:54:57.520782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:57.525855Z","title":"Large language models are zero-shot reasoners.Advances in neural information processing systems, 35:22199–22213, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.525855Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:b22af961715a27686c7a066aa9dd14983b72b85c10307553e6c31a05503a1056","observation_id":"5ee880ee-cb2f-464b-8a83-aa39e7f6f6f7","resolution":{"observed_at":"2026-08-15T14:54:57.525855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-15T14:54:57.530582Z","title":"OpenAI o1 system card.arXiv preprint arXiv:2412.16720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.530582Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:f5614ac5302eed4887c52da3b6211b76aa806e9002849520269e61dc08a1becf","observation_id":"0fd67a53-3624-48be-ace6-fc7430c99d05","resolution":{"observed_at":"2026-08-15T14:54:57.530582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:57.535245Z","title":"DeepSeek-R1 incentivizes reasoning in LLMs through reinforcement learning.Nature, 645(8081):633–638, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.535245Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:4ec46db190e0199bc88e77d1b5705f5d2039f27b6f610b68ec706e45f7af99b2","observation_id":"9c2a21f9-0582-4600-bfec-c6a17c97a042","resolution":{"observed_at":"2026-08-15T14:54:57.535245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-15T14:54:57.548637Z","title":"Scaling LLM test-time compute optimally can be more effective than scaling model parameters.arXiv preprint arXiv:2408.03314, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.548637Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:603ef62d7f931dd4dba13f4970763c755b1da4871699dbebfc69ef8c9a01bcfa","observation_id":"2383471f-f178-423e-96d3-73a14a372d4a","resolution":{"observed_at":"2026-08-15T14:54:57.548637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:57.554009Z","title":"s1: Simple test-time scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.554009Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:bb057d2b2546e8d115c8abfa74846e4c6fcbee64c0c23dc2074456b7fb7293a1","observation_id":"0d43ff10-ee0a-4cc5-a7d5-2cc07bf25182","resolution":{"observed_at":"2026-08-15T14:54:57.554009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:57.558919Z","title":"Reasoning over mathematical objects: on-policy reward modeling and test time aggregation.arXiv preprint arXiv:2603.18886, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.558919Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:5dea5b39e855ecf6690cac9b158cb595a8d375b13b49df44878ab00cadbc1e58","observation_id":"ce656fa3-8228-49c2-b196-a90e38e692d1","resolution":{"observed_at":"2026-08-15T14:54:57.558919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-15T14:54:57.563430Z","title":"Do not think that much for 2+3=? On the overthinking of o1-like LLMs.arXiv preprint arXiv:2412.21187, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.563430Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:fbfb073c62c028e9d716019f979996776faaa197da9c9b6ca329fa5c199ca7d4","observation_id":"5a675195-a9c3-4bfa-8706-4d2e110c841f","resolution":{"observed_at":"2026-08-15T14:54:57.563430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15631","last_updated":"2026-07-07T09:54:57Z","snapshot_observed_at":"2026-08-16T12:56:17.055385Z","submitted_at":"2025-02-21T17:59:13Z","title":"The relationship between reasoning and performance in large language models--o3 (mini) thinks harder, not longer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15631","snapshot_observed_at":"2026-08-15T14:54:57.568104Z","title":"The relationship between reasoning and performance in large language models—o3 (mini) Thinks Harder, Not Longer.arXiv preprint arXiv:2502.15631, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.568104Z"},"links":{"cited_paper":"/paper/2502.15631","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:51c7f2644ecc0354d1fc0be7a95fd2ea88ebf7a7f36a22410470e02b6fd7d9b6","observation_id":"a81c8cae-96db-46bb-a70f-c33ec72f4a7b","resolution":{"observed_at":"2026-08-15T14:54:57.568104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00127","last_updated":"2025-04-30T18:48:06Z","snapshot_observed_at":"2026-08-16T04:48:18.978901Z","submitted_at":"2025-04-30T18:48:06Z","title":"Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00127","snapshot_observed_at":"2026-08-15T14:54:57.572709Z","title":"Between underthinking and overthinking: An empirical study of reasoning length and correctness in LLMs.arXiv preprint arXiv:2505.00127, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.572709Z"},"links":{"cited_paper":"/paper/2505.00127","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:c670eddb6b6c5231ba0b58e9426ed74683b052800d4a633ba78fad1936e47829","observation_id":"a3b647d3-6289-417b-a44f-dade89ba92be","resolution":{"observed_at":"2026-08-15T14:54:57.572709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:57.577012Z","title":"Stop when enough: Adaptive early-stopping for chain-of-thought reasoning.arXiv preprint arXiv:2510.10103, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.577012Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:2f1ff3108e96ce847929b65df8a0a1b8c96be734f901cf9b4b9d168f975f193b","observation_id":"fa820d98-7913-4f0f-9047-9996b4e1b5b4","resolution":{"observed_at":"2026-08-15T14:54:57.577012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:58.527805Z","title":"An analysis of time-dependent planning","venue":null,"work_id":"fc185b05-b96b-4885-9b8b-07b3b8802f76","year":1988},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.581067Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:461ca34cd261db00b16f4eefe3b8fe63fe7510dbf4a069e3039e1b2b0989f2a3","observation_id":"824dc38e-7443-462e-8f1c-58fa739b8c3e","resolution":{"observed_at":"2026-08-15T14:54:58.532238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:58.513303Z","title":"Using anytime algorithms in intelligent systems.AI Magazine, 17(3):73–83, 1996","venue":null,"work_id":"c8134445-e6fe-4045-b43c-708a2a8e82f8","year":1996},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.586012Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:7ff9a764220a4328624145e96572d2703ddf0d83df54b889e6110bb363e55219","observation_id":"c2afde66-0238-4cff-8689-69a2b70a6bbe","resolution":{"observed_at":"2026-08-15T14:54:58.518240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.7551/mitpress/2474.001.0001","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:57.783305Z","title":"Russell and Eric H","venue":null,"work_id":"4c6e95f7-73f7-4f8a-b25a-64c6e1dcd5e9","year":1991},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.590709Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:4ba283f525da7a3b35aa19bed0ddbce68d3c56e9d9b51a2e3fbb954ad3cbbeaf","observation_id":"005d7309-4229-40c0-8d5f-71bd1224fd3d","resolution":{"observed_at":"2026-08-15T14:54:57.789108Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-17T16:48:59.674177Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-15T14:54:57.595634Z","title":"L1: Controlling how long a reasoning model thinks with reinforcement learning.arXiv preprint arXiv:2503.04697, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.595634Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:ba5236630b14efede7b568d4aa869c97b521f44698deb7d0278e10ae08be6b3d","observation_id":"7f16c520-4e5c-497b-b9e4-f288b3955cf4","resolution":{"observed_at":"2026-08-15T14:54:57.595634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:57.600606Z","title":"Token-budget-aware LLM reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.600606Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:f4120d23ecc0630c912c6ce510720d9c7cb477acf5308085a1c12f1a3bb9d6e2","observation_id":"43d16131-21c0-4c11-bd75-a5c1544c5d07","resolution":{"observed_at":"2026-08-15T14:54:57.600606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:57.605630Z","title":"Training language models to reason efficiently.arXiv preprint arXiv:2502.04463, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.605630Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:abfedaee93c304d4d582747d8ea180efd3cef9065d4d40fbdd25c291e00d039c","observation_id":"67ba498a-ad94-423a-8b68-44c964b33b0e","resolution":{"observed_at":"2026-08-15T14:54:57.605630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13752","last_updated":"2025-06-16T17:57:05Z","snapshot_observed_at":"2026-08-09T05:35:21.916120Z","submitted_at":"2025-06-16T17:57:05Z","title":"Steering LLM Thinking with Budget Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13752","snapshot_observed_at":"2026-08-15T14:54:57.620132Z","title":"Steering LLM thinking with budget guidance.arXiv preprint arXiv:2506.13752, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.620132Z"},"links":{"cited_paper":"/paper/2506.13752","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:eda57fa75098a304801657cfb9a7be8be7234eca0b43cb1d3c2fe632145d714e","observation_id":"3d1b3763-41a4-4eb8-8b75-00431a292bc9","resolution":{"observed_at":"2026-08-15T14:54:57.620132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:57.624637Z","title":"An empirical study of LLM reasoning ability under strict output length constraint","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.624637Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:25939757ceb9b172a31706275786e032a8f2716e43d78ab0272b65bc0aa3f595","observation_id":"268b03b5-82a6-4329-8dab-329dc0e3e2cf","resolution":{"observed_at":"2026-08-15T14:54:57.624637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-17T15:45:29.274413Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.17196","snapshot_observed_at":"2026-08-15T14:54:57.629195Z","title":"BudgetThinker: Empowering budget-aware LLM reasoning with control tokens.arXiv preprint arXiv:2508.17196, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.629195Z"},"links":{"cited_paper":"/paper/2508.17196","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:1271d5d15970327173bd5e22e5a842873ad4cfa21e8140841d3a157e7604cdff","observation_id":"b0d6ed03-fff1-4e05-8fb1-f1364426e827","resolution":{"observed_at":"2026-08-15T14:54:57.629195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05618","last_updated":"2024-10-19T19:37:40Z","snapshot_observed_at":"2026-08-16T14:28:22.447838Z","submitted_at":"2024-01-11T01:52:25Z","title":"The Benefits of a Concise Chain of Thought on Problem-Solving in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05618","snapshot_observed_at":"2026-08-15T14:54:57.634129Z","title":"The benefits of a concise chain of thought on problem-solving in large language models.arXiv preprint arXiv:2401.05618, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.634129Z"},"links":{"cited_paper":"/paper/2401.05618","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:919dccb9c98619d3a9698194dbc54a805aed0889494b6cf8d5c33b0b8a9660ea","observation_id":"17c482ae-480b-4e5c-8be7-f8b10d88c9ac","resolution":{"observed_at":"2026-08-15T14:54:57.634129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19825","last_updated":"2025-01-23T08:45:52Z","snapshot_observed_at":"2026-08-16T13:30:18.557142Z","submitted_at":"2024-07-29T09:21:52Z","title":"Concise Thoughts: Impact of Output Length on LLM Reasoning and Cost","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19825","snapshot_observed_at":"2026-08-15T14:54:57.638901Z","title":"Concise thoughts: Impact of output length on LLM reasoning and cost.arXiv preprint arXiv:2407.19825, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.638901Z"},"links":{"cited_paper":"/paper/2407.19825","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:d7068dd0c866963276d9bf9f4b97f839a121ae2384ae165d7b3ae01831cc0adf","observation_id":"7c95076f-eec1-45f9-8765-55568b5e2235","resolution":{"observed_at":"2026-08-15T14:54:57.638901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-08-18T14:29:54.622995Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-15T14:54:57.643806Z","title":"Chain of draft: Thinking faster by writing less.arXiv preprint arXiv:2502.18600, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.643806Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:d609f6f9642e56fdd1b636ea8e937fdd21dd47a2bf80952abcb665409fb14be5","observation_id":"6d8124ee-6aae-468d-aa3d-71e649abdf89","resolution":{"observed_at":"2026-08-15T14:54:57.643806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-11T13:10:23.709172Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-15T14:54:57.648570Z","title":"Stop overthinking: A survey on efficient reasoning for large language models.arXiv preprint arXiv:2503.16419, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.648570Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:949fadf9b7a2b055289cf16918eaaa9f4154256d1c2ec2fcad8f2bc369ab2141","observation_id":"f46c7d4a-21b2-4dbe-81f7-32f459e3b274","resolution":{"observed_at":"2026-08-15T14:54:57.648570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.17930","last_updated":"2026-07-16T16:03:20Z","snapshot_observed_at":"2026-08-08T05:21:34.389587Z","submitted_at":"2026-06-16T13:40:53Z","title":"How Inference Compute Shapes Frontier LLM Evaluation","version":3},"cited_work":{"arxiv_id":"2606.17930","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.17930","snapshot_observed_at":"2026-08-15T14:54:58.085891Z","title":"How Inference Compute Shapes Frontier LLM Evaluation","venue":"cs.AI","work_id":"417bf666-d8d8-4a59-844d-9c04278cc390","year":2026},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.653008Z"},"links":{"cited_paper":"/paper/2606.17930","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:2fa4db105a7cc0bff9809ac587f95053ee987d12f89b28e2f1d151086d0aed1e","observation_id":"b11b80b7-6de1-4b7f-8738-d74b209c2769","resolution":{"observed_at":"2026-08-15T14:54:58.090186Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.23163","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:58.063996Z","title":"Probing the trajectories of reasoning traces in large language models.arXiv preprint arXiv:2601.23163, 2026","venue":null,"work_id":"3aa2675e-62bb-428c-a38c-f2faee0ba110","year":2026},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.657715Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:ea0e9cfcddfff07decbc73c69342f8bcbd0368229dcbbf58305788f98f6395b0","observation_id":"68b076d0-ddf9-4700-a947-1fa501372c3c","resolution":{"observed_at":"2026-08-15T14:54:58.070990Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.22266","last_updated":"2026-04-24T06:26:24Z","snapshot_observed_at":"2026-08-11T12:21:08.417141Z","submitted_at":"2026-04-24T06:26:24Z","title":"Large Language Models Decide Early and Explain Later","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.22266","snapshot_observed_at":"2026-08-15T14:54:57.662009Z","title":"Large language models decide early and explain later.arXiv preprint arXiv:2604.22266, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.662009Z"},"links":{"cited_paper":"/paper/2604.22266","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:4b924634647d955df1cef42477290b22c253b93b650f10938b61608a88ed1e4d","observation_id":"7d654e80-0011-4ebf-b6f9-9f6020ce5d6a","resolution":{"observed_at":"2026-08-15T14:54:57.662009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.11713","last_updated":"2026-06-01T17:06:08Z","snapshot_observed_at":"2026-08-15T02:54:48.270724Z","submitted_at":"2025-10-13T17:59:35Z","title":"Are Large Reasoning Models Interruptible?","version":4},"cited_work":{"arxiv_id":"2510.11713","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.11713","snapshot_observed_at":"2026-08-15T14:54:57.973131Z","title":"Are Large Reasoning Models Interruptible?","venue":"cs.CL","work_id":"1b74b249-f9ed-48b9-8a2e-a8571055a5ef","year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.666595Z"},"links":{"cited_paper":"/paper/2510.11713","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:fdd556740ec2b818afedb86f6d6751f04a5a709d37dc5ce6b0d1e591538138fa","observation_id":"f92a8373-fda2-44d6-879a-f6ff3ff2fb6f","resolution":{"observed_at":"2026-08-15T14:54:57.978821Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:58.499086Z","title":null,"venue":null,"work_id":"a698c7b0-552c-45b6-86c0-b9a3bfccbd48","year":2024},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.671028Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:59543186b5faa4c75db9efa367f0c33478c739a4ee20475f01ea0060a5250e39","observation_id":"c52aea3d-2259-4c2b-8e52-0a3df8366ab9","resolution":{"observed_at":"2026-08-15T14:54:58.503586Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:57.675459Z","title":"MMLU-Pro: A more robust and challenging multi-task language un- derstanding benchmark.Advances in Neural Information Processing Systems, 37:95266–95290, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.675459Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:abbdaf8b2e32e3ea6a6853137cea3074652a7cca621f39a6363d92167502ea2c","observation_id":"66099167-8a59-42ff-9257-9d2276bb4657","resolution":{"observed_at":"2026-08-15T14:54:57.675459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07985","last_updated":"2024-12-24T04:04:30Z","snapshot_observed_at":"2026-08-16T19:47:24.627230Z","submitted_at":"2024-10-10T14:39:33Z","title":"Omni-MATH: A Universal Olympiad Level Mathematic Benchmark For Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07985","snapshot_observed_at":"2026-08-15T14:54:57.680612Z","title":"Omni-MATH: A universal olympiad level mathematic benchmark for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.680612Z"},"links":{"cited_paper":"/paper/2410.07985","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:f9824c68c53bb57603e18d525867ca29268612a365e872267b1216c860218645","observation_id":"d48652b6-c996-4849-994e-5362b8a6c3fe","resolution":{"observed_at":"2026-08-15T14:54:57.680612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:57.685592Z","title":"Benchmarks saturate when the model gets smarter than the judge.arXiv preprint arXiv:2601.19532, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.685592Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:b124718db217cea43c2354ae47d8c1ec341a04e52670c408a5d556aa7db94b77","observation_id":"ffca41ce-6e00-48f4-b10b-05f09316c281","resolution":{"observed_at":"2026-08-15T14:54:57.685592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-15T14:54:57.690130Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.690130Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:a85ffa2ef98f5333bdcc0c2668aad73815222ccf53bd4bf359d26e9841a5a904","observation_id":"1266c92c-7807-453c-9ab7-9c8b4a09a93a","resolution":{"observed_at":"2026-08-15T14:54:57.690130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:58.485163Z","title":"Qwen3 thinking budget","venue":null,"work_id":"fdba8b09-51fc-442f-9a17-16aaf4ddbc5b","year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.695545Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:83b0b1329d890fee48d8d698811f99c54540e58d6f2e8d11dbc1da72d6060d9a","observation_id":"37f7506a-61ec-4cd2-ac82-ceb2c809e0dd","resolution":{"observed_at":"2026-08-15T14:54:58.489510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11926","last_updated":"2025-03-14T23:50:34Z","snapshot_observed_at":"2026-08-17T15:42:03.133713Z","submitted_at":"2025-03-14T23:50:34Z","title":"Monitoring Reasoning Models for Misbehavior and the Risks of Promoting Obfuscation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11926","snapshot_observed_at":"2026-08-15T14:54:57.699994Z","title":"Monitoring reasoning models for misbehavior and the risks of promoting obfuscation.arXiv preprint arXiv:2503.11926, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.699994Z"},"links":{"cited_paper":"/paper/2503.11926","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:8cefed74bbb193f856db5864f95bd6e3a6de194895915004d0dbfcb98ced5155","observation_id":"eaff9bf9-80bd-42e9-be0c-7b30fb728f09","resolution":{"observed_at":"2026-08-15T14:54:57.699994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-17T02:01:42.843839Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-15T14:54:57.705072Z","title":"Chain of thought monitorability: A new and fragile opportunity for AI safety.arXiv preprint arXiv:2507.11473, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.705072Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:34c9e31c2f8607b24213743607df53176d3574c7bc4ac09b0937f91aaf215a60","observation_id":"21b92984-2e1c-4a76-b5d8-264744cd8815","resolution":{"observed_at":"2026-08-15T14:54:57.705072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:57.709810Z","title":"Finished","venue":null,"work_id":null,"year":1947},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.709810Z"},"links":{"citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:d87d530a59e9c14c175e9cd3929705f1c34067b3201f14614297013be594f547","observation_id":"30b791ab-2ecf-44c6-a22a-f236715f4969","resolution":{"observed_at":"2026-08-15T14:54:57.709810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-15T14:54:57.544427Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.544427Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:2896e0c18d72ffc0a103d82c485951112df1c87dd5a4c48900c274977e3a0cf7","observation_id":"06ff5807-5bce-4b8c-af34-84b8812b74db","resolution":{"observed_at":"2026-08-15T14:54:57.544427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-14T02:46:12.121034Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-08-15T14:54:57.615077Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:57.615077Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2608.03401"},"observation_digest":"sha256:b8199a470d2d4e29f4938bc90f1a8a71b424d29d67f53570b7ee7ba60a55f5c4","observation_id":"6c19270b-111f-4bf0-a278-e86cbb30e579","resolution":{"observed_at":"2026-08-15T14:54:57.615077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03401","last_updated":"2026-08-04T09:54:37Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T03:20:28.860765Z","submitted_at":"2026-08-04T09:54:37Z","title":"Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":4,"verified_fuzzy":3},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2608.03401."}