{"as_of":"2026-08-09T16:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4714fa805dc8efe604ddfb66e02f6b3df570ffa434d14ee3613de2592d5f4ec8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":40,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T05:22:32.565978Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T14:16:23.842092Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2408.03314"},"observation_digest":"sha256:63cd11d3ff9d485f241bdab00330e08874b828add22a6baac43ac84fee7bb3a5","observation_id":"ffa6a240-7238-4739-9f0e-2096a5dc696e","resolution":{"observed_at":"2026-05-10T14:16:23.868058Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2409.12059","last_updated":"2026-04-29T16:04:42Z","snapshot_observed_at":"2026-07-31T16:43:47.158831Z","submitted_at":"2024-09-18T15:32:48Z","title":"MeTHanol: Modularized Thinking Language Models with Intermediate Layer Thinking, Decoding and Bootstrapping Reasoning","version":6},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-23T21:02:36.873034Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2409.12059"},"observation_digest":"sha256:53fac3d8ecf8bbdd07a60f89030d02e99a3346a2bbbe65bf1e69ceb214895aa5","observation_id":"bc82b9a3-74b9-40f7-b007-8126939e1953","resolution":{"observed_at":"2026-05-23T21:03:26.316471Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-07T06:05:27.895209Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T10:29:05.384381Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2412.06769"},"observation_digest":"sha256:2f12456adadfa8f13f3e3c745488278579197b887cce805740714750de42295c","observation_id":"1f5f740c-529c-4a42-9587-4d242a2e1563","resolution":{"observed_at":"2026-05-11T10:29:05.664360Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2412.13171","last_updated":"2024-12-17T18:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-17T18:50:33Z","title":"Compressed Chain of Thought: Efficient Reasoning Through Dense Representations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-17T04:47:40.335477Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2412.13171"},"observation_digest":"sha256:5b5cf53344e86d2c5ab28c988d857f88d763b62e7fadc396e09fb9fae51dbe60","observation_id":"fd3878df-ac30-4218-b528-7128b9eccdb8","resolution":{"observed_at":"2026-05-17T04:47:40.381114Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-09T05:22:32.565978Z","title":"S., Menon, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03275","last_updated":"2025-09-01T18:25:38Z","snapshot_observed_at":"2026-08-09T05:15:11.459630Z","submitted_at":"2025-02-05T15:33:00Z","title":"Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T05:22:32.565978Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2502.03275"},"observation_digest":"sha256:4540d638bbea9cf0602b02685382662bb9be7f16e82b27faadf7d379ae3f7d71","observation_id":"ad26f8bf-777b-49bf-8912-6e541244df80","resolution":{"observed_at":"2026-08-09T05:22:32.565978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-07T14:32:32.230744Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18642","last_updated":"2025-05-24T11:04:52Z","snapshot_observed_at":"2026-08-09T14:08:16.153756Z","submitted_at":"2025-05-24T11:04:52Z","title":"Skip-Thinking: Chunk-wise Chain-of-Thought Distillation Enable Smaller Language Models to Reason Better and Faster","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:32.230744Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2505.18642"},"observation_digest":"sha256:7c35c688eb2f1457dafb459a6c2ac062a7b6fc08e74ccfce4cb34a96522ac07b","observation_id":"4a505697-7948-4a32-933e-b00d2a86094f","resolution":{"observed_at":"2026-08-07T14:32:32.230744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-07T14:27:38.221574Z","title":"URL https://aclanthology.org/2021.tacl-1.21/","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18962","last_updated":"2025-05-31T15:08:41Z","snapshot_observed_at":"2026-08-09T13:11:14.871776Z","submitted_at":"2025-05-25T03:35:49Z","title":"System-1.5 Reasoning: Traversal in Language and Latent Spaces with Dynamic Shortcuts","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:38.221574Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2505.18962"},"observation_digest":"sha256:6802d6d7ab8f0a17a06630aba9b27decb7c35458644c47c7f0f97396f9f771c5","observation_id":"8b8ef420-0d32-4d7a-a559-88dbb85524c3","resolution":{"observed_at":"2026-08-07T14:27:38.221574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-07T12:35:19.638184Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24362","last_updated":"2025-06-02T10:26:59Z","snapshot_observed_at":"2026-08-09T13:32:21.842726Z","submitted_at":"2025-05-30T08:54:28Z","title":"Knowing Before Saying: LLM Representations Encode Information About Chain-of-Thought Success Before Completion","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:19.638184Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2505.24362"},"observation_digest":"sha256:b5c9ba83aef51c458223b32da5a1ba3e1babf4c5ff159304de6c4779e0fba55c","observation_id":"dd456392-e44e-41ce-bce8-39715e9adb07","resolution":{"observed_at":"2026-08-07T12:35:19.638184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-06T20:42:29.670598Z","title":"Think before you speak: Training language models with pause tokens","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02092","last_updated":"2025-07-02T19:17:29Z","snapshot_observed_at":"2026-08-08T04:36:50.019846Z","submitted_at":"2025-07-02T19:17:29Z","title":"Energy-Based Transformers are Scalable Learners and Thinkers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:42:29.670598Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2507.02092"},"observation_digest":"sha256:983c08a34519c264dd5d8043df5dff08daaadeab84bf0fc35de78a36f76a36e3","observation_id":"7a678ad2-fe4c-488a-b99d-81b9d4b172fe","resolution":{"observed_at":"2026-08-06T20:42:29.670598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-06T16:48:30.625805Z","title":"Think before you speak: Training language models with pause tokens","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13401","last_updated":"2025-07-16T20:56:57Z","snapshot_observed_at":"2026-08-09T09:34:20.574844Z","submitted_at":"2025-07-16T20:56:57Z","title":"MADI: Masking-Augmented Diffusion with Inference-Time Scaling for Visual Editing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:48:30.625805Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2507.13401"},"observation_digest":"sha256:e022c05ee125031b59f60c10dd74a6589dd7a70dd818bcde4157c734a3db2fa1","observation_id":"a06ac850-4280-4fab-9f07-12874da7d55f","resolution":{"observed_at":"2026-08-06T16:48:30.625805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-06T15:46:56.781431Z","title":"Think before you speak: Training language models with pause tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15104","last_updated":"2026-06-15T19:35:17Z","snapshot_observed_at":"2026-08-09T15:47:37.792059Z","submitted_at":"2025-07-20T19:57:07Z","title":"AnalogFed: Privacy-Preserving Discovery of Analog Circuits at Scale with Federated Generative AI","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T15:46:56.781431Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2507.15104"},"observation_digest":"sha256:69321ebe376a03f53947159e908667cb9cf0570fbfdbad4ec4f835721fa313cc","observation_id":"adae2c4c-54e3-43e1-877d-1c010e58537e","resolution":{"observed_at":"2026-08-06T15:46:56.781431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-06T15:17:34.903549Z","title":"S., Menon, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16473","last_updated":"2025-07-24T08:23:56Z","snapshot_observed_at":"2026-08-09T12:19:33.989331Z","submitted_at":"2025-07-22T11:22:58Z","title":"Learning Temporal Abstractions via Variational Homomorphisms in Option-Induced Abstract MDPs","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:17:34.903549Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2507.16473"},"observation_digest":"sha256:561f79d108b7d8fb0d1e7843d792c0297c231b1990fa9397c9a32aeee851e3b7","observation_id":"02e29b84-6d12-4014-a3ca-f9e661c44304","resolution":{"observed_at":"2026-08-06T15:17:34.903549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2510.09592","last_updated":"2026-05-10T15:21:35Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-10T17:50:59Z","title":"Mind-Paced Speaking: A Dual-Brain Approach to Real-Time Reasoning in Spoken Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T07:43:23.913399Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2510.09592"},"observation_digest":"sha256:9b3ef1e50b0535accc2c27da1ce4b9daf8461521f401e831be7f49add4518dab","observation_id":"3ccb2d8f-3e9c-441b-a8e5-66eb0c32ca18","resolution":{"observed_at":"2026-05-18T07:46:03.555461Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2510.24941","last_updated":"2026-05-26T22:58:09Z","snapshot_observed_at":"2026-08-08T14:16:18.113872Z","submitted_at":"2025-10-28T20:14:02Z","title":"Can Aha Moments Be Fake? Towards Quantifying Decorative and True Thinking in Chain-of-Thought","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T02:44:48.729794Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2510.24941"},"observation_digest":"sha256:df1cb5eb1567c12590d2e2fe24609ef899bb477081d04aceac4bc9566142fca3","observation_id":"bb357db0-d87c-4e5b-92d5-44405ae7569f","resolution":{"observed_at":"2026-05-18T02:45:46.257095Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-04T07:43:09.543491Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.24941","last_updated":"2026-05-26T22:58:09Z","snapshot_observed_at":"2026-08-08T14:16:18.113872Z","submitted_at":"2025-10-28T20:14:02Z","title":"Can Aha Moments Be Fake? Towards Quantifying Decorative and True Thinking in Chain-of-Thought","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T07:43:09.543491Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2510.24941"},"observation_digest":"sha256:05f1ce8fd803c1d76e4901d6d03aea00561a8343a309c1aff04a47abd673dbd8","observation_id":"c905c2a2-5a3a-4962-b96b-8c13a3e000f9","resolution":{"observed_at":"2026-08-04T07:43:09.543491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2511.05963","last_updated":"2026-05-25T15:53:24Z","snapshot_observed_at":"2026-08-08T22:18:33.888125Z","submitted_at":"2025-11-08T10:41:26Z","title":"Next-Latent Prediction Transformers Learn Compact World Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-25T07:21:04.684347Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2511.05963"},"observation_digest":"sha256:5b97e5b1df7daa61966c7217f8ba99cedd8c90837b76cfe7e1d0c1c4bc58b69d","observation_id":"31af617b-0c5a-442d-aa30-a65efea124c8","resolution":{"observed_at":"2026-05-25T07:25:29.419754Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-03T23:27:54.521220Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.05963","last_updated":"2026-05-25T15:53:24Z","snapshot_observed_at":"2026-08-08T22:18:33.888125Z","submitted_at":"2025-11-08T10:41:26Z","title":"Next-Latent Prediction Transformers Learn Compact World Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T23:27:54.521220Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2511.05963"},"observation_digest":"sha256:0fc9e8d7f94cd0ca1f235e4af8e33aebdecfd33648491b4a1db1978f55fd6868","observation_id":"ff79b576-6d77-44a0-9ce4-9722e1e9c4d5","resolution":{"observed_at":"2026-08-03T23:27:54.521220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2603.08899","last_updated":"2026-04-21T05:16:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-09T20:11:06Z","title":"ConFu: Contemplate the Future for Better Speculative Sampling","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T14:18:24.071422Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2603.08899"},"observation_digest":"sha256:d6e78e44c63a3291250d4b86c264d357380d53d8f9cc61de910924659107e26c","observation_id":"a9780133-3271-4cc1-a15f-c7d98e65aa19","resolution":{"observed_at":"2026-05-15T14:20:03.343507Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2604.03809","last_updated":"2026-04-04T17:30:23Z","snapshot_observed_at":"2026-07-30T17:01:04.006139Z","submitted_at":"2026-04-04T17:30:23Z","title":"Representational Collapse in Multi-Agent LLM Committees: Measurement and Diversity-Aware Consensus","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-13T17:59:52.185345Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2604.03809"},"observation_digest":"sha256:62058fff73cdfc9720069dff4ec8c0d2f6c4d9aa96c347d720e472d82a9ca4d3","observation_id":"ebdfda19-b095-4e6e-b79f-705874614819","resolution":{"observed_at":"2026-05-13T18:03:04.471785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2604.08299","last_updated":"2026-04-19T12:06:32Z","snapshot_observed_at":"2026-07-06T22:57:26.678728Z","submitted_at":"2026-04-09T14:32:07Z","title":"SeLaR: Selective Latent Reasoning in Large Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-10T18:27:36.132030Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2604.08299"},"observation_digest":"sha256:fca9e141c7ec1586c0c7b4734bcafaa725038640a3d2150babb9519bf274b2d0","observation_id":"8fddf0f9-438a-4a4c-9a01-99d6256b44e4","resolution":{"observed_at":"2026-05-11T00:35:49.487904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2604.10034","last_updated":"2026-04-11T05:13:33Z","snapshot_observed_at":"2026-07-31T08:50:30.342805Z","submitted_at":"2026-04-11T05:13:33Z","title":"AI Achieves a Perfect LSAT Score","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T16:35:01.079284Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2604.10034"},"observation_digest":"sha256:5222e5cd3c25d9b8fe77d42a35f9bfa286aed082c46e9b3d7e80684726de7e55","observation_id":"9456df79-ae04-4707-a066-ea9cbe63d7d3","resolution":{"observed_at":"2026-05-11T08:40:57.923772Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2604.17866","last_updated":"2026-05-07T12:30:55Z","snapshot_observed_at":"2026-07-30T06:32:10.464135Z","submitted_at":"2026-04-20T06:26:13Z","title":"Latent Abstraction for Retrieval-Augmented Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T04:22:05.341154Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2604.17866"},"observation_digest":"sha256:92789f6ee2711032b50d4255e01ace3333dc06eace48f6f22d6139f1d50eec5b","observation_id":"5adea2f9-71f0-43da-822f-a5f0292f3bdf","resolution":{"observed_at":"2026-05-11T12:01:04.901647Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2604.21027","last_updated":"2026-08-02T16:15:42Z","snapshot_observed_at":"2026-08-06T23:24:26.820832Z","submitted_at":"2026-04-22T19:18:36Z","title":"HypEHR: Hyperbolic Modeling of Electronic Health Records for Efficient Question Answering","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-09T23:51:47.724033Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2604.21027"},"observation_digest":"sha256:bf7b4f38058873b4980a48842faf72db973772abb8d556f6dce410c712f3ef6c","observation_id":"e1cb126c-a791-4f63-8787-0cac22f0dd1c","resolution":{"observed_at":"2026-05-09T23:54:45.200043Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2605.05997","last_updated":"2026-05-22T12:07:44Z","snapshot_observed_at":"2026-08-02T14:48:34.696358Z","submitted_at":"2026-05-07T10:48:46Z","title":"4DThinker: Thinking with 4D Imagery for Dynamic Spatial Understanding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:08.404090Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2605.05997"},"observation_digest":"sha256:56cb8bd8bb0dcfa5f9c9ba5641c3852aabb4ed8db0069285778afbc27aa1ae35","observation_id":"95303fd2-2971-419e-a343-4aa1ba5f28f9","resolution":{"observed_at":"2026-05-11T18:41:11.546187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2605.05997","last_updated":"2026-05-22T12:07:44Z","snapshot_observed_at":"2026-08-02T14:48:34.696358Z","submitted_at":"2026-05-07T10:48:46Z","title":"4DThinker: Thinking with 4D Imagery for Dynamic Spatial Understanding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-25T06:15:33.062980Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2605.05997"},"observation_digest":"sha256:e3b2a6025383c16bd0d8f4c9a527b527dc1061af3d742c437674e1b6d1053a89","observation_id":"14890bca-94bc-42b8-a51e-7e46bef1126e","resolution":{"observed_at":"2026-05-25T06:16:39.972605Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2605.08221","last_updated":"2026-05-06T13:58:55Z","snapshot_observed_at":"2026-07-06T23:20:28.875586Z","submitted_at":"2026-05-06T13:58:55Z","title":"NoisyCoconut: Counterfactual Consensus via Latent Space Reasoning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-12T00:51:40.815981Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2605.08221"},"observation_digest":"sha256:c11a7fda107afabae2fc8ec3ab0112b26c45b3e9f83f960c8d2d6050e2977962","observation_id":"2513bcb5-cb0e-4cb9-8484-adb152f34fef","resolution":{"observed_at":"2026-05-12T08:41:24.271480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2605.14323","last_updated":"2026-05-14T03:35:46Z","snapshot_observed_at":"2026-07-06T23:25:44.508166Z","submitted_at":"2026-05-14T03:35:46Z","title":"Dynamic Latent Routing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T01:49:14.934586Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2605.14323"},"observation_digest":"sha256:104f98b9e9a3aba4db3d62d2fb5f7d21a6384cc2e4975a140c8621a3b64ea4b8","observation_id":"6d9cffc8-9a1c-4cdd-8fe1-de69bb944101","resolution":{"observed_at":"2026-05-15T01:49:38.166124Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2605.16638","last_updated":"2026-05-15T21:10:56Z","snapshot_observed_at":"2026-08-03T04:32:55.741433Z","submitted_at":"2026-05-15T21:10:56Z","title":"TTE-Flash: Accelerating Reasoning-based Multimodal Representations via Think-Then-Embed Tokens","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-20T18:00:18.315737Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2605.16638"},"observation_digest":"sha256:dc3ecad216303152c1700e9de05e8c32f87cb70ea868b5a0f5537c699918aeb9","observation_id":"e73dcb0c-bc57-4262-be13-37b3b997beb4","resolution":{"observed_at":"2026-05-20T18:03:36.924513Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2605.22012","last_updated":"2026-05-21T05:18:57Z","snapshot_observed_at":"2026-08-05T07:24:30.530987Z","submitted_at":"2026-05-21T05:18:57Z","title":"LatentOmni: Rethinking Omni-Modal Understanding via Unified Audio-Visual Latent Reasoning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T06:34:57.483234Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2605.22012"},"observation_digest":"sha256:8140505654b9cb2b151d1b86dd643e1702d33c8136421dddff852ddac664fc19","observation_id":"5ebad7b8-378d-46e4-8739-421ce11244bf","resolution":{"observed_at":"2026-05-22T06:36:10.403900Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2605.28600","last_updated":"2026-05-27T15:17:06Z","snapshot_observed_at":"2026-08-05T23:04:48.328422Z","submitted_at":"2026-05-27T15:17:06Z","title":"Transformers Provably Learn to Internalize Chain-of-Thought","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-29T14:29:10.010212Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2605.28600"},"observation_digest":"sha256:2b8138c2c0adbd7e3d9c028993123a1081fbcc28fe010fc21a8af14a034b798c","observation_id":"ea4364f7-53ee-4e8a-8c6b-a6a3648f7921","resolution":{"observed_at":"2026-06-29T14:33:30.553941Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2606.04627","last_updated":"2026-06-06T08:34:56Z","snapshot_observed_at":"2026-07-06T23:44:42.700120Z","submitted_at":"2026-06-03T09:01:24Z","title":"MIRAGE: Mobile Agents with Implicit Reasoning and Generative World Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T06:21:57.229717Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2606.04627"},"observation_digest":"sha256:84f687d71deb0eb330e5502749d89bc1ee2668d370a14c8a1fc2f9506b71a6e1","observation_id":"3fe1e73e-24e8-4977-847e-97303368ee51","resolution":{"observed_at":"2026-07-02T08:06:48.304321Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2606.04678","last_updated":"2026-06-03T10:01:45Z","snapshot_observed_at":"2026-08-03T02:32:14.203182Z","submitted_at":"2026-06-03T10:01:45Z","title":"Test-Time Compute Scaling for ASR with Depth-Conditioned Looped Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T06:56:57.423463Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2606.04678"},"observation_digest":"sha256:738f5939b545791471ceed445eaab3326ce2aa5b31d017af93c13e61e3ed7458","observation_id":"94387795-7d27-4bc0-b471-24a2fb05b2e4","resolution":{"observed_at":"2026-07-02T07:26:45.923378Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2606.07720","last_updated":"2026-06-05T15:45:44Z","snapshot_observed_at":"2026-08-03T13:27:31.399604Z","submitted_at":"2026-06-05T15:45:44Z","title":"Why Limit the Residual Stream to Layers and Not Tokens? Persistent Memory for Continuous Latent Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-27T21:54:19.244824Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2606.07720"},"observation_digest":"sha256:890ffdbfb05351ac852609c384d7c04c75f792318e1c9848c5d567d21b5192a6","observation_id":"3915c544-a9a2-403f-bf09-b28b7487b39e","resolution":{"observed_at":"2026-07-02T17:47:17.690706Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2606.11445","last_updated":"2026-06-09T20:56:23Z","snapshot_observed_at":"2026-08-07T19:33:11.551966Z","submitted_at":"2026-06-09T20:56:23Z","title":"Forecasting Future Behavior as a Learning Task","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-06-27T12:55:39.494339Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2606.11445"},"observation_digest":"sha256:ea92a0bc68151c8e36f850e882f66c31a8b9d81eae042c6df46e9a2d95abc22a","observation_id":"49f8842d-9840-441c-ba72-947b02449465","resolution":{"observed_at":"2026-07-03T06:07:41.342134Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2606.13106","last_updated":"2026-06-11T09:33:40Z","snapshot_observed_at":"2026-07-06T23:51:55.044440Z","submitted_at":"2026-06-11T09:33:40Z","title":"Demystifying Hidden-State Recurrence: Switchable Latent Reasoning with On-Policy Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-27T07:20:38.534666Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2606.13106"},"observation_digest":"sha256:fbacde676d1ef94fa5502f2a5a2adb87d784240ec0c238f8db5279ac0819e155","observation_id":"f024309d-532c-49f1-b1c4-c01e18d6225b","resolution":{"observed_at":"2026-07-03T13:58:22.055865Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":"2310.02226","doi":"10.48550/arxiv.2310.02226","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226","venue":"arXiv (Cornell University)","work_id":"3fcd9a29-ac68-4f58-904c-2a4b18155c5f","year":2024},"citing_paper":{"arxiv_id":"2606.30128","last_updated":"2026-06-29T11:06:46Z","snapshot_observed_at":"2026-08-03T10:56:31.923714Z","submitted_at":"2026-06-29T11:06:46Z","title":"Does Verbose Chain-of-Thought Really Help? In-Distribution Evidence that Content, Not Length, Matters","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T06:45:56.613559Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2606.30128"},"observation_digest":"sha256:dc813abf955ad9dbaf35b93380c1cd43a64503ae484ca8704a13a4b678a47b5e","observation_id":"3b16d7e7-ecc1-40f8-852d-752cca32ef64","resolution":{"observed_at":"2026-06-30T06:54:21.082071Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-07-13T08:04:15.548790Z","title":"arXiv preprint arXiv:2310.02226 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08775","last_updated":"2026-05-03T21:34:35Z","snapshot_observed_at":"2026-07-15T23:17:52.001791Z","submitted_at":"2026-05-03T21:34:35Z","title":"HALO: Hybrid Adaptive Latent Reasoning for Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-13T08:04:15.548790Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2607.08775"},"observation_digest":"sha256:22ff6204fdc23fa7d91f316b46cfde9ba6edc60e88daa82776775b634cc8ec31","observation_id":"7d02fbc4-be96-4efa-8a32-adcc046593f5","resolution":{"observed_at":"2026-07-13T08:04:15.548790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-02T05:05:25.293025Z","title":"Think before you speak: Training language models with pause tokens.arXiv preprint arXiv:2310.02226,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13491","last_updated":"2026-07-15T06:37:05Z","snapshot_observed_at":"2026-08-06T10:33:55.264647Z","submitted_at":"2026-07-15T06:37:05Z","title":"DeepLoop: Depth Scaling for Looped Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T05:05:25.293025Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2607.13491"},"observation_digest":"sha256:29bbd9bd1904c06a2d273c77381879dfea5549cd8e89c753fd73b2eb46c2d56a","observation_id":"51fd1338-e877-4b76-9ef7-4fb9d4d55b48","resolution":{"observed_at":"2026-08-02T05:05:25.293025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-02T14:39:31.073737Z","title":"arXiv preprint arXiv:2310.02226 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20427","last_updated":"2026-05-08T16:55:49Z","snapshot_observed_at":"2026-08-07T08:49:09.996693Z","submitted_at":"2026-05-08T16:55:49Z","title":"Is MoE Routing a Huffman Code? Discovering the Frequency-Diversity Law in Chain-of-Thought","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T14:39:31.073737Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2607.20427"},"observation_digest":"sha256:51e25c61c6f40bf234c638a11d09ef0a9b0a855cba2d734a9ed232dec0e3f874","observation_id":"40798c7b-bb3f-46c2-8587-b87bc6d2b770","resolution":{"observed_at":"2026-08-02T14:39:31.073737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02226","snapshot_observed_at":"2026-08-01T04:14:43.722684Z","title":"Think before you speak: Training language models with pause tokens, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22925","last_updated":"2026-07-24T21:32:48Z","snapshot_observed_at":"2026-08-08T05:49:21.548828Z","submitted_at":"2026-07-24T21:32:48Z","title":"Not All LLM Reasoning is Visible in the Chain-of-Thought","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T04:14:43.722684Z"},"links":{"cited_paper":"/paper/2310.02226","citing_paper":"/paper/2607.22925"},"observation_digest":"sha256:5f1fd1d8ebd7878064c2e888d0c58e962bf06af0d42ef9935e82130a62911d4a","observation_id":"4fbea894-1da0-4fe5-8aa6-8d0816cc42a4","resolution":{"observed_at":"2026-08-01T04:14:43.722684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2310.02226/citation-record","integrity":"/paper/2310.02226/integrity","json":"/paper/2310.02226/citation-record.json","paper":"/paper/2310.02226"},"outbound":[],"paper":{"arxiv_id":"2310.02226","last_updated":"2024-04-21T03:39:21Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T21:01:03.193755Z","submitted_at":"2023-10-03T17:32:41Z","title":"Think before you speak: Training Language Models With Pause Tokens"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 40 inbound Pith citation observations for arXiv:2310.02226."}