{"as_of":"2026-08-07T14:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3696f3578f7290102d4db405351062eaaae0afdde61de9d81c8544922a9feb31","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T05:50:23.111591Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.22211/citation-record","integrity":"/paper/2605.22211/integrity","json":"/paper/2605.22211/citation-record.json","paper":"/paper/2605.22211"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-06T08:53:09.095000Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2503.04697","doi":"10.48550/arxiv.2503.04697","metadata_source":"pith","pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","venue":"cs.CL","work_id":"ad7236fb-3752-48a9-b782-a384899c45a0","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:7ad64d279152e04d3aa5fe815e7c74ec7511c7fd612af309f8c70600bc5e6aec","observation_id":"696136e2-793a-455b-b747-29311ac43f46","resolution":{"observed_at":"2026-05-22T05:51:08.252527Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T13:04:57.086056Z","title":"Back to basics: Revisiting reinforce-style optimization for learning from human feedback in llms","venue":null,"work_id":"f42c8e62-7c0d-4824-b1a2-906653781f5c","year":2024},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:4b06d18019fd44ffe62c59dce89ab19304e6376bf7ce3bdc9814961e09413f55","observation_id":"a219f3af-9b34-4ba7-995c-20d1c9983099","resolution":{"observed_at":"2026-05-22T05:51:09.643715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00157","last_updated":"2024-09-16T19:20:59Z","snapshot_observed_at":"2026-08-03T23:38:38.676420Z","submitted_at":"2024-01-31T20:26:32Z","title":"Large Language Models for Mathematical Reasoning: Progresses and Challenges","version":4},"cited_work":{"arxiv_id":"2402.00157","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.00157","snapshot_observed_at":"2026-07-04T11:39:46.423009Z","title":"Large language models for mathematical reasoning: Progresses and challenges","venue":null,"work_id":"d8278850-469f-40f1-8af5-cf634483852f","year":2024},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2402.00157","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:7121f09ba319eba60738420866b80486f054efce7244684e5cc703115b3e547d","observation_id":"f3f1dc8c-8d96-48bb-9328-57bff04c810e","resolution":{"observed_at":"2026-05-22T05:51:08.336753Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.04463","doi":"10.48550/arxiv.2502.04463","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training language models to reason efficiently","venue":"ArXiv.org","work_id":"ddc0d049-f0ca-4946-aa25-6843f6072e08","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:220b664b4f24bc6b2e5472cde28940326df4e35e6ec5ca4b26a76c89738c280d","observation_id":"31c5df9d-9424-4d79-b38b-8704a5eb24f7","resolution":{"observed_at":"2026-05-22T05:51:08.112138Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.17449","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:05:03.811295Z","title":"Trims: Real-time tracking of minimal sufficient length for efficient reasoning via rl","venue":null,"work_id":"a3884ca2-7c57-4130-a3d4-759b59dfcc5b","year":2026},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:5cad4a92ae8be95e59c67ae567fbc5f18abf4e7b7869bd92020c25898f5101b5","observation_id":"224733ea-9a8c-4dac-b7c2-f999eb5d9d62","resolution":{"observed_at":"2026-05-22T05:51:08.154850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Do not think that much for 2+ 3=? on the overthinking of long reasoning models","venue":null,"work_id":"16cda0c7-eaed-4089-9362-e7ff98a136aa","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:894619b9a97225c70a539e4e86496f65d6eb5d54256fc2b1911fde570debd03b","observation_id":"ae1a9b08-4d6d-4710-a6f2-a6ce32e1ca6d","resolution":{"observed_at":"2026-05-22T05:51:09.639829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00711","last_updated":"2025-07-01T12:14:22Z","snapshot_observed_at":"2026-08-07T07:21:03.621965Z","submitted_at":"2025-07-01T12:14:22Z","title":"Large Reasoning Models are not thinking straight: on the unreliability of thinking trajectories","version":1},"cited_work":{"arxiv_id":"2507.00711","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00711","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large reasoning mod- els are not thinking straight: on the unreliability of thinking trajectories","venue":null,"work_id":"57f5e5d9-8c22-45d3-9850-fac7fec6211c","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2507.00711","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:ad2b5c9aeb9ffff81a27f8bf9f0f28b9a70504cdf8fffe3c3fce546974bc809d","observation_id":"346cb749-5c01-423c-9f43-4a55b660d881","resolution":{"observed_at":"2026-05-22T05:51:08.101200Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18086","last_updated":"2025-05-23T16:43:03Z","snapshot_observed_at":"2026-07-06T21:29:26.614513Z","submitted_at":"2025-05-23T16:43:03Z","title":"Stable Reinforcement Learning for Efficient Reasoning","version":1},"cited_work":{"arxiv_id":"2505.18086","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.18086","snapshot_observed_at":"2026-07-01T22:46:20.251611Z","title":"Stable reinforcement learning for efficient reasoning","venue":null,"work_id":"4b2b6cf2-4622-48ca-acc9-a321825659e0","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2505.18086","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:c34e05db904c266f8cc68eec6341ffabed8230ecfe7d81c08e54a135babae0c4","observation_id":"32eafdbe-ed52-49a4-b269-446d843604d6","resolution":{"observed_at":"2026-05-22T05:51:08.263012Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06807","last_updated":"2025-02-18T22:21:40Z","snapshot_observed_at":"2026-08-05T15:21:07.825807Z","submitted_at":"2025-02-03T23:00:15Z","title":"Competitive Programming with Large Reasoning Models","version":2},"cited_work":{"arxiv_id":"2502.06807","doi":"10.48550/arxiv.2502.06807","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06807","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Competitive programming with large reasoning models","venue":"ArXiv.org","work_id":"872d4377-f88a-4ea0-9f62-88c513266130","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2502.06807","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:1418a4635847164573f346fe8de2bea8648fdd29ff9b4e44674d418037e50115","observation_id":"6a483081-dd8a-49a2-8f83-3101c90ede19","resolution":{"observed_at":"2026-05-22T05:51:08.235559Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.23966","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A pragmatic way to measure chain-of-thought monitorability","venue":null,"work_id":"18de2ace-a7b2-4de8-a326-f846ff157ca2","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:dc14567153c9299d589c232c58ee59e7496f4f9585ae1e0871d750fba9dc28c9","observation_id":"ff273a58-7581-4528-b33f-ff40300a6d2a","resolution":{"observed_at":"2026-05-22T05:51:08.331036Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.20347","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:50:10.670758Z","title":"Serl: Self-play reinforcement learning for large language models with limited data","venue":null,"work_id":"504cbf18-21bd-46c7-81c6-de09bc479215","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:afcce799db58400758a4d92e57b59396dc6bd2b82ad1a54b9a8af7b9c96b9d65","observation_id":"e3dfef68-a825-4b1e-a012-266ff45c44ee","resolution":{"observed_at":"2026-05-22T05:51:08.130746Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:3f652d6f57e6b7cc8cfd885a568f1503c5b1f85b5f1a10e488b249544fbb4a7a","observation_id":"7cb99d6b-172d-4a34-bb6d-9828bd4c8ee0","resolution":{"observed_at":"2026-05-22T05:51:08.136722Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Token-budget-aware llm reasoning","venue":null,"work_id":"121235a9-be0c-46f6-9a5b-2cc17c01efbe","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:cfc28d5498ff8004d7a2b19e1c56477dec9604724ff0edde420f08e13932632d","observation_id":"f5b08414-dbcc-423a-9ff1-ef0a8627550a","resolution":{"observed_at":"2026-05-22T05:51:09.636221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.17813","doi":"10.48550/arxiv.2505.17813","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Don’t overthink it","venue":"Open MIND","work_id":"a34204a7-e7e2-4b25-86e0-559b519bef00","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:1565f593f15f21694cff4a4c2ee9257e63555f0628c9dbc473243d3b290335ad","observation_id":"cba08d68-2a06-4b28-bdac-ed904a928375","resolution":{"observed_at":"2026-05-22T05:51:08.142676Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T01:34:27.161234Z","title":"Olympiadbench: A challenging benchmark for promoting agi with olympiad-level bilingual multimodal scientific problems","venue":null,"work_id":"3dfe4141-a0a1-4147-a19e-40a523885251","year":2024},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:fde4ce6f0a3e3fa1cf0e3e7c96258729002878db4c542dcded89244c064359fe","observation_id":"c26f8ae5-43b4-4e0d-96d8-503212b2f10e","resolution":{"observed_at":"2026-05-22T05:51:09.632448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18773","last_updated":"2025-08-26T07:57:28Z","snapshot_observed_at":"2026-08-06T15:54:13.543604Z","submitted_at":"2025-08-26T07:57:28Z","title":"ThinkDial: An Open Recipe for Controlling Reasoning Effort in Large Language Models","version":1},"cited_work":{"arxiv_id":"2508.18773","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.18773","snapshot_observed_at":"2026-07-03T21:08:58.549502Z","title":"Thinkdial: An open recipe for controlling reasoning effort in large language models","venue":null,"work_id":"d20ab1ba-4c25-458d-aa0b-95437707977e","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2508.18773","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:1a4f1b5b3b8dcde9609503012cbe536221c97ce2f69937034d57bf2fcdb3040b","observation_id":"39b11de7-fe3c-4060-99d6-50b4a948d379","resolution":{"observed_at":"2026-05-22T05:51:08.273949Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":"2103.03874","doi":"10.48550/arxiv.2103.03874","metadata_source":"pith","pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","venue":"cs.LG","work_id":"50652ac6-fb7c-4675-a2c2-159c241feb17","year":2021},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:ba2421e6c4273108771731be2442646071e6c3f0646f13486ed687f82267f4ce","observation_id":"16253f30-8ba0-4dbe-b761-451d904dbf7b","resolution":{"observed_at":"2026-05-22T05:51:08.240716Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01296","last_updated":"2025-04-02T01:59:26Z","snapshot_observed_at":"2026-07-30T08:40:23.849282Z","submitted_at":"2025-04-02T01:59:26Z","title":"ThinkPrune: Pruning Long Chain-of-Thought of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.01296","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.01296","snapshot_observed_at":"2026-07-10T05:16:48.068473Z","title":"ThinkPrune: Pruning Long Chain-of-Thought of LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"9eb97578-ef7d-45eb-b973-842ff7f61c2b","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2504.01296","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:44bbe7033ab49f84b86fce0ecc2eb3b0f7c45ba548588f8c05aec302aef972ce","observation_id":"c5db1169-5707-4a80-aa5a-ba3caab3c296","resolution":{"observed_at":"2026-05-22T05:51:08.194772Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03262","last_updated":"2025-11-10T15:11:13Z","snapshot_observed_at":"2026-08-02T05:27:47.490711Z","submitted_at":"2025-01-04T02:08:06Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","version":9},"cited_work":{"arxiv_id":"2501.03262","doi":"10.48550/arxiv.2501.03262","metadata_source":"pith","pith_arxiv_id":"2501.03262","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","venue":"cs.CL","work_id":"557f9e99-cb00-4dd2-92fd-67ddcddbb35d","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2501.03262","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:bd048f419fb29ba2ba866d7054e67ad3eb966c4ae4f2abcbc90b31a7784342a7","observation_id":"431148f9-675c-4a10-9613-22cf74339235","resolution":{"observed_at":"2026-05-22T05:51:08.176467Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:52:56.973979+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:52:56.973979+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.18822","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adactrl: Towards adaptive and controllable reasoning via difficulty-aware budgeting","venue":null,"work_id":"67776b05-360c-4a5e-8e7a-3058297e1d47","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:a641f82ac9851473dfc1557f87d32ddf280c69c8e8c768e83ea5b67ba4d0f6ee","observation_id":"74116fa5-988b-43ce-bb4d-16c06f6f1e5a","resolution":{"observed_at":"2026-05-22T05:51:08.246949Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":"2412.16720","doi":"10.48550/arxiv.2412.16720","metadata_source":"pith","pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI o1 System Card","venue":"cs.AI","work_id":"68d3c334-0fc9-49e3-b7b0-a69afae933e2","year":2024},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:8c1f50d7ba12a47adaa1914ae1e8a45b9a8b56d14374d6f3c768065c7f7f7f05","observation_id":"0118d74e-cf98-4043-9d2a-e5f689968498","resolution":{"observed_at":"2026-05-22T05:51:08.124080Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What makes a good reasoning chain? uncovering structural patterns in long chain-of- thought reasoning","venue":null,"work_id":"e6cf6795-121e-4788-bca9-195b6b10fa4d","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:ffcd295f0196c928795f5a47d5b50703c209f0a5787eccc798297bf3c0211122","observation_id":"19df6ec6-2eff-47be-9bbd-c416dfee3730","resolution":{"observed_at":"2026-05-22T05:51:09.624019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.27338","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reasoning models sometimes output illegible chains of thought","venue":null,"work_id":"4e2887c2-f0b8-4beb-a6c2-f82c77388e07","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:9c61eb3b59d9a3d774d989384cf6842fb532880e530cae762ade5542e0ca932f","observation_id":"39a54a02-be9f-4515-8867-7d29dbf3f6ee","resolution":{"observed_at":"2026-05-22T05:51:08.188963Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-07-06T18:48:37.723242Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:e25742157add275f9e0b22addf1b78e7db774440bab01549940171f9964c26af","observation_id":"dbe2568e-3262-41ea-9660-a72c084b39ed","resolution":{"observed_at":"2026-05-22T05:51:08.304679Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.02542","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T19:58:53.649523Z","title":"Overthink: Slowdown attacks on reasoning llms","venue":null,"work_id":"66563fc1-564b-48e3-994f-4a091f2885c6","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:b7e00449e60e21bfc534552987cd11fa6674cd84b1ef8291cb9ca19fe4dff534","observation_id":"0e75ef50-2165-48f8-841c-ac2073259dff","resolution":{"observed_at":"2026-05-22T05:51:08.311073Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:14:00.902487Z","title":"Solving quan- titative reasoning problems with language models.Advances in neural information processing systems, 35:3843–3857","venue":null,"work_id":"35f20160-250e-4a1b-9b1a-f00caf5d6247","year":2022},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:4a5f49a7245352b76cc9a3a7431b62792d07b10775bfdd723776c116f65ad59b","observation_id":"085487de-aad0-4b62-9c98-f0a3253bf1f6","resolution":{"observed_at":"2026-05-22T05:51:09.664501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20160","last_updated":"2025-08-08T09:23:42Z","snapshot_observed_at":"2026-08-06T22:52:54.526678Z","submitted_at":"2025-06-25T06:29:18Z","title":"AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control","version":2},"cited_work":{"arxiv_id":"2506.20160","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.20160","snapshot_observed_at":"2026-07-04T08:09:40.738273Z","title":"Aalc: Large language model efficient reasoning via adaptive accuracy-length control","venue":null,"work_id":"899bfd26-fd51-4013-a4ba-dde51db36f97","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2506.20160","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:ae57f56ca549af11917177b715eff821436c349870c9e00bda1509793db79945","observation_id":"5d88afe3-db78-4c7c-8106-7475dddf4cd3","resolution":{"observed_at":"2026-05-22T05:51:08.318894Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11423","last_updated":"2025-09-02T02:55:17Z","snapshot_observed_at":"2026-07-06T21:25:08.411184Z","submitted_at":"2025-05-16T16:36:00Z","title":"When Thinking Fails: The Pitfalls of Reasoning for Instruction-Following in LLMs","version":3},"cited_work":{"arxiv_id":"2505.11423","doi":"10.48550/arxiv.2505.11423","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.11423","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When thinking fails: The pitfalls of reasoning for instruction- following in llms","venue":"ArXiv.org","work_id":"0bf7d75b-5a69-4f2a-ba16-1e22b09d053b","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2505.11423","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:0587860930450e5b031866914f5c63f071f08550843a043749e91cb5eee3a221","observation_id":"4fc68512-6158-45dc-bcad-f86df5b9b6ac","resolution":{"observed_at":"2026-05-22T05:51:08.363458Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11274","last_updated":"2026-04-17T08:29:27Z","snapshot_observed_at":"2026-07-06T21:25:03.247284Z","submitted_at":"2025-05-16T14:08:04Z","title":"SelfBudgeter: Adaptive Token Allocation for Efficient LLM Reasoning","version":6},"cited_work":{"arxiv_id":"2505.11274","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.11274","snapshot_observed_at":"2026-07-04T10:39:45.819564Z","title":"SelfBudgeter: Adaptive Token Allocation for Efficient LLM Reasoning","venue":"cs.AI","work_id":"cf7e4740-947f-49ca-a139-70469439ba99","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2505.11274","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:de5dcfd1b0f7223be999bd2ac1800d401898d45236c9df9e0ffd932cb02831ec","observation_id":"e5695cff-874d-4959-94b1-58412102b4c5","resolution":{"observed_at":"2026-05-22T05:51:08.290592Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:26:37.560761Z","title":"Let’s verify step by step","venue":null,"work_id":"1e1d0751-e17d-4e3e-aa61-95245c4f49c8","year":2023},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:f017e716732366e5e615db3f2dd7de38c50fe3254975ff3a73c0aae4973897ac","observation_id":"c842b863-0d1c-41fc-b1be-fe86ac67373f","resolution":{"observed_at":"2026-05-22T05:51:09.655637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15612","last_updated":"2025-05-21T15:03:26Z","snapshot_observed_at":"2026-07-31T03:41:47.823516Z","submitted_at":"2025-05-21T15:03:26Z","title":"Learn to Reason Efficiently with Adaptive Length-based Reward Shaping","version":1},"cited_work":{"arxiv_id":"2505.15612","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.15612","snapshot_observed_at":"2026-07-04T09:19:43.881659Z","title":"Learn to reason efficiently with adaptive length-based reward shaping","venue":null,"work_id":"6baef149-2491-431c-a612-c9fea9b25a16","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2505.15612","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:23a4e9126a79892ab78c18bb7d8797a3f9af5fb6e09607d79195c382f7499874","observation_id":"9473f81e-b1c1-4bbf-b0f4-d52050b385e9","resolution":{"observed_at":"2026-05-22T05:51:08.161581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01348","last_updated":"2026-07-25T11:09:30Z","snapshot_observed_at":"2026-08-03T05:45:38.584771Z","submitted_at":"2026-02-01T17:33:39Z","title":"Does Faithfulness-Guided Alignment Hurt Accuracy? Unlocking Accurate and Faithful Post-Retrieval Reasoning","version":3},"cited_work":{"arxiv_id":"2602.01348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.01348","snapshot_observed_at":"2026-07-28T02:21:37.675319Z","title":"Craft: Calibrated reasoning with answer-faithful traces via reinforcement learning for multi-hop question answering","venue":null,"work_id":"a4d56c12-62e5-451b-9d70-51892fc5c9c5","year":2026},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2602.01348","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:3c723dc47a36d2b44b2a39a490460349b6a911ecf176320a65ac53df92a0bbb4","observation_id":"74d3c4ab-bd87-4b13-b6f7-b7548cf70742","resolution":{"observed_at":"2026-07-28T02:21:37.675319Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12570","last_updated":"2025-01-29T03:11:03Z","snapshot_observed_at":"2026-07-06T20:24:12.803909Z","submitted_at":"2025-01-22T01:35:11Z","title":"O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning","version":2},"cited_work":{"arxiv_id":"2501.12570","doi":"10.48550/arxiv.2501.12570","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.12570","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"O1-pruner: Length-harmonizing fine-tuning for o1-like reasoning pruning","venue":"ArXiv.org","work_id":"133f3b9f-d49a-46dd-9844-40063846c9ee","year":2026},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2501.12570","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:cf408139701264af63bea508a5944b885942c1f287b8c745979173b92c097d4d","observation_id":"54861ffc-569e-4c96-872a-45c508107e2a","resolution":{"observed_at":"2026-05-22T05:51:08.358986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19825","last_updated":"2025-01-23T08:45:52Z","snapshot_observed_at":"2026-08-06T05:46:44.376142Z","submitted_at":"2024-07-29T09:21:52Z","title":"Concise Thoughts: Impact of Output Length on LLM Reasoning and Cost","version":2},"cited_work":{"arxiv_id":"2407.19825","doi":"10.48550/arxiv.2407.19825","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.19825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Concise thoughts: Impact of output length on llm reasoning and cost","venue":"arXiv (Cornell University)","work_id":"3e42d8fa-6b62-47fb-b0b4-c307d541460a","year":2024},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2407.19825","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:b2f9b9c0dab623a6ee0b762adc0a901650cf5fa60360066100982e7cd6abe156","observation_id":"509ff2d1-7256-4c24-9bb9-397838723096","resolution":{"observed_at":"2026-07-28T01:22:17.782417Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T18:16:26.555721Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744","venue":null,"work_id":"aa3e2ba7-4265-495b-8612-615b2ddc9991","year":2022},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:a2408cd0429cbe4707321755e456ccf04a5581d05e590d148860ff00d997ebce","observation_id":"16acf123-3bf2-42ff-b3ad-57f5947b3fb5","resolution":{"observed_at":"2026-05-22T05:51:09.648048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23480","last_updated":"2025-05-29T14:30:02Z","snapshot_observed_at":"2026-08-07T12:42:51.966401Z","submitted_at":"2025-05-29T14:30:02Z","title":"Revisiting Overthinking in Long Chain-of-Thought from the Perspective of Self-Doubt","version":1},"cited_work":{"arxiv_id":"2505.23480","doi":"10.48550/arxiv.2505.23480","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23480","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Revisiting overthinking in long chain-of-thought from the perspective of self-doubt","venue":"ArXiv.org","work_id":"ef8adebc-fabb-42d3-a9d6-2ffb82853c30","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2505.23480","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:47b53eda81990a03ff010e2ebc8c88a0c8287008c615ba50b32ba3fab127cff8","observation_id":"8b138a4d-fbef-4a8b-8f81-d604cab1da11","resolution":{"observed_at":"2026-05-22T05:51:08.285565Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-14T19:20:38.806839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T19:20:38.806839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T08:54:50.108470Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":"5d2e1082-e73f-4c1b-a18c-bf0ba1772c23","year":2023},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:e83e0c55268fbc33c57907066008cca7036d0b4ed416ea76081533e138b254d7","observation_id":"ed965ed0-c2fa-4110-81e7-92c5839ae32f","resolution":{"observed_at":"2026-05-22T05:51:09.659756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A principled approach to chain-of-thought monitorability in reasoning models","venue":null,"work_id":"5f432955-6321-4c57-b287-67403411bcba","year":null},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:bd1f360edccd48e54fd655df69e6026c281ec673baf0d19cceb61ef24487d281","observation_id":"04da9fa2-9cdb-4e1b-b916-759112367174","resolution":{"observed_at":"2026-05-22T05:51:09.673168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.20508","last_updated":"2026-06-02T07:42:23Z","snapshot_observed_at":"2026-08-03T02:31:08.820508Z","submitted_at":"2026-03-20T21:23:29Z","title":"Measuring Weak-to-Strong Legibility of Reasoning Models","version":2},"cited_work":{"arxiv_id":"2603.20508","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.20508","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Measuring reasoning trace legibility: Can those who understand teach?","venue":null,"work_id":"a98445e8-fa42-4277-8c6e-25ac587d2512","year":2026},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2603.20508","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:9c4288423fe8c11f00bd55fce6c07ae8e5a01f5472e991bf7a992b75516fea0a","observation_id":"b69ac798-fe59-4f60-8192-591d2afd54a0","resolution":{"observed_at":"2026-06-03T02:05:14.472947Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:e570fc2032c5a95c7531864a1f8b9fef7683d7d87cb13367ddf1ce739e80288b","observation_id":"91a6268e-084b-4122-902f-d6a2f4565195","resolution":{"observed_at":"2026-05-22T05:51:08.219123Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:0bd7bbfbe0eca625e03d20487b2c547bba8858604b06306ac3d0722c699082dc","observation_id":"919aa59d-b83f-45e4-afef-ba8e432d1ae4","resolution":{"observed_at":"2026-05-22T05:51:08.117873Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18298","last_updated":"2025-05-23T18:44:46Z","snapshot_observed_at":"2026-08-07T02:27:17.115747Z","submitted_at":"2025-05-23T18:44:46Z","title":"Thinking Fast and Right: Balancing Accuracy and Reasoning Length with Adaptive Rewards","version":1},"cited_work":{"arxiv_id":"2505.18298","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.18298","snapshot_observed_at":"2026-07-04T09:19:43.854814Z","title":"Thinking fast and right: Balancing accuracy and reasoning length with adaptive rewards","venue":null,"work_id":"3e34189b-2679-47d3-96ef-27405bed04a7","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2505.18298","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:18027cf3ed1bcc15c997caf5d141551c1420f2780b7b195ff0f6195b5a59ed6b","observation_id":"f1e542d4-bdda-4a54-853a-dcf3a992cc5b","resolution":{"observed_at":"2026-05-22T05:51:08.229808Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00127","last_updated":"2025-04-30T18:48:06Z","snapshot_observed_at":"2026-07-06T21:17:19.119854Z","submitted_at":"2025-04-30T18:48:06Z","title":"Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs","version":1},"cited_work":{"arxiv_id":"2505.00127","doi":"10.48550/arxiv.2505.00127","metadata_source":"pith","pith_arxiv_id":"2505.00127","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Betweenunderthinkingandoverthinking: Anempiricalstudyofreasoninglengthandcorrectnessinllms.arXivpreprint","venue":"cs.CL","work_id":"b686084f-7501-4f71-bba5-86b60b1504f7","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2505.00127","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:ac1612a11eb8e2b4b18d51b81dc40fe88684689f5489bfac66a0c0797c732038","observation_id":"c759b76b-4160-4d13-9665-f0ffd6ae6d1a","resolution":{"observed_at":"2026-05-22T05:51:08.202504Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-07T04:27:23.738927Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":"2503.16419","doi":"10.48550/arxiv.2503.16419","metadata_source":"pith","pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","venue":"cs.CL","work_id":"21afd80d-63a7-472b-800d-3b81161c39d3","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:53b203da60896005365489a9e1595bf611200d6c7c0982a974978bf68d6828b1","observation_id":"5febb1a8-d301-4ebc-a389-4c740c9e2363","resolution":{"observed_at":"2026-05-22T05:51:08.224443Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":"2203.11171","doi":"10.1101/2025.04.03.646459","metadata_source":"pith","pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","venue":"cs.CL","work_id":"8c6d5a6b-b5cc-4105-9c84-9c34bb9375bb","year":2022},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:f4f8af15c65420c90f15b9b0b0b4fa16917283ec3ca5fc0a939752b8a20440a7","observation_id":"ad8dc005-2bfb-4a1a-adb9-3eb8540858fe","resolution":{"observed_at":"2026-05-22T05:51:08.299503Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.595164Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"a3ac3b4d-8c58-4772-ad55-18e8fb162bd1","year":2022},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:f6cd857515f56d98cf36bc5da0158c80f66dd7327a297fd4e7d499f374533316","observation_id":"6e0d3468-06de-41e0-9271-260107112612","resolution":{"observed_at":"2026-05-22T05:51:09.628822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.04319","last_updated":"2019-09-26T23:57:44Z","snapshot_observed_at":"2026-08-05T17:26:35.920382Z","submitted_at":"2019-08-12T18:09:04Z","title":"Neural Text Generation with Unlikelihood Training","version":2},"cited_work":{"arxiv_id":"1908.04319","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1908.04319","snapshot_observed_at":"2026-07-04T19:40:07.174377Z","title":"Neural text generation with unlikelihood training","venue":null,"work_id":"f5c0999f-3f2c-4fd2-be5b-486e99399ccf","year":2020},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/1908.04319","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:e83638ca92a4e66eab50d108349cc84eeaa08c2bf6ba796645a1f1ab63548a6c","observation_id":"421645f1-8c4f-4f5e-ae2a-4734beba09e2","resolution":{"observed_at":"2026-05-22T05:51:08.106790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03302","last_updated":"2024-09-12T11:51:51Z","snapshot_observed_at":"2026-08-05T22:12:41.897890Z","submitted_at":"2024-04-04T08:52:30Z","title":"How Easily do Irrelevant Inputs Skew the Responses of Large Language Models?","version":4},"cited_work":{"arxiv_id":"2404.03302","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.03302","snapshot_observed_at":"2026-07-10T13:37:06.862301Z","title":"How easily do irrelevant inputs skew the responses of large language models?","venue":"cs.CL","work_id":"a77d6016-f4f4-4394-94f2-80a8d9221212","year":2024},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2404.03302","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:e6e990268c68531ffb14f7841c12f3efbbcfd170296ad277aad028b793225fae","observation_id":"6c900aeb-fc8e-43ab-b7b3-1eeffbfc8ac2","resolution":{"observed_at":"2026-05-22T05:51:08.168132Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.20945","doi":"10.48550/arxiv.2602.20945","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The art of efficient reasoning: Data, reward, and optimization","venue":"Open MIND","work_id":"cbe66095-4a1e-445f-8a38-e1dddcf8575b","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:8e625418de097f46f7d99fc6f5ec5b49d98414ab408d56cafb1bcadaab5a6731","observation_id":"bc70a0c9-434d-41fc-974f-74b610629371","resolution":{"observed_at":"2026-05-22T05:51:08.207944Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07266","last_updated":"2025-05-27T02:56:52Z","snapshot_observed_at":"2026-08-07T06:50:02.841285Z","submitted_at":"2025-02-11T05:28:59Z","title":"When More is Less: Understanding Chain-of-Thought Length in LLMs","version":3},"cited_work":{"arxiv_id":"2502.07266","doi":"10.48550/arxiv.2502.07266","metadata_source":"pith","pith_arxiv_id":"2502.07266","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When more is less: Understanding chain-of-thought length in llms","venue":"cs.AI","work_id":"450a518d-6378-4944-9651-8e3ef8049ddf","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2502.07266","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:6f2da7c3dfcf75a5f1bb5db209f72f34fb757cb8307828013c4eb1bb1a346a73","observation_id":"ab2e150e-adc7-40bf-a0b0-df3f8e5ab3c4","resolution":{"observed_at":"2026-05-22T05:51:08.368496Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05256","last_updated":"2025-06-06T02:38:39Z","snapshot_observed_at":"2026-08-07T10:19:38.980399Z","submitted_at":"2025-06-05T17:17:05Z","title":"Just Enough Thinking: Efficient Reasoning with Adaptive Length Penalties Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2506.05256","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05256","snapshot_observed_at":"2026-07-04T18:40:03.297902Z","title":"Just enough thinking: Efficient reasoning with adaptive length penalties reinforcement learning","venue":null,"work_id":"3264baac-3c10-43e1-8ad6-8dd6a491afbe","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2506.05256","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:892cc39ba15d07475b8ffe987898d0d7c9e7fac35d0c546ef3eeb22ca23492ad","observation_id":"07878212-db95-4bed-acb5-058a6488d63c","resolution":{"observed_at":"2026-05-22T05:51:08.348019Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:c6ee518269ec975bc2bd5156e2a229e4158c4ea21bfce1833f8076dc90ff58cf","observation_id":"645af4cb-bb17-447d-8d33-d1bb2b065373","resolution":{"observed_at":"2026-05-22T05:51:08.353420Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":"2409.12122","doi":"10.18653/v1/2025.emnlp-main.712","metadata_source":"pith","pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","venue":"cs.CL","work_id":"a097c5d4-6d32-46ee-9826-57d532bbfc9c","year":2024},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:c894f24ade08aa39ce2a07a57fedf94a2509a4803bb3c7df252965769d40d332","observation_id":"295a31f4-000d-4951-b416-7d4773872f28","resolution":{"observed_at":"2026-05-22T05:51:08.213615Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How is llm reasoning distracted by irrelevant context? an analysis using a controlled benchmark","venue":null,"work_id":"c8aa32c8-43fd-4e2d-9f0d-d2918739e711","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:2ef3987eeac3af0891ee147c5dd0c295567907983165dd2013a1dff96df4203f","observation_id":"16f49b6f-1fda-4747-97db-9ffa03026572","resolution":{"observed_at":"2026-05-22T05:51:09.677288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T15:13:54.676757Z","title":"Tree of thoughts: Deliberate problem solving with large language models.Ad- vances in neural information processing systems, 36:11809–11822","venue":null,"work_id":"a6744ae4-8f0e-4304-a9db-84910eaa073a","year":2023},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:26d981bd39891bc527c2791037ad04d8a4ea18d36df03d4173ff72e82b74d08f","observation_id":"9d78fcb7-d874-4469-a8a3-9bb4853c3314","resolution":{"observed_at":"2026-05-22T05:51:09.668785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03373","last_updated":"2025-02-05T17:13:32Z","snapshot_observed_at":"2026-07-06T20:31:41.231839Z","submitted_at":"2025-02-05T17:13:32Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","version":1},"cited_work":{"arxiv_id":"2502.03373","doi":"10.48550/arxiv.2502.03373","metadata_source":"pith","pith_arxiv_id":"2502.03373","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Demystifying Long Chain-of-Thought Reasoning in LLMs","venue":"cs.CL","work_id":"6d35a498-cdd6-463a-a0d9-5a29224a06d8","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2502.03373","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:8135ac76ec861fc65b90a1b660f615fafc6400b4d0a1fab512bf072c4ddef4c9","observation_id":"447ab622-07c5-4372-9006-d28a11828813","resolution":{"observed_at":"2026-05-22T05:51:08.341989Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.21370","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shorterbetter: Guiding reasoning models to find optimal inference length for efficient reasoning","venue":null,"work_id":"a147911b-5594-4394-a39d-f4e4768bdc48","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:975e2a31c16296cb30acc5aeeebc4aba4e03a902ab21af645e9d03a78b8d544b","observation_id":"b059e8a6-2dcc-44f0-8aa3-480a6d9bb842","resolution":{"observed_at":"2026-05-22T05:51:08.326126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:e26b3e25392288c142340a8d16130d95075ea55f4dfc664cffc9c01c940008dc","observation_id":"5a107780-3a89-421e-830f-1d5928574bbb","resolution":{"observed_at":"2026-05-22T05:51:08.372998Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.12284","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T18:40:03.334286Z","title":"Efficient rl training for reasoning models via length-aware optimization","venue":null,"work_id":"f678189c-c621-4d48-857f-4cd7314ac6c5","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:55f646c5b37c52f0e94e907b1ce71af4407bfaf313ec0502e3e950515dc34ebf","observation_id":"e343ea59-7990-4620-a66e-cb574e7e7e5c","resolution":{"observed_at":"2026-05-22T05:51:08.148451Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.07880","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T15:08:33.346728Z","title":"find the time 1000 days later","venue":null,"work_id":"493c756c-1d65-4a9e-8f89-291f2c10199b","year":2025},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:df1159376e575a54b61d8b49996f808d70c4fa60370e0592dbb72dec296e2d88","observation_id":"a800ada9-b08c-4d74-81c5-45374ca74d75","resolution":{"observed_at":"2026-05-22T05:51:08.258007Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Python verification","venue":null,"work_id":"bb1a60fc-bbd0-4edb-812e-4f49e7ff6dbc","year":2024},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:c72b14ceb1bc53634cc729b0702ac2c87f91f4cb23782607f04f5da4264ed7c4","observation_id":"30787a6b-254f-48a2-831c-b87e5c07c63d","resolution":{"observed_at":"2026-05-22T05:51:09.651803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The possible sums he can end up with are125, 126, 127","venue":null,"work_id":"239f5add-ac7b-47f7-ae60-316fb63770b8","year":2000},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:d7e051d2908f6a4a28843cb89eb6b1703b2a966dda7d1e8c263076d51a29b3e0","observation_id":"f8288a8c-7250-4e12-921e-74733b6a8423","resolution":{"observed_at":"2026-05-22T05:51:09.619306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":46,"verified_fuzzy":15},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2605.22211."}