{"as_of":"2026-08-06T21:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9ab698581402c8817c25618967dd7d76819ead5c810fb8f388403cf4cf119183","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T01:29:02.387691Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.08776/citation-record","integrity":"/paper/2605.08776/integrity","json":"/paper/2605.08776/citation-record.json","paper":"/paper/2605.08776"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:45:51.581453Z","title":"Chi, Quoc V","venue":null,"work_id":"927dced1-85d0-4fc1-9989-531a9930dfd1","year":2022},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:68daa3bc0e191e52dd697afee833dd32c9f57744a288d2931a1f70f82f98513e","observation_id":"5239fce8-56e5-45db-9027-10d4d79339f6","resolution":{"observed_at":"2026-05-14T06:59:04.099620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:45:51.632905Z","title":"Large language models are zero-shot reasoners","venue":null,"work_id":"b4bda17d-30bd-497e-8146-44a3011dbdc6","year":2022},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:9855a3844e4756d0b3f7fc4625370e596d943644cb05e5ec2b8f34394b2f51ef","observation_id":"9f5a3dff-e04e-47d2-8389-e468cc4194f6","resolution":{"observed_at":"2026-05-14T06:59:04.113459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:5270fb1edd6b3d84427413ae298151ee147b7aba7d28d0e480a62cac708451fe","observation_id":"906c24a0-c143-4108-91c3-2b3e68c859fb","resolution":{"observed_at":"2026-05-12T07:56:28.127357Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stop overthinking: A survey on efficient reasoning for large language models.Trans","venue":null,"work_id":"e5b2865f-304f-428b-ac80-7dd193d0f1f4","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:a2022cc568a07ce4ffcba389c4f17f800da57ae21b79dcea0c1b0515a9670464","observation_id":"24f4f96b-4e31-4772-a346-26c320de25b5","resolution":{"observed_at":"2026-05-14T06:59:04.108647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wait, we don’t need to \"wait\"! removing thinking tokens improves reasoning efficiency","venue":null,"work_id":"8148ebeb-e07c-45f1-b76d-e019b6069b5e","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:4d059ead9a4ab2a0024b2e6d819d3878d6cde88f28026ee55addb2c92d718348","observation_id":"bb25c0ad-d5a7-45fb-9a78-cf825275f53e","resolution":{"observed_at":"2026-05-14T06:59:04.090986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The benefits of a concise chain of thought on problem-solving in large language models","venue":null,"work_id":"52adce0e-870b-435d-a585-b7165f6925d8","year":2024},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:1e8fdca2ce683e6c7b39c98878a39b4c597c4789d0044c15ff18889fff82f950","observation_id":"36b0bca1-5b46-4e80-bd39-784faaa3023b","resolution":{"observed_at":"2026-05-14T06:59:04.095252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18600","last_updated":"2025-03-03T17:08:21Z","snapshot_observed_at":"2026-08-06T08:00:07.411397Z","submitted_at":"2025-02-25T19:36:06Z","title":"Chain of Draft: Thinking Faster by Writing Less","version":2},"cited_work":{"arxiv_id":"2502.18600","doi":"10.48550/arxiv.2502.18600","metadata_source":"pith","pith_arxiv_id":"2502.18600","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.18600 , year=","venue":"cs.CL","work_id":"9bb5ce25-93d1-4df0-bba6-491d6ba79d28","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"cited_paper":"/paper/2502.18600","citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:ed0a296d05d8ffd5e97e22783f7d19ecc89868e036445b0748172eafe6c91753","observation_id":"a1564186-707f-4e3e-9cc6-5b41571fe43f","resolution":{"observed_at":"2026-05-12T07:56:28.199335Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"C3ot: Generating shorter chain-of-thought without compromising effectiveness","venue":null,"work_id":"4da605f1-8226-4f6a-8659-2c2ca8f45abc","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:f7b337f0bc1adf8ca4491ed7b0cc567d41d23871d85f0867ed73d1634911ae7f","observation_id":"9f5fbbe9-9ba1-4de3-8e0d-9670933f7e90","resolution":{"observed_at":"2026-05-14T06:59:04.103993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tokenskip: Controllable chain-of-thought compression in llms","venue":null,"work_id":"fe14bf36-3a76-4ba9-81ab-e4f168313d46","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:5a56b4ee9501c1179fd000c94eaa3a759f42d44f2ef573b1dd4bff0e4ab77afb","observation_id":"a6d706c0-ba27-4b97-80ac-8f93d0219e6f","resolution":{"observed_at":"2026-05-14T06:59:04.117779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19716","last_updated":"2025-05-26T09:04:44Z","snapshot_observed_at":"2026-07-06T21:30:28.303379Z","submitted_at":"2025-05-26T09:04:44Z","title":"Concise Reasoning, Big Gains: Pruning Long Reasoning Trace with Difficulty-Aware Prompting","version":1},"cited_work":{"arxiv_id":"2505.19716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19716","snapshot_observed_at":"2026-07-02T16:57:10.052051Z","title":"Concise reasoning, big gains: Pruning long reasoning trace with difficulty-aware prompting","venue":null,"work_id":"ba6225c0-851a-4001-9bdd-5acfd1291bbb","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"cited_paper":"/paper/2505.19716","citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:a91331399494f85061623a1e2e7d03812da9b22e85e3023283d06f675346b35f","observation_id":"e957e801-ff61-474d-a182-30d2420caa32","resolution":{"observed_at":"2026-05-12T07:56:28.206267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recut: Balancing reasoning length and accuracy in llms via stepwise trails and preference optimization","venue":null,"work_id":"5d76017a-59ab-4c2c-bc3f-059f6b4a22a5","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:94f03c9606cbd8934a2e541ae84cff1f5095329253d606e5de422a118f96d99e","observation_id":"a7e07d58-0a24-4fad-8290-d41b294264da","resolution":{"observed_at":"2026-05-14T06:59:04.086846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:0611e029bdf9d7e9284f5372bae9c43d2dd526ac4fa55d7aa7eee9c25d4aeba4","observation_id":"4a721cd9-76c9-4ae1-ae28-4d65a3cf2e54","resolution":{"observed_at":"2026-05-12T07:56:28.272051Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-06T08:53:09.095000Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2503.04697","doi":"10.48550/arxiv.2503.04697","metadata_source":"pith","pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","venue":"cs.CL","work_id":"ad7236fb-3752-48a9-b782-a384899c45a0","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:cc26dcb9715abb1567b7a1516eee466b85cdc4ce564721c999514f63feb9b6dc","observation_id":"803a5ec3-ef33-4874-93f2-2af4b5f69543","resolution":{"observed_at":"2026-05-18T00:19:22.325854Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Thinkprune: Pruning long chain-of-thought of llms via reinforcement learning.Trans","venue":null,"work_id":"0c7b568b-b496-4b2e-b9f5-db019bdea0ef","year":2026},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:7b2ae86e04d0586032370fd33d6880d10eafac1e986076d3853cd685517ac122","observation_id":"7f5f5274-7069-4df7-a532-eba6699190e2","resolution":{"observed_at":"2026-05-14T06:59:04.081456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.05433","last_updated":"2026-07-03T04:38:21Z","snapshot_observed_at":"2026-07-15T14:32:24.776402Z","submitted_at":"2026-03-05T17:54:40Z","title":"CRISP: Compressed Reasoning via Iterative Self-Policy Distillation","version":7},"cited_work":{"arxiv_id":"2603.05433","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.05433","snapshot_observed_at":"2026-07-03T20:18:56.074332Z","title":"CRISP: Compressed Reasoning via Iterative Self-Policy Distillation","venue":"cs.LG","work_id":"c5a99022-15b6-4d77-9850-23036df7a073","year":2026},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"cited_paper":"/paper/2603.05433","citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:5cfcfd2a5bb09441f42cef885ccaad14cb4c722a2b9632b946eb167d4f1e7787","observation_id":"d2645ce4-997d-4abf-9683-2d3070237991","resolution":{"observed_at":"2026-05-12T07:56:28.173768Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openmathinstruct-2: Accelerating AI for math with massive open-source instruction data","venue":null,"work_id":"194d7bce-ccbe-4767-a54c-7c432ee08d4d","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:72dfbe8a7ffc71a5a1391b9a599353ce5593f51a1e1b35688b214852c13e6b25","observation_id":"0cf3891f-a9f8-4041-9a52-b58291bade57","resolution":{"observed_at":"2026-05-14T06:59:04.071867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:d70ee75285576ad4e4397dd56181cb977d865fcf3e04cfa3ebbdd1a001b2a011","observation_id":"2bb9c946-0fa7-4be5-993d-7d93c839458a","resolution":{"observed_at":"2026-05-12T07:56:28.182351Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":"2412.16720","doi":"10.48550/arxiv.2412.16720","metadata_source":"pith","pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI o1 System Card","venue":"cs.AI","work_id":"68d3c334-0fc9-49e3-b7b0-a69afae933e2","year":2024},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:9815d909044eb10e90e8491ba50f08057fcaaa5efae1dfc8a2b3585dfc439bc8","observation_id":"18f614ed-e3b1-4885-9b78-ed465c708402","resolution":{"observed_at":"2026-05-12T07:56:28.220558Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-04T15:46:25.710484Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:a49255b5cacd6e2efd1e0d071cc8b81bec1cd6f52085bb8e3f2fab081f38e456","observation_id":"d4476742-a5ee-4df9-8521-86ba04693a24","resolution":{"observed_at":"2026-05-12T07:56:28.278238Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nguyen, Quang Pham, and Nghi D","venue":null,"work_id":"edf2d81c-18eb-4033-897b-0c1cf7785f3d","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:fb0d3fc88419b5f79f950cc880f67534ab2dd3c2d150b192c866f3fd8dbdf6b3","observation_id":"8895d4df-acbd-4e1d-86bb-ef10854bbdf5","resolution":{"observed_at":"2026-05-14T06:59:04.076156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Longbench v2: Towards deeper understanding and reasoning on realistic long-context multitasks","venue":null,"work_id":"cb00f81c-7a44-4b0f-b02c-50e9df0b5e67","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:1f3502fd4b46aa49c6a06a6513edf0c5d7d7f9238a79c0e93f806e98dc905166","observation_id":"9e9a8cf4-2ced-47c9-8f2b-ea9c25b360c4","resolution":{"observed_at":"2026-05-14T06:59:04.067394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":"2412.21187","doi":"10.48550/arxiv.2412.21187","metadata_source":"pith","pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","venue":"cs.CL","work_id":"d79f8b7d-560d-4fbd-bd70-4d084f6d9ad6","year":2024},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:19c162c46bdc4d288be8e2366bb6957eb2675bb11eb75daad1789bc319a9273a","observation_id":"05e092c1-6179-4af5-88eb-c8fd5ad07e34","resolution":{"observed_at":"2026-05-13T15:51:30.429014Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.719296+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.719296+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.09906","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T16:59:58.671324Z","title":"arXiv preprint arXiv:2603.09906 , year=","venue":null,"work_id":"f0a1b831-f743-4e43-9bb2-d4f3529014f3","year":2026},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:1ce68f1587a524084be45ab534fc48a10d56f94a4dc910402a54ee5015748be8","observation_id":"7d6af50d-2d8e-423a-aa47-bba7e3f2f151","resolution":{"observed_at":"2026-05-12T07:56:28.256127Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01141","last_updated":"2025-04-01T00:41:36Z","snapshot_observed_at":"2026-08-05T08:31:33.714333Z","submitted_at":"2025-03-03T03:48:20Z","title":"How Well do LLMs Compress Their Own Chain-of-Thought? A Token Complexity Approach","version":2},"cited_work":{"arxiv_id":"2503.01141","doi":"10.48550/arxiv.2503.01141","metadata_source":"pith","pith_arxiv_id":"2503.01141","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"How well do llms compress their own chain-of-thought? a token complexity approach","venue":"cs.CL","work_id":"21e3a5ff-8dd1-4b00-823c-baeba601afb5","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"cited_paper":"/paper/2503.01141","citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:b40dedeff9b96d97c7e6e46627605d328cf9991e5a66ac0f54a6ce43f792e630","observation_id":"f6727f4c-34e4-401c-ab16-6ebfaeb57273","resolution":{"observed_at":"2026-05-12T07:56:28.234223Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:02.583941+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:02.583941+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On-policy distillation of language models: Learning from self-generated mistakes","venue":null,"work_id":"1cb6e22a-9e1c-48b8-9df7-9d308b3c8aa9","year":2024},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:a22fa8d8bf09b698735d9dc8b600002e2ba416242507438a0926c875b621472f","observation_id":"48faaedd-4bfe-47db-9be2-56981da3159e","resolution":{"observed_at":"2026-05-14T06:59:04.030470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d9553ed3-3d72-41e4-a344-67f0d7b21f2d","year":2024},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:6ccae7a970a0cd79c29820ed8aaf37f21541402f5b30662cf8293c6f854f4f7f","observation_id":"2109f45f-7f28-4ce1-9a4d-4b18c9badbe0","resolution":{"observed_at":"2026-05-14T06:59:04.122087Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Minillm: Knowledge distillation of large language models","venue":null,"work_id":"d0f44fab-a539-40a6-8eca-30467c975cb1","year":2024},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:b574ec3f560fe1bd868bb91ffd3bc4dbeadff2abbff13ce020eb253efb216b31","observation_id":"7aadeaee-71b3-4a33-a4a2-a1aa47ce0331","resolution":{"observed_at":"2026-05-14T06:59:04.038592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On-policy distillation","venue":null,"work_id":"1e1213f1-43f1-4c0e-b137-371c2e17579a","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:fb0409adf51eea72817913edb6a037ae5781344b8f43cf998e0da9f995617918","observation_id":"6b78cb60-8b28-480e-af82-6aa6984cabf4","resolution":{"observed_at":"2026-05-14T06:59:04.033964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12275","last_updated":"2026-03-23T13:11:10Z","snapshot_observed_at":"2026-07-06T22:45:39.557598Z","submitted_at":"2026-02-12T18:58:28Z","title":"On-Policy Context Distillation for Language Models","version":2},"cited_work":{"arxiv_id":"2602.12275","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.12275","snapshot_observed_at":"2026-07-10T00:26:39.252472Z","title":"On-Policy Context Distillation for Language Models","venue":"cs.CL","work_id":"b56a7e15-d864-43f4-9212-59bc7ec70d21","year":2026},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"cited_paper":"/paper/2602.12275","citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:c540507a63f7d0f8639d20da318a91b1ce785122464364b8c645ac099484e72f","observation_id":"7d3533df-8ed8-4f1a-ba3d-3842467ce009","resolution":{"observed_at":"2026-05-13T20:48:41.492604Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks","venue":null,"work_id":"2831f974-7033-45c5-8467-d09a0e9205a4","year":2019},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:bdec91fc79a7992e8f1e67534e579d0acdbc49f56cc637da0db9f2b51d3f7ddc","observation_id":"906fa986-bfe3-44eb-8b3f-ebee18385ad6","resolution":{"observed_at":"2026-05-14T06:59:04.055042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T15:53:55.014752Z","title":"American invitational mathematics examination (aime) 2024","venue":null,"work_id":"c89df4af-f9f0-4144-8e3e-26c9942c3ba7","year":2024},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:ae464cd726e505878939d35252e348ee0bab190f35007b07b79bcbea6512a3cc","observation_id":"1a907381-4167-4cc1-958d-243350e495d5","resolution":{"observed_at":"2026-05-14T06:59:04.058799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T11:03:40.086802Z","title":"American invitational mathematics examination (aime) 2025","venue":null,"work_id":"27d55e43-baf9-4333-ab45-2d36e5a48005","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:ae77dd2dbc41cded5c1e27a677572105bee48f5db23d43dd95da1cbe04b467e9","observation_id":"3d9dc4f0-be9b-4c0e-86b1-00c74d2a1fc1","resolution":{"observed_at":"2026-05-14T06:59:04.052122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.21420","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Overconfident errors need stronger correction: Asymmetric confidence penalties for reinforcement learning.arXiv preprint arXiv:2602.21420, 2026a","venue":null,"work_id":"074d6fcd-cdcd-45d5-81cb-95684fd64c0f","year":2026},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:209e3e8769e21334f3c847c6ba123b3c5139c9cc089ef04773b607f3c3e2ac6d","observation_id":"28e6659f-ea38-427a-a1d5-0740c70acad5","resolution":{"observed_at":"2026-05-12T07:56:28.161002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Protect our environment from information overload.Nature Human Behaviour, 8(3):402–403","venue":null,"work_id":"5a95f560-fe94-4d2f-ac43-442196915260","year":2024},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:832235dca84b9f47ff721ddf2c9eeafd84332c8a6c0881839b1c092991098456","observation_id":"0dbe3366-048a-4aae-8c47-2d6ca33ac7b8","resolution":{"observed_at":"2026-05-14T06:59:04.048275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yang, Zachary DeVito, Martin Raison, Alykhan Tejani, Sasank Chilamkurthy, Benoit Steiner, Lu Fang, Junjie Bai, and Soumith Chintala","venue":null,"work_id":"321b5591-84dc-4b29-99fd-b428dc3df361","year":2019},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:f99b87692b341885b58dbfedf7207f5fdd03fcb47b713b50f670f0214344f133","observation_id":"143c1877-7029-4336-a7d0-ae4624394da3","resolution":{"observed_at":"2026-05-14T06:59:04.043625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":"1910.03771","doi":"10.48550/arxiv.1910.03771","metadata_source":"pith","pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","venue":"cs.CL","work_id":"9d86da8d-01d3-41af-a0d2-ee14897927a9","year":2019},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:cf1a1e16e05887af00e3eac2684b3f02ac21d8f208d0c19b218de0b7a8170277","observation_id":"e3d7f1d7-44d6-4e39-a57b-fec434cec536","resolution":{"observed_at":"2026-05-12T07:56:28.265448Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PhD thesis, UC Berkeley","venue":null,"work_id":"0d122b72-39cf-45ae-bafc-36e7722d6295","year":2025},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:f5c22d7e8e1e3db7701891c3e50d6720b923526e393b5d8c45bb36980fe706e4","observation_id":"d276b8ec-8e96-4695-867a-2a952046fe64","resolution":{"observed_at":"2026-05-14T06:59:04.062543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18734","last_updated":"2026-03-20T15:40:19Z","snapshot_observed_at":"2026-08-06T08:49:57.295985Z","submitted_at":"2026-01-26T17:56:50Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","version":3},"cited_work":{"arxiv_id":"2601.18734","doi":"10.18653/v1/2025.emnlp-main.125.https://aclanthology.org/2025.emnlp-main.125/","metadata_source":"pith","pith_arxiv_id":"2601.18734","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","venue":"cs.LG","work_id":"bae00e84-9b0d-433d-a066-20b951f0b4d0","year":2026},"citing_paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-12T01:29:02.387691Z"},"links":{"cited_paper":"/paper/2601.18734","citing_paper":"/paper/2605.08776"},"observation_digest":"sha256:8e2c7b8afda76bc28c59843888f6424eccb681a28286ca872374a44a8c683bb6","observation_id":"866e854f-69c8-499a-8fc4-391bd17d07a4","resolution":{"observed_at":"2026-05-12T07:56:28.240279Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.08776","last_updated":"2026-05-09T08:04:47Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:04:47Z","title":"Reasoning Compression with Mixed-Policy Distillation"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":1,"unresolved":0,"verified_exact":13,"verified_fuzzy":21},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2605.08776."}