{"as_of":"2026-08-23T17:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:00117882fa63f4d502762f368940ff21dbfd0a42feb80d0292cc6b489ada3e57","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:28:51.217571Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.27770/citation-record","integrity":"/paper/2607.27770/integrity","json":"/paper/2607.27770/citation-record.json","paper":"/paper/2607.27770"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:28:51.125490Z","title":"On-policy distillation of language models: Learning from self-generated mistakes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.125490Z"},"links":{"citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:3aacbdc445b0e6a52b8c0f7893621471f6e7d08af00b77209db7f446858bbdd8","observation_id":"f1eb6640-571f-45b1-8846-1d5ab143acf7","resolution":{"observed_at":"2026-08-15T15:28:51.125490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01064","last_updated":"2026-04-11T14:46:55Z","snapshot_observed_at":"2026-08-10T06:36:49.666818Z","submitted_at":"2026-02-01T07:19:57Z","title":"Exploring Knowledge Purification in Multi-Teacher Knowledge Distillation for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.01064","snapshot_observed_at":"2026-08-15T15:28:51.148065Z","title":"Exploring knowledge purification in multi-teacher knowledge distillation for llms.arXiv preprint arXiv:2602.01064, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.148065Z"},"links":{"cited_paper":"/paper/2602.01064","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:a074b93e6943cd36b7d8a075cf861c7f56469e4a45e819fa77a856e0e409022e","observation_id":"20a54d58-a011-4fe2-8903-10d4878d1bc6","resolution":{"observed_at":"2026-08-15T15:28:51.148065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13016","last_updated":"2026-04-15T17:48:51Z","snapshot_observed_at":"2026-08-16T00:27:04.851196Z","submitted_at":"2026-04-14T17:54:28Z","title":"Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.13016","snapshot_observed_at":"2026-08-15T15:28:51.158593Z","title":"Rethinking on-policy distillation of large language models: Phenomenology, mechanism, and recipe.arXiv preprint arXiv:2604.13016,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.158593Z"},"links":{"cited_paper":"/paper/2604.13016","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:678d6e632e9d2f7b260856e2fb132f37f88a14c505ea45460b1141cc3dc96928","observation_id":"b201a18f-0a80-433b-9511-76382099cb8a","resolution":{"observed_at":"2026-08-15T15:28:51.158593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:28:51.610080Z","title":"Learning from committee: Reasoning distillation from a mixture of teachers with peer-review","venue":null,"work_id":"57e50b61-f260-4d09-aac8-c0b6ba265cbc","year":2025},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.164599Z"},"links":{"citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:e40ff6cca047bb760603ca1247ede153eda4db9e281ec7a84c9497e89025c089","observation_id":"dc3eec7a-6484-4433-90e9-c6545c40945e","resolution":{"observed_at":"2026-08-15T15:28:51.617233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.30406","last_updated":"2026-06-29T14:51:28Z","snapshot_observed_at":"2026-08-10T09:37:40.339025Z","submitted_at":"2026-06-29T14:51:28Z","title":"MOPD: Multi-Teacher On-Policy Distillation for Capability Integration in LLM Post-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.30406","snapshot_observed_at":"2026-08-15T15:28:51.169704Z","title":"https://thinkingmachines.ai/blog/on-policy-distillation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.169704Z"},"links":{"cited_paper":"/paper/2606.30406","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:8532fe43d7d13889ce45872820be7056f0f5262262ba223c4cae709e8a98b07b","observation_id":"62770b68-0b5a-456e-8151-d8a28c6f40c2","resolution":{"observed_at":"2026-08-15T15:28:51.169704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:28:51.587578Z","title":"s1: Simple test-time scaling","venue":null,"work_id":"2cdf03a0-fc9e-4de0-b744-e036c2ce1814","year":2025},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.174919Z"},"links":{"citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:b1401f591a780f2154e7b9616ea972f01cddef2b031b596fdf64c99f2d5aa148","observation_id":"c4918eb6-eef8-4f24-a0f3-c2c3d7c26a75","resolution":{"observed_at":"2026-08-15T15:28:51.596518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-15T15:28:51.179897Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.179897Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:c9ebd52006a55a7114c11e731d4a5b40e3180c4e56d0694a117b87fd8d763cea","observation_id":"c8f606d7-4356-4379-bd30-80bb234edaff","resolution":{"observed_at":"2026-08-15T15:28:51.179897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-15T15:28:51.185156Z","title":"Hybridflow: A flexible and efficient rlhf framework.arXiv preprint arXiv:2409.19256,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.185156Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:0b150e199558a578d888b861bdd9e32e19dfbf0bcc343c3b0649ef1ade04e474","observation_id":"2351334e-3783-4cd3-a97b-7b229b5d5870","resolution":{"observed_at":"2026-08-15T15:28:51.185156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.17497","last_updated":"2026-05-17T15:14:24Z","snapshot_observed_at":"2026-08-15T19:35:05.302488Z","submitted_at":"2026-05-17T15:14:24Z","title":"Self-Supervised On-Policy Distillation for Reasoning Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.17497","snapshot_observed_at":"2026-08-15T15:28:51.190510Z","title":"Self-supervised on-policy distillation for reasoning language models.arXiv preprint arXiv:2605.17497,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.190510Z"},"links":{"cited_paper":"/paper/2605.17497","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:781e852f0262fbba6691de8a2fa98cf2a6c3d80b25eb1160cb202956e087253f","observation_id":"6540a40b-d26b-4072-8a79-239bcd732a00","resolution":{"observed_at":"2026-08-15T15:28:51.190510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14084","last_updated":"2026-05-21T05:36:13Z","snapshot_observed_at":"2026-08-12T12:04:07.125000Z","submitted_at":"2026-04-15T16:58:24Z","title":"TIP: Token Importance in On-Policy Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14084","snapshot_observed_at":"2026-08-15T15:28:51.195902Z","title":"Tip: Token importance in on-policy distillation.arXiv preprint arXiv:2604.14084,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.195902Z"},"links":{"cited_paper":"/paper/2604.14084","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:522248f7131b9a12f83bf6cebfb87a887c389f7780bcd83c68a259ef7ffae414","observation_id":"86885669-370f-46f7-b883-2567c64a1b22","resolution":{"observed_at":"2026-08-15T15:28:51.195902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-15T15:28:51.201570Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.201570Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:749723185e2e5d081aab9fb11076f76e7a068d64073547db0f4066b3f867549e","observation_id":"5f68fc4a-219f-48fb-b8b6-5002e7939969","resolution":{"observed_at":"2026-08-15T15:28:51.201570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12275","last_updated":"2026-03-23T13:11:10Z","snapshot_observed_at":"2026-08-13T16:28:18.700523Z","submitted_at":"2026-02-12T18:58:28Z","title":"On-Policy Context Distillation for Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12275","snapshot_observed_at":"2026-08-15T15:28:51.207619Z","title":"On-policy context distillation for language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.207619Z"},"links":{"cited_paper":"/paper/2602.12275","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:7e950d7d2d3aae615e586df5f4b5d8c3a5eedf79aedef050bd2d830fe11e5772","observation_id":"45848a7e-2e9b-417c-a2a1-81fa19d0af64","resolution":{"observed_at":"2026-08-15T15:28:51.207619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-15T15:28:51.212641Z","title":"Limo: Less is more for reasoning.arXiv preprint arXiv:2502.03387,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.212641Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:e1a49db8263e56e738796b3c8017b685d18fe702f78e762c51b00523e195c840","observation_id":"735ba16e-2ed2-4d84-beca-df252310a15e","resolution":{"observed_at":"2026-08-15T15:28:51.212641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.01732","last_updated":"2026-05-03T06:05:51Z","snapshot_observed_at":"2026-08-11T18:40:54.385799Z","submitted_at":"2026-05-03T06:05:51Z","title":"EGAD: Entropy-Guided Adaptive Distillation for Token-Level Knowledge Transfer","version":1},"cited_work":{"arxiv_id":"2605.01732","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.01732","snapshot_observed_at":"2026-08-15T15:28:51.259814Z","title":"EGAD: Entropy-Guided Adaptive Distillation for Token-Level Knowledge Transfer","venue":"cs.CL","work_id":"2ed6b91c-8f49-4d27-874a-429628db2532","year":2026},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.217571Z"},"links":{"cited_paper":"/paper/2605.01732","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:162665f60d1f6cc06515a5052229469d177d9936b65241b4c4dfaadac9f9ddc5","observation_id":"6f60308c-cc1e-455d-ad7c-61cb58179fa4","resolution":{"observed_at":"2026-08-15T15:28:51.267932Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.28562","last_updated":"2026-06-26T19:41:02Z","snapshot_observed_at":"2026-07-07T00:02:38.226622Z","submitted_at":"2026-06-26T19:41:02Z","title":"SEAD: Competence-Aware On-Policy Distillation via Entropy-Guided Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.28562","snapshot_observed_at":"2026-08-15T15:28:51.153413Z","title":"Sead: Competence-aware on-policy distillation via entropy-guided supervision.arXiv preprint arXiv:2606.28562,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.153413Z"},"links":{"cited_paper":"/paper/2606.28562","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:b05c4144fe9151c2eef81bab2df48b4ddb7eef7b8ab336b14e35859ac0a12282","observation_id":"4180b8c2-f123-4a12-b2a1-dca71221d3da","resolution":{"observed_at":"2026-08-15T15:28:51.153413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04178","last_updated":"2025-06-05T02:21:52Z","snapshot_observed_at":"2026-08-17T02:17:22.510859Z","submitted_at":"2025-06-04T17:25:39Z","title":"OpenThoughts: Data Recipes for Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04178","snapshot_observed_at":"2026-08-15T15:28:51.131158Z","title":"Openthoughts: Data recipes for reasoning models.arXiv preprint arXiv:2506.04178,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.131158Z"},"links":{"cited_paper":"/paper/2506.04178","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:58b35c8f9e503aba8bbe5b590d944d9908423c9d44d8a9b0a611b19af45d71c5","observation_id":"f707849d-c6ca-499c-9eee-76c16781778b","resolution":{"observed_at":"2026-08-15T15:28:51.131158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T15:28:51.136641Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.136641Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:c9ff0e94cc0cdff95e0bd4e4155e03bcd69306ae36e4bc3ef970bd0397f6f50f","observation_id":"86f6cc6a-4fa8-47d6-9272-597112a888be","resolution":{"observed_at":"2026-08-15T15:28:51.136641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22312","last_updated":"2025-05-29T09:07:33Z","snapshot_observed_at":"2026-08-15T23:24:42.542733Z","submitted_at":"2025-05-28T12:56:04Z","title":"Skywork Open Reasoner 1 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22312","snapshot_observed_at":"2026-08-15T15:28:51.141879Z","title":"Skywork open reasoner 1 technical report.arXiv preprint arXiv:2505.22312, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-15T15:28:51.141879Z"},"links":{"cited_paper":"/paper/2505.22312","citing_paper":"/paper/2607.27770"},"observation_digest":"sha256:6ea886b6bf65b0a3ed9b8594f64e2ea54c35d19c1bb8e78889649a7a6997de66","observation_id":"f8f489e9-142f-40e8-93c3-18572dca4c42","resolution":{"observed_at":"2026-08-15T15:28:51.141879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.27770","last_updated":"2026-07-30T07:05:37Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T06:27:36.319289Z","submitted_at":"2026-07-30T07:05:37Z","title":"Beyond the Best Teacher: Expanding and Compressing the Reasoning Solution Manifold"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2607.27770."}