{"as_of":"2026-08-06T07:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d6bd12febe627062361db139e7a7b2fe3e1bca6d7034f634ed1ffd84c5d7245e","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T14:20:37.141500Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T03:39:37.096675Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T10:19:47.040092Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"cited_work":{"arxiv_id":"2605.05940","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.05940","snapshot_observed_at":"2026-07-04T10:19:47.040092Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","venue":"cs.LG","work_id":"480f70cb-9a6d-468f-813c-3743f15502eb","year":2026},"citing_paper":{"arxiv_id":"2606.17199","last_updated":"2026-06-15T18:37:51Z","snapshot_observed_at":"2026-07-06T23:52:47.494791Z","submitted_at":"2026-06-15T18:37:51Z","title":"PowerOPD: Stabilizing On-Policy Distillation with Bounded Power Transformation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-27T03:39:37.096675Z"},"links":{"cited_paper":"/paper/2605.05940","citing_paper":"/paper/2606.17199"},"observation_digest":"sha256:3babe0422bd1324342c7e77266075e12896b1409d3cf3d036e5802364fd9484c","observation_id":"410c8209-94a9-4504-8e22-e2a0808e6a8c","resolution":{"observed_at":"2026-07-03T17:48:46.307858Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"cited_work":{"arxiv_id":"2605.05940","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.05940","snapshot_observed_at":"2026-07-04T10:19:47.040092Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","venue":"cs.LG","work_id":"480f70cb-9a6d-468f-813c-3743f15502eb","year":2026},"citing_paper":{"arxiv_id":"2606.22793","last_updated":"2026-06-22T03:09:21Z","snapshot_observed_at":"2026-07-06T23:57:38.036151Z","submitted_at":"2026-06-22T03:09:21Z","title":"A Formula-Driven Survey and Research Agenda for On-Policy Distillation","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-06-26T09:02:13.340365Z"},"links":{"cited_paper":"/paper/2605.05940","citing_paper":"/paper/2606.22793"},"observation_digest":"sha256:5564887b234c7efc2a587a338475510f020aa147e721a19cc5ec461d0b54daa8","observation_id":"e736c71a-3dfa-40d1-9ae1-407af7ebd8f2","resolution":{"observed_at":"2026-07-04T10:19:47.041368Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.05940/citation-record","integrity":"/paper/2605.05940/integrity","json":"/paper/2605.05940/citation-record.json","paper":"/paper/2605.05940"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:346ac6fae2cd86ffa021f7fa804ef60ae8aac91e551554098bb09addb544006c","observation_id":"4a68abf3-262a-4c50-b57d-f64c0c230539","resolution":{"observed_at":"2026-05-11T18:41:11.055846Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13649","last_updated":"2024-01-17T03:23:23Z","snapshot_observed_at":"2026-08-05T08:59:17.098218Z","submitted_at":"2023-06-23T17:56:26Z","title":"On-Policy Distillation of Language Models: Learning from Self-Generated Mistakes","version":3},"cited_work":{"arxiv_id":"2306.13649","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.13649","snapshot_observed_at":"2026-07-09T21:06:34.855301Z","title":"Yoshua Bengio, Jérôme Louradour, Ronan Collobert, and Jason Weston","venue":"cs.LG","work_id":"78b7a553-fd43-4995-b559-e95779797d3f","year":2023},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2306.13649","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:2a392af1401a6e2329d71a15a51226bbad65e9bd5d6729de73ccdedb68d17a89","observation_id":"71cce084-14e8-4e71-a4de-8afc5e94be4d","resolution":{"observed_at":"2026-05-11T18:41:11.127436Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":"2309.16609","doi":"10.48550/arxiv.2309.16609","metadata_source":"pith","pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen Technical Report","venue":"cs.CL","work_id":"bb1fd52f-6b2f-437c-9516-37bdf6eb9be8","year":2023},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:d0df8641ec91a6d06fa2a778163e9d88a92fd5daa0d44091b39f215346553d0d","observation_id":"48f882a1-0fdf-4e9a-9830-991c1f4fcdcc","resolution":{"observed_at":"2026-05-11T18:41:11.084497Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:15.620681+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:15.620681+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22375","last_updated":"2025-05-29T01:59:00Z","snapshot_observed_at":"2026-08-02T18:20:00.749960Z","submitted_at":"2025-05-28T14:03:02Z","title":"Pangu Embedded: An Efficient Dual-system LLM Reasoner with Metacognition","version":2},"cited_work":{"arxiv_id":"2505.22375","doi":"10.48550/arxiv.2505.22375","metadata_source":"pith","pith_arxiv_id":"2505.22375","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pangu embedded: An efficient dual-system llm reasoner with metacognition","venue":"cs.CL","work_id":"48eb26ab-dce4-4bb6-9a0c-2376e9449315","year":2025},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2505.22375","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:83e1f1ebb5ee9891cc7c4a96d650024983716bcf536e2aad6caaaeb199f60590","observation_id":"ebfcfb0c-5db4-4edf-b438-34c95145772f","resolution":{"observed_at":"2026-05-11T18:41:11.234190Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:de4f9fab28b61c15a95e23ad8ee5cc064620c6e2e445f5f4fdcfd449ce0e087a","observation_id":"389bbd15-3c65-4570-8b76-9ad6092b48a7","resolution":{"observed_at":"2026-05-11T18:41:11.032193Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08543","last_updated":"2026-01-31T09:16:35Z","snapshot_observed_at":"2026-08-02T20:03:32.798288Z","submitted_at":"2023-06-14T14:44:03Z","title":"MiniLLM: On-Policy Distillation of Large Language Models","version":6},"cited_work":{"arxiv_id":"2306.08543","doi":"10.48550/arxiv.2306.08543","metadata_source":"pith","pith_arxiv_id":"2306.08543","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MiniLLM: On-Policy Distillation of Large Language Models","venue":"cs.CL","work_id":"16edb291-dd18-41c5-8486-c6c715ec5311","year":2023},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2306.08543","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:5e5c624917dc39ae5a16aad2fcde1e5325aebff91f218ad31adb88692b5542d7","observation_id":"f967d690-a3f0-4af2-bfbc-5849b5abb4fc","resolution":{"observed_at":"2026-05-12T17:40:27.990750Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":"2103.03874","doi":"10.48550/arxiv.2103.03874","metadata_source":"pith","pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","venue":"cs.LG","work_id":"50652ac6-fb7c-4675-a2c2-159c241feb17","year":2021},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:07d2913e960289baa54a2bf405f5c13a355dc2e2d325040f1a1063bb5c94d137","observation_id":"8298ea37-677e-49ac-958b-4b81470adfa0","resolution":{"observed_at":"2026-05-11T18:41:11.077759Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":"1503.02531","doi":"10.1109/cvpr52733.2024.01515","metadata_source":"pith","pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distilling the Knowledge in a Neural Network","venue":"stat.ML","work_id":"d927ab1f-17b8-4002-9d09-c3d55764fbad","year":2015},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:8acff2c4c1e3d42ba2ac378d364f80534ae3e0d25eb9ffbf5527ad8980fa2ae1","observation_id":"b810ca00-7290-4472-a8b8-5246337bf24e","resolution":{"observed_at":"2026-05-11T18:41:11.100735Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08322","last_updated":"2023-11-06T13:24:16Z","snapshot_observed_at":"2026-08-03T16:27:29.675478Z","submitted_at":"2023-05-15T03:20:19Z","title":"C-Eval: A Multi-Level Multi-Discipline Chinese Evaluation Suite for Foundation Models","version":3},"cited_work":{"arxiv_id":"2305.08322","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.08322","snapshot_observed_at":"2026-07-03T20:48:56.200978Z","title":"C-eval: A multi-level multi-discipline chinese evaluation suite for foundation models","venue":null,"work_id":"61dc95c3-d071-4ec6-9d31-ea0610192fde","year":2023},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2305.08322","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:1390ed5cc78877e0fb461d7e93d37bdbc924239a33c6e0570fe261f8450a0504","observation_id":"57e78f15-793d-48d3-b860-f7baa8f580d3","resolution":{"observed_at":"2026-05-11T18:41:11.218058Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.07947","last_updated":"2016-09-22T01:17:12Z","snapshot_observed_at":"2026-07-06T05:01:17.743844Z","submitted_at":"2016-06-25T18:16:39Z","title":"Sequence-Level Knowledge Distillation","version":4},"cited_work":{"arxiv_id":"1606.07947","doi":null,"metadata_source":"pith","pith_arxiv_id":"1606.07947","snapshot_observed_at":"2026-07-04T17:40:00.736680Z","title":"Sequence-Level Knowledge Distillation","venue":"cs.CL","work_id":"81f47e08-b2fa-4722-9fab-dd97260b9002","year":2016},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/1606.07947","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:2a909810a4b08afd7898d584249a6f7ee16c65f7054ae2dc75c489f020c3005e","observation_id":"2ed7d323-8883-457c-bb11-f5564a89be6f","resolution":{"observed_at":"2026-05-11T18:41:11.201966Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03898","last_updated":"2024-07-03T04:57:41Z","snapshot_observed_at":"2026-08-05T01:48:55.895470Z","submitted_at":"2024-02-06T11:10:35Z","title":"DistiLLM: Towards Streamlined Distillation for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.03898","doi":"10.48550/arxiv.2402.03898","metadata_source":"pith","pith_arxiv_id":"2402.03898","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distillm: Towards streamlined distillation for large language models.ArXiv, abs/2402.03898","venue":"cs.CL","work_id":"aebc3613-3aa4-4807-b7a7-c7496f1d7f34","year":2024},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2402.03898","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:2786dc29c052984ee4e73d1c93d2cc6da4d5f37bea030cbaf5a0ed76347c0fc3","observation_id":"22128e69-fbca-4a4d-9f98-4c8ee4151840","resolution":{"observed_at":"2026-05-11T18:41:11.258763Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07067","last_updated":"2025-05-30T04:41:12Z","snapshot_observed_at":"2026-07-06T20:49:41.870804Z","submitted_at":"2025-03-10T08:51:32Z","title":"DistiLLM-2: A Contrastive Approach Boosts the Distillation of LLMs","version":2},"cited_work":{"arxiv_id":"2503.07067","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.07067","snapshot_observed_at":"2026-07-10T10:37:01.562752Z","title":"Distillm-2: A contrastive approach boosts the distillation of llms","venue":"cs.CL","work_id":"ade2b501-2ca3-4825-9150-d23205f4edb9","year":2025},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2503.07067","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:73273c6ba0e00852f002540ddcb370c3d4c36cba7d0ef2e764b286c98e1f5a7e","observation_id":"a62b92f5-bb23-42e8-97cb-dfd7691ebed1","resolution":{"observed_at":"2026-05-11T18:41:11.069374Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From quantity to quality: Boosting llm performance with self-guided data selection for instruction tuning","venue":null,"work_id":"6dd32f47-dcfa-4936-8863-f75c6d55383f","year":2024},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:a75b59546de99d08d9e2de4457f6a28668ef9d7d811cf664ee7f637a030c8777","observation_id":"c6133a74-2fe5-44c3-b5f6-4afe2a796849","resolution":{"observed_at":"2026-05-26T11:37:38.352945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:44af4a558fafc363dd241ed5af7625fe2ae596fbf3def325c930bc74b48d54d8","observation_id":"04d17247-3b63-42d5-ab12-c97459153abf","resolution":{"observed_at":"2026-05-11T18:41:11.177765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-03T03:32:02.223426Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":"1910.01108","doi":"10.48550/arxiv.1910.01108","metadata_source":"pith","pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-07-11T02:57:46.620845Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","venue":"cs.CL","work_id":"756f9764-ecd6-4672-8043-b37c698c7ad2","year":2019},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:972d291fb0f7d78200bfd602b41e6531332ba9a5036ba5c80f55ce778d1f9994","observation_id":"fa6fe405-048c-4608-b5a5-17128dddb162","resolution":{"observed_at":"2026-05-11T18:41:11.049615Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04519","last_updated":"2025-05-07T15:46:36Z","snapshot_observed_at":"2026-07-06T21:20:22.224369Z","submitted_at":"2025-05-07T15:46:36Z","title":"Pangu Ultra MoE: How to Train Your Big MoE on Ascend NPUs","version":1},"cited_work":{"arxiv_id":"2505.04519","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.04519","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pangu ultra moe: How to train your big moe on ascend npus","venue":null,"work_id":"9788a94c-dbd8-409b-aec6-f546e80e0220","year":2025},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2505.04519","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:790b4c66511eeb7076be004dd9c875494ebf78b75d206aebf45131ae98b6d3e3","observation_id":"3bb9c390-7dee-40a2-991c-7c9e03ba1aab","resolution":{"observed_at":"2026-05-11T18:41:11.017629Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:b85eab0d60d4f954c4c8bbcf26865736d965e3023f15f976ab731aa35d9d752c","observation_id":"6a589774-f9bc-451f-a4b1-99a1b0f8539f","resolution":{"observed_at":"2026-05-11T18:41:11.240651Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-01T11:08:05.851253+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T11:08:05.851253+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05986","last_updated":"2020-11-05T14:46:45Z","snapshot_observed_at":"2026-07-06T09:11:58.924192Z","submitted_at":"2020-04-13T15:02:29Z","title":"CLUE: A Chinese Language Understanding Evaluation Benchmark","version":3},"cited_work":{"arxiv_id":"2004.05986","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.05986","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clue: A chinese language understanding evaluation benchmark","venue":null,"work_id":"261c4173-b7f2-48a8-a14b-731445c995be","year":2004},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2004.05986","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:8c9a19e61e4817ac6fbd05a6b2c2e8e498ea5bbc702791c6d9544e6fcc6e2fcb","observation_id":"80367539-ffd1-40c8-9ddd-e2661cd12d81","resolution":{"observed_at":"2026-05-11T18:41:11.208726Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":"2409.12122","doi":"10.18653/v1/2025.emnlp-main.712","metadata_source":"pith","pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","venue":"cs.CL","work_id":"a097c5d4-6d32-46ee-9826-57d532bbfc9c","year":2024},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:98101dd91ead6399e18604fe71ccd8f373458acb9bbc6baf515cee360dac00c0","observation_id":"82c9ead3-d731-4da1-ba04-ebee15001603","resolution":{"observed_at":"2026-05-11T18:41:11.023292Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:92486e22406b7dd7e66f7ee459d4412a96502b2f4036efc603245eff34760034","observation_id":"6d3c7e77-111a-4434-9631-0d041a9e2854","resolution":{"observed_at":"2026-05-11T18:41:11.037923Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-02T15:00:50.388422Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.12284","doi":"10.48550/arxiv.2309.12284","metadata_source":"pith","pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","venue":"cs.CL","work_id":"e791a2f0-3b75-4c5b-84e1-d297d96e42f0","year":2023},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:57a34c60b011727de68ab9b5dc04f831416d2839f73bc29636f18bdca3b78e0e","observation_id":"d3d5bb8c-4047-459c-a3ea-0b39b7b2996e","resolution":{"observed_at":"2026-05-13T10:07:53.977132Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":"2311.07911","doi":"10.48550/arxiv.2311.07911","metadata_source":"pith","pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Instruction-Following Evaluation for Large Language Models","venue":"cs.CL","work_id":"3aa06177-125a-4f5a-8f4a-8070c5986c26","year":2023},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:4a093b53348c3dae368a52cdb135a0fb3f858de43ff9992bc7bbabd66ebe055f","observation_id":"aac6be0d-8f9b-4d5e-8126-adb04a1473a8","resolution":{"observed_at":"2026-05-11T18:41:11.167537Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4355.2954","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The evaluation metric is the average zero-shot accuracy across eight benchmarks","venue":null,"work_id":"bfc408b4-8e29-4add-bf8e-b07afc2c71b8","year":null},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:bce1b665fe2bceb4631a9f668277c55e9c65513e557427be38a4a5f7167599e1","observation_id":"208c8945-ed74-4fe3-a32a-4f01e1e19a24","resolution":{"observed_at":"2026-05-11T18:41:11.280183Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7855.2954","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"generate-then-filter","venue":null,"work_id":"a4dad109-867a-43ed-8c83-7f707692f5e2","year":null},"citing_paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T14:20:37.141500Z"},"links":{"citing_paper":"/paper/2605.05940"},"observation_digest":"sha256:e509e31d9d168f4066198a59daf0c27eaa570948baccd235058caea373f10375","observation_id":"7e83f3f4-347b-44eb-82f8-b081d78f088b","resolution":{"observed_at":"2026-05-11T18:41:11.158094Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.05940","last_updated":"2026-05-07T09:50:53Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-03T03:51:16.123756Z","submitted_at":"2026-05-07T09:50:53Z","title":"Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":0,"verified_exact":17,"verified_fuzzy":1},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 2 inbound Pith citation observations for arXiv:2605.05940."}