{"as_of":"2026-08-16T01:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a76ff5e6dc7ee94a31d0ff678053a09676cf118b0bd5f8155418408c29d1543c","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T09:22:00.584270Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18293/citation-record","integrity":"/paper/2607.18293/integrity","json":"/paper/2607.18293/citation-record.json","paper":"/paper/2607.18293"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:21:59.329335Z","title":"Proceedings of the 2022 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T09:21:59.329335Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:219c5ca50c0391fe1f9334233c002151d98270d88c1d019721972bec02b8dcdc","observation_id":"5d6527be-7058-451f-bf18-1260df82d2d8","resolution":{"observed_at":"2026-08-02T09:21:59.329335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:21:59.346711Z","title":", author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T09:21:59.346711Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:2614842cde2fd03104202af313950773e239f711c2871549e3574b1bdd472f72","observation_id":"666afcf8-f5e4-4919-ad79-53171ea3da2d","resolution":{"observed_at":"2026-08-02T09:21:59.346711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:21:59.365668Z","title":"Proceedings of the 2021 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T09:21:59.365668Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:f95b602199e666a88d4ffbf9b411d23333c92bdf4fd851a60f17ee2393c49249","observation_id":"b7e9b59d-c9b0-4af4-9e3c-b6156f515e8f","resolution":{"observed_at":"2026-08-02T09:21:59.365668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:21:59.479962Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T09:21:59.479962Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:37976b546e6679bfba9e28e0341bdb28ec64c70072480b33d71db8db5e94ff25","observation_id":"faafd262-c1e9-4dd0-bbae-d969db792e22","resolution":{"observed_at":"2026-08-02T09:21:59.479962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-02T09:21:59.595482Z","title":"arXiv preprint arXiv:2505.09388 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T09:21:59.595482Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:a88a33ad1eb888a22545af786407d9865168c5d6cd5097d20b0c5e9e71a5e7f1","observation_id":"b23258f8-4365-4edb-907d-44d34fb4a492","resolution":{"observed_at":"2026-08-02T09:21:59.595482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:21:59.756000Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T09:21:59.756000Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:f90a61b1ca2ba4459b08413612396d30e731d532295394556675a0f2347c5422","observation_id":"fd2c056c-71b6-4164-9f80-fe8863a9e097","resolution":{"observed_at":"2026-08-02T09:21:59.756000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02780","last_updated":"2026-01-08T05:52:17Z","snapshot_observed_at":"2026-08-14T07:48:23.313445Z","submitted_at":"2026-01-06T07:31:47Z","title":"MiMo-V2-Flash Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.02780","snapshot_observed_at":"2026-08-02T09:21:59.882469Z","title":"arXiv preprint arXiv:2601.02780 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T09:21:59.882469Z"},"links":{"cited_paper":"/paper/2601.02780","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:e5ee34f784fd933d136c1e292ee27ed9f888dc9b13e26a01a0b18cd036fda59e","observation_id":"af44fc0c-f2c5-4d77-85b4-0eebe05644f9","resolution":{"observed_at":"2026-08-02T09:21:59.882469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:21:59.992576Z","title":"Findings of the Association for Computational Linguistics: ACL 2022 , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T09:21:59.992576Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:3ceed4c02c8f1011793f9a1cd4593cf0a7925136e0b1cf05488d9e1f47e83c89","observation_id":"dc44e849-c1c6-4547-8032-e9cb53e70490","resolution":{"observed_at":"2026-08-02T09:21:59.992576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.19897","last_updated":"2026-08-07T16:19:50Z","snapshot_observed_at":"2026-08-15T04:42:50.651833Z","submitted_at":"2026-01-27T18:59:08Z","title":"Self-Distillation Enables Continual Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.19897","snapshot_observed_at":"2026-08-02T09:22:00.103945Z","title":"arXiv preprint arXiv:2601.19897 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.103945Z"},"links":{"cited_paper":"/paper/2601.19897","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:4e0cf163fdff97ce0928f0bdeabd527f1e9f2993260b9ad9d3540d7f704bd4b1","observation_id":"29e13708-2f63-4712-99e2-8951a75b36a9","resolution":{"observed_at":"2026-08-02T09:22:00.103945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18734","last_updated":"2026-03-20T15:40:19Z","snapshot_observed_at":"2026-08-13T14:47:47.249767Z","submitted_at":"2026-01-26T17:56:50Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.18734","snapshot_observed_at":"2026-08-02T09:22:00.263016Z","title":"arXiv preprint arXiv:2601.18734 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.263016Z"},"links":{"cited_paper":"/paper/2601.18734","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:260d79463d857f6aabd9b085a14ac323d68b3642a502ec9089e97107ea29c705","observation_id":"8d385f87-494e-4c63-a172-376c5fd9d899","resolution":{"observed_at":"2026-08-02T09:22:00.263016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27083","last_updated":"2026-04-29T18:24:11Z","snapshot_observed_at":"2026-07-06T23:12:38.453388Z","submitted_at":"2026-04-29T18:24:11Z","title":"Co-Evolving Policy Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27083","snapshot_observed_at":"2026-08-02T09:22:00.429032Z","title":"arXiv preprint arXiv:2604.27083 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.429032Z"},"links":{"cited_paper":"/paper/2604.27083","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:485c57fd8ee1fafb201578d0ed84eda6007c356f54e31baf1825cec316a112ad","observation_id":"3656d4ee-f64a-4165-8acb-db56adb90fbf","resolution":{"observed_at":"2026-08-02T09:22:00.429032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20802","last_updated":"2026-02-16T14:49:34Z","snapshot_observed_at":"2026-08-13T15:28:29.238641Z","submitted_at":"2026-01-28T17:45:12Z","title":"Reinforcement Learning via Self-Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.20802","snapshot_observed_at":"2026-08-02T09:22:00.507315Z","title":"arXiv preprint arXiv:2601.20802 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.507315Z"},"links":{"cited_paper":"/paper/2601.20802","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:abc4c34867b1abf3d92bd58bfbb20badb8c39c8cac3ed9d8ab076780e873e009","observation_id":"0ff63415-9aab-4989-98bb-68076a89b753","resolution":{"observed_at":"2026-08-02T09:22:00.507315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.510268Z","title":"Proceedings of the national academy of sciences , volume=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.510268Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:afd17a3fc5216671ee0b73aff00e814e9b6653340d1f3e63432c708229aa4e41","observation_id":"674b9971-e544-452d-824f-cfaa61ae0d3c","resolution":{"observed_at":"2026-08-02T09:22:00.510268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.512933Z","title":"IEEE Transactions on Audio, Speech and Language Processing , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.512933Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:19520be66bdee668e3669cd2b16a4adf418970c6a775ef5cbf7236c63a0702d9","observation_id":"394ac657-5194-402a-860c-8e1ed870b778","resolution":{"observed_at":"2026-08-02T09:22:00.512933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-13T00:06:55.915196Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-02T09:22:00.516068Z","title":"arXiv preprint arXiv:2405.09673 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.516068Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:ae0376df5a99d147de3b39967c22390a0c98f1b9e5fe3ea4ba0e0915a874ea7c","observation_id":"fdec435e-912a-441e-a1e1-44583e708703","resolution":{"observed_at":"2026-08-02T09:22:00.516068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05605","last_updated":"2024-01-11T00:44:25Z","snapshot_observed_at":"2026-08-14T17:43:15.151937Z","submitted_at":"2024-01-11T00:44:25Z","title":"Scaling Laws for Forgetting When Fine-Tuning Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05605","snapshot_observed_at":"2026-08-02T09:22:00.518886Z","title":"arXiv preprint arXiv:2401.05605 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.518886Z"},"links":{"cited_paper":"/paper/2401.05605","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:865d9128585255bfb991034979f273bc88e1206c806a24b7451567785d144437","observation_id":"74f0b9a1-2e19-43b5-8c2e-bdbb907f7718","resolution":{"observed_at":"2026-08-02T09:22:00.518886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.521584Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.521584Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:3f714aecd2a2fb4fd9048e654f4b598cfaafee972145c003b3e99ddc38681bcc","observation_id":"ae247f6f-84e8-4a3c-88a1-72b8d810c188","resolution":{"observed_at":"2026-08-02T09:22:00.521584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.524595Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.524595Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:9cffb2014fc170c73e9f381496a6a3628ad4b9112e08107d5390eb212c967d1a","observation_id":"05773675-7c46-488d-9a6f-c6ee248c0e7d","resolution":{"observed_at":"2026-08-02T09:22:00.524595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.527465Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.527465Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:42d2088d2d4ea79868c17d9bbef0a7577e5e95594aff5412f71286f7d0b014e8","observation_id":"fb0f1363-0b1f-4f13-81b7-82b92c75598e","resolution":{"observed_at":"2026-08-02T09:22:00.527465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.00088","last_updated":"2026-01-07T09:09:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-30T01:25:34Z","title":"Alpamayo-R1: Bridging Reasoning and Action Prediction for Generalizable Autonomous Driving in the Long Tail","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.00088","snapshot_observed_at":"2026-08-02T09:22:00.530054Z","title":"arXiv preprint arXiv:2511.00088 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.530054Z"},"links":{"cited_paper":"/paper/2511.00088","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:33d0f3a64e71ce6656b579a7306f72af17baaed9a6eae2b05ec394afa9454a05","observation_id":"795535b6-98c3-4087-b408-58880b739501","resolution":{"observed_at":"2026-08-02T09:22:00.530054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13016","last_updated":"2026-04-15T17:48:51Z","snapshot_observed_at":"2026-08-16T00:27:04.851196Z","submitted_at":"2026-04-14T17:54:28Z","title":"Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.13016","snapshot_observed_at":"2026-08-02T09:22:00.532674Z","title":"arXiv preprint arXiv:2604.13016 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.532674Z"},"links":{"cited_paper":"/paper/2604.13016","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:91b2dcb3197cf9731e9a34828c13866c8886a2def088b19a18daaa1c0b4eafb9","observation_id":"7f2c1ea6-5f7d-4eae-aaa8-7fb0c929c5e4","resolution":{"observed_at":"2026-08-02T09:22:00.532674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.535283Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.535283Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:c81dda3c41f23f1716d2dcdb9e0f99965af44c07dc012704d4ae84afdd7be5f0","observation_id":"322fda7e-ed7e-4c33-b612-50330a64d08d","resolution":{"observed_at":"2026-08-02T09:22:00.535283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.537923Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.537923Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:37aa160e19624853abc3134025dec9e6e66be41a779e7b02edc1a684268c2a8e","observation_id":"a4ffee76-8380-40ce-89ca-fed197ca2bdc","resolution":{"observed_at":"2026-08-02T09:22:00.537923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08679","last_updated":"2026-06-16T17:36:22Z","snapshot_observed_at":"2026-08-14T07:47:45.666218Z","submitted_at":"2025-03-11T17:56:30Z","title":"Chain-of-Thought Reasoning In The Wild Is Not Always Faithful","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08679","snapshot_observed_at":"2026-08-02T09:22:00.540306Z","title":"arXiv preprint arXiv:2503.08679 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.540306Z"},"links":{"cited_paper":"/paper/2503.08679","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:fac5aba2ba30cafde55f26bfbb71d1ad78a827401c3d8e6272483d6248baba94","observation_id":"7de66025-d265-4f54-b74a-364463398050","resolution":{"observed_at":"2026-08-02T09:22:00.540306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-02T09:22:00.542871Z","title":"arXiv preprint arXiv:2103.03874 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.542871Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:cd7fe18c53b5306334e9adc4ddfa9adb43222a70634a3e5b4ea18d9a84412c4d","observation_id":"71903882-4ac3-4067-a6d8-efe9cc42d2fa","resolution":{"observed_at":"2026-08-02T09:22:00.542871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.546537Z","title":"Proceedings of the 31st International Conference on Computational Linguistics , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.546537Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:c8b7ec5fc0a4255c7a04b404068495fba92f7fa80f57e2b63097cf6d54416f1d","observation_id":"7db7a4e3-cfae-477e-a3a3-5ea7539c1d39","resolution":{"observed_at":"2026-08-02T09:22:00.546537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-14T03:45:52.225630Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-02T09:22:00.549141Z","title":"arXiv preprint arXiv:2412.08905 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.549141Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:67eee30e9d866dd22a5db847684d8b0818fd6cd248ab9a3141d11f6753ca5f6b","observation_id":"a0968e6e-945d-4a52-802a-aca744962e20","resolution":{"observed_at":"2026-08-02T09:22:00.549141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.551981Z","title":"Proceedings of the 29th symposium on operating systems principles , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.551981Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:635cbcdc398ada45e33508badd2997570e5e793f0f628373822f4dc82d7c4954","observation_id":"635213e9-6961-4265-b34c-15bb761409b1","resolution":{"observed_at":"2026-08-02T09:22:00.551981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.554597Z","title":"arXiv preprint arXiv:2406.09098 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.554597Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:5c3fef7f9e79054a56fce3c728f2d097adf239891b5f62852c71cb0a9aa688e7","observation_id":"928e8c3e-ec6a-4733-bba1-43e453b8c873","resolution":{"observed_at":"2026-08-02T09:22:00.554597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.557503Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.557503Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:7dc4759a314d4294186dbeea4a957a2791023ac68e3c4ae436c31da93827cba1","observation_id":"002424e9-344f-4948-8ee1-8d4e409da8a1","resolution":{"observed_at":"2026-08-02T09:22:00.557503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.560282Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.560282Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:aa135393bad34a494b53692d3e50a2173d90c7c6660e9e665231f02cd4891840","observation_id":"a576194f-2f4c-42d6-8ca3-4381bc85eead","resolution":{"observed_at":"2026-08-02T09:22:00.560282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.562732Z","title":"Proceedings of the 57th annual meeting of the association for computational linguistics , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.562732Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:9acebdbb11e8a66f38615387d2c069a669dd2a0c0fe96623842586024397f46c","observation_id":"44ab12be-ede7-4b3b-9e81-2738534f6b44","resolution":{"observed_at":"2026-08-02T09:22:00.562732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.565452Z","title":"Proceedings of the 60th annual meeting of the association for computational linguistics (volume 1: long papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.565452Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:0a8893d8f82222ca40be1823135e0100eb2616c51d3fa55302e5e6b98fcf791a","observation_id":"dd650898-6f08-4d58-a345-851c42bde498","resolution":{"observed_at":"2026-08-02T09:22:00.565452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.568176Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.568176Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:6f47712046f88fd0f9bd132e0d3dac07f73d7f6eb9fefe27838064f4045f688e","observation_id":"a3d462d6-7be5-443c-a301-f9863d3d8ebc","resolution":{"observed_at":"2026-08-02T09:22:00.568176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.570763Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.570763Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:8097a83b69ceec10947dc40426c505b5448306c201b5431af502b038593b4590","observation_id":"58e3dc0d-f8b8-4158-bb0d-4cbb1672e4b1","resolution":{"observed_at":"2026-08-02T09:22:00.570763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.573784Z","title":"Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.573784Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:bccf43225fc7e605c693df976f1bc25b88c4b656f2d0033137b36d827778a769","observation_id":"466d036e-f686-49ad-9a86-31ef5bb3e5fc","resolution":{"observed_at":"2026-08-02T09:22:00.573784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.576312Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.576312Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:5d63335b2270afffa14918ae9b944418a816fc780b035f291171f9ac0784363f","observation_id":"6f309fb2-1d48-49bf-a5f0-25e401953a34","resolution":{"observed_at":"2026-08-02T09:22:00.576312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.579259Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.579259Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:513681c0b88c59de3be5cb0cc36c4b170bb1ec6e78680eef1ee3cd1ab35167c1","observation_id":"f93cfc4a-e7f8-4797-8bd8-73e25f69f89f","resolution":{"observed_at":"2026-08-02T09:22:00.579259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-02T09:22:00.581617Z","title":"arXiv preprint arXiv:2402.03300 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.581617Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:bf11bdd3185086f1e65883b153b3fe328b3a1cd355413d995a018c15c2b5e83b","observation_id":"a1ed95e0-7223-4a9b-bd00-e20c3c81533b","resolution":{"observed_at":"2026-08-02T09:22:00.581617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T09:22:00.584270Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.584270Z"},"links":{"citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:36c8e42e50a841502bed1ea04166e71303b8416a9017d53b30812b52f0a95365","observation_id":"0c945f74-efb1-432c-8fbf-2f1fd95166d2","resolution":{"observed_at":"2026-08-02T09:22:00.584270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T07:48:29.945579Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2607.18293."}