{"as_of":"2026-08-13T00:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8ea67e4c38a90d9f5f976700ed17d7f0fc227cf5c45ce9b2a9bc37876c66feed","coverage":[{"denominator":6,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T17:29:50.136131Z","state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T04:31:28.340096Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.27115","last_updated":"2026-05-26T14:52:51Z","snapshot_observed_at":"2026-08-05T07:26:13.507498Z","submitted_at":"2026-05-26T14:52:51Z","title":"Counteraction-Aware Multi-Teacher On-Policy Distillation for General Capability Recovery with Domain Preservation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27115","snapshot_observed_at":"2026-08-02T08:11:30.065010Z","title":"Counteraction-aware multi-teacher On-Policy distillation for general capability recovery with domain preservation.arXiv preprint arXiv:2605.27115, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.07050","last_updated":"2026-08-02T05:11:29Z","snapshot_observed_at":"2026-08-06T23:24:47.535990Z","submitted_at":"2026-07-08T06:26:13Z","title":"When Top-K Misses the Decision: Tool-Call Drift in Multi-Teacher On-Policy Distillation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T08:11:30.065010Z"},"links":{"cited_paper":"/paper/2605.27115","citing_paper":"/paper/2607.07050"},"observation_digest":"sha256:88db1d900646570b84b936e4be27c4b08a31910da5a4d3c07eaaf2e711b69101","observation_id":"cc1d4db0-4509-4e28-ba24-af488945fb73","resolution":{"observed_at":"2026-08-02T08:11:30.065010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.27115","last_updated":"2026-05-26T14:52:51Z","snapshot_observed_at":"2026-08-05T07:26:13.507498Z","submitted_at":"2026-05-26T14:52:51Z","title":"Counteraction-Aware Multi-Teacher On-Policy Distillation for General Capability Recovery with Domain Preservation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27115","snapshot_observed_at":"2026-08-04T04:31:28.340096Z","title":"Counteraction-aware multi-teacher On-Policy distillation for general capability recovery with domain preservation.arXiv preprint arXiv:2605.27115, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.07050","last_updated":"2026-08-02T05:11:29Z","snapshot_observed_at":"2026-08-06T23:24:47.535990Z","submitted_at":"2026-07-08T06:26:13Z","title":"When Top-K Misses the Decision: Tool-Call Drift in Multi-Teacher On-Policy Distillation","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T04:31:28.340096Z"},"links":{"cited_paper":"/paper/2605.27115","citing_paper":"/paper/2607.07050"},"observation_digest":"sha256:ceef385512ae025003ab8039dc3655a678de0ea52497cef7642becd783d26c9a","observation_id":"ddd895a1-f81a-43d0-9e53-8c905e92ade4","resolution":{"observed_at":"2026-08-04T04:31:28.340096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.27115","last_updated":"2026-05-26T14:52:51Z","snapshot_observed_at":"2026-08-05T07:26:13.507498Z","submitted_at":"2026-05-26T14:52:51Z","title":"Counteraction-Aware Multi-Teacher On-Policy Distillation for General Capability Recovery with Domain Preservation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27115","snapshot_observed_at":"2026-08-01T00:26:20.783962Z","title":"arXiv preprint arXiv:2605.27115 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26246","last_updated":"2026-07-28T20:31:48Z","snapshot_observed_at":"2026-08-12T12:03:15.179459Z","submitted_at":"2026-07-28T20:31:48Z","title":"Weak-to-Strong On-Policy Distillation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T00:26:20.783962Z"},"links":{"cited_paper":"/paper/2605.27115","citing_paper":"/paper/2607.26246"},"observation_digest":"sha256:0ef40e0da37ddd78f23ba1589fc49595b57315af0053c2f4f5e8bd71eb61b707","observation_id":"2b7daaf2-3ecf-42ef-a436-68fdfaad4df4","resolution":{"observed_at":"2026-08-01T00:26:20.783962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.27115/citation-record","integrity":"/paper/2605.27115/integrity","json":"/paper/2605.27115/citation-record.json","paper":"/paper/2605.27115"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.18925","last_updated":"2024-12-25T15:12:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-25T15:12:34Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","version":1},"cited_work":{"arxiv_id":"2412.18925","doi":"10.48550/arxiv.2412.18925","metadata_source":"pith","pith_arxiv_id":"2412.18925","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","venue":"cs.CL","work_id":"56766c95-7f7b-4db7-8563-f6df210ecdd1","year":2024},"citing_paper":{"arxiv_id":"2605.27115","last_updated":"2026-05-26T14:52:51Z","snapshot_observed_at":"2026-08-05T07:26:13.507498Z","submitted_at":"2026-05-26T14:52:51Z","title":"Counteraction-Aware Multi-Teacher On-Policy Distillation for General Capability Recovery with Domain Preservation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T17:29:50.136131Z"},"links":{"cited_paper":"/paper/2412.18925","citing_paper":"/paper/2605.27115"},"observation_digest":"sha256:52d061c37ca7039553c0d9b8d221e5971c6678b01ff6bc822e8a059aa16d4552","observation_id":"b27c4f44-dbe2-4b0f-850a-81efc0b0fc83","resolution":{"observed_at":"2026-06-29T17:33:45.190978Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.25562","last_updated":"2026-04-27T06:21:52Z","snapshot_observed_at":"2026-08-12T14:24:19.099654Z","submitted_at":"2026-03-26T15:35:59Z","title":"Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes","version":2},"cited_work":{"arxiv_id":"2603.25562","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.25562","snapshot_observed_at":"2026-07-07T12:33:45.227324Z","title":"Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes","venue":"cs.LG","work_id":"8e059321-d6e4-4359-89eb-83ecbb93b657","year":2026},"citing_paper":{"arxiv_id":"2605.27115","last_updated":"2026-05-26T14:52:51Z","snapshot_observed_at":"2026-08-05T07:26:13.507498Z","submitted_at":"2026-05-26T14:52:51Z","title":"Counteraction-Aware Multi-Teacher On-Policy Distillation for General Capability Recovery with Domain Preservation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T17:29:50.136131Z"},"links":{"cited_paper":"/paper/2603.25562","citing_paper":"/paper/2605.27115"},"observation_digest":"sha256:84b9154885f060f7f38001e3c7c8d7dac9483bd68eb54982b552d03f2ea7640d","observation_id":"2d7f5ccd-7337-4ca4-80fe-07238cf8d8df","resolution":{"observed_at":"2026-06-29T17:33:45.203772Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13016","last_updated":"2026-04-15T17:48:51Z","snapshot_observed_at":"2026-08-12T11:04:06.923686Z","submitted_at":"2026-04-14T17:54:28Z","title":"Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe","version":2},"cited_work":{"arxiv_id":"2604.13016","doi":"10.48550/arxiv.2604.13016","metadata_source":"pith","pith_arxiv_id":"2604.13016","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe","venue":"cs.LG","work_id":"42b43df0-4c82-493f-9d9b-1be8c116d9af","year":2026},"citing_paper":{"arxiv_id":"2605.27115","last_updated":"2026-05-26T14:52:51Z","snapshot_observed_at":"2026-08-05T07:26:13.507498Z","submitted_at":"2026-05-26T14:52:51Z","title":"Counteraction-Aware Multi-Teacher On-Policy Distillation for General Capability Recovery with Domain Preservation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T17:29:50.136131Z"},"links":{"cited_paper":"/paper/2604.13016","citing_paper":"/paper/2605.27115"},"observation_digest":"sha256:ca8e9cb4918b7cee9b538a96d0019da23bd5f4dbe5d4546e089c57ae349cbb8e","observation_id":"ba982bb4-1447-48d4-83c9-3cb8eb4d2aea","resolution":{"observed_at":"2026-06-29T17:33:45.193346Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-07T20:38:24.605597+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T20:38:24.605597+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.11615","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:59:42.589322Z","title":"LLM-oriented token-adaptive knowledge distillation, 2025","venue":null,"work_id":"9158769c-f4f1-47f3-b312-16f63a4ac342","year":2025},"citing_paper":{"arxiv_id":"2605.27115","last_updated":"2026-05-26T14:52:51Z","snapshot_observed_at":"2026-08-05T07:26:13.507498Z","submitted_at":"2026-05-26T14:52:51Z","title":"Counteraction-Aware Multi-Teacher On-Policy Distillation for General Capability Recovery with Domain Preservation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T17:29:50.136131Z"},"links":{"citing_paper":"/paper/2605.27115"},"observation_digest":"sha256:68a22746e40fc5b927ec21a5e662c9cbc9f099f547023731dcca955e383e87e9","observation_id":"50ef33b8-fa69-4bcb-8aa3-9a504b434f0b","resolution":{"observed_at":"2026-06-29T17:33:45.200256Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.19220","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T11:45:46.868153Z","title":"Nemotron-cascade 2: Post-training LLMs with cascade RL and multi-domain on-policy distillation","venue":null,"work_id":"5f8ea875-b88d-48f2-a052-33fb550d5e54","year":2026},"citing_paper":{"arxiv_id":"2605.27115","last_updated":"2026-05-26T14:52:51Z","snapshot_observed_at":"2026-08-05T07:26:13.507498Z","submitted_at":"2026-05-26T14:52:51Z","title":"Counteraction-Aware Multi-Teacher On-Policy Distillation for General Capability Recovery with Domain Preservation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T17:29:50.136131Z"},"links":{"citing_paper":"/paper/2605.27115"},"observation_digest":"sha256:61139dff33d1c2d25642872fabdb8874649aa64f969d5a27e696059e63e22c62","observation_id":"0787e20f-e4d5-47ae-8c24-8655d9758c2c","resolution":{"observed_at":"2026-06-29T17:33:45.195784Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6262.6360","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T17:33:45.196201Z","title":"We use the GBaker/MedQA-USMLE-4-options test split, which contains 1,273 examples in the local cache","venue":null,"work_id":"7da32cd2-8e11-4e1f-9274-b9b8233495c2","year":2027},"citing_paper":{"arxiv_id":"2605.27115","last_updated":"2026-05-26T14:52:51Z","snapshot_observed_at":"2026-08-05T07:26:13.507498Z","submitted_at":"2026-05-26T14:52:51Z","title":"Counteraction-Aware Multi-Teacher On-Policy Distillation for General Capability Recovery with Domain Preservation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T17:29:50.136131Z"},"links":{"citing_paper":"/paper/2605.27115"},"observation_digest":"sha256:bd4bd7cdb31d05afbe67f1960f419ce7739fb14281266f84fae22025960b1f13","observation_id":"8397e0e3-76c7-4040-bf33-19cf77d590f7","resolution":{"observed_at":"2026-06-29T17:33:45.197720Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.27115","last_updated":"2026-05-26T14:52:51Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-05T07:26:13.507498Z","submitted_at":"2026-05-26T14:52:51Z","title":"Counteraction-Aware Multi-Teacher On-Policy Distillation for General Capability Recovery with Domain Preservation"},"reference_resolution":{"displayed":6,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":0,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":6},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 6 of 6 outbound references and 3 inbound Pith citation observations for arXiv:2605.27115."}