{"as_of":"2026-08-05T05:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f76f49db7908ae2f653d67dfec57839765d83ed2b04993ce6224252ac003677d","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-09T15:18:39.844534Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T04:31:28.536475Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T21:06:34.834207Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"cited_work":{"arxiv_id":"2605.01347","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.01347","snapshot_observed_at":"2026-07-09T21:06:34.834207Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","venue":"cs.CL","work_id":"3a3edb67-d89e-4bb2-baaf-be1a9e0122de","year":2026},"citing_paper":{"arxiv_id":"2605.22263","last_updated":"2026-05-21T10:07:46Z","snapshot_observed_at":"2026-08-02T10:25:42.509450Z","submitted_at":"2026-05-21T10:07:46Z","title":"Tailoring Teaching to Aptitude: Direction-Adaptive Self-Distillation for LLM Reasoning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-22T08:06:30.862911Z"},"links":{"cited_paper":"/paper/2605.01347","citing_paper":"/paper/2605.22263"},"observation_digest":"sha256:92d573fc03b3cb45d629f3a68e2bdc821a9eb220f46701ee986078fe98d7f608","observation_id":"3383638a-2ab5-4588-9be1-96448d6cd801","resolution":{"observed_at":"2026-05-22T08:11:17.758464Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"cited_work":{"arxiv_id":"2605.01347","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.01347","snapshot_observed_at":"2026-07-09T21:06:34.834207Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","venue":"cs.CL","work_id":"3a3edb67-d89e-4bb2-baaf-be1a9e0122de","year":2026},"citing_paper":{"arxiv_id":"2606.22793","last_updated":"2026-06-22T03:09:21Z","snapshot_observed_at":"2026-07-06T23:57:38.036151Z","submitted_at":"2026-06-22T03:09:21Z","title":"A Formula-Driven Survey and Research Agenda for On-Policy Distillation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-26T09:02:13.340365Z"},"links":{"cited_paper":"/paper/2605.01347","citing_paper":"/paper/2606.22793"},"observation_digest":"sha256:41072cf0d388f954db603af4bc78ccb6d6477887377b7f2e02de369c80025c0f","observation_id":"7e930519-c915-4227-ae28-ce5401dd800b","resolution":{"observed_at":"2026-07-04T10:19:47.049206Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"cited_work":{"arxiv_id":"2605.01347","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.01347","snapshot_observed_at":"2026-07-09T21:06:34.834207Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","venue":"cs.CL","work_id":"3a3edb67-d89e-4bb2-baaf-be1a9e0122de","year":2026},"citing_paper":{"arxiv_id":"2607.07050","last_updated":"2026-08-02T05:11:29Z","snapshot_observed_at":"2026-08-05T05:16:16.640626Z","submitted_at":"2026-07-08T06:26:13Z","title":"When Top-K Misses the Decision: Tool-Call Drift in Multi-Teacher On-Policy Distillation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-09T21:05:08.742517Z"},"links":{"cited_paper":"/paper/2605.01347","citing_paper":"/paper/2607.07050"},"observation_digest":"sha256:10dda757ea74ede055476a5190077a3aeb1c140ad2847fcf4dbe099464583bb0","observation_id":"716121cd-cf07-4506-9245-997d95bad734","resolution":{"observed_at":"2026-07-09T21:06:34.835892Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.01347","snapshot_observed_at":"2026-08-02T08:11:32.403020Z","title":"MAD-OPD: Breaking the ceiling in On-Policy distillation via multi-agent debate.arXiv preprint arXiv:2605.01347, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.07050","last_updated":"2026-08-02T05:11:29Z","snapshot_observed_at":"2026-08-05T05:16:16.640626Z","submitted_at":"2026-07-08T06:26:13Z","title":"When Top-K Misses the Decision: Tool-Call Drift in Multi-Teacher On-Policy Distillation","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T08:11:32.403020Z"},"links":{"cited_paper":"/paper/2605.01347","citing_paper":"/paper/2607.07050"},"observation_digest":"sha256:85509b63d5c01dc9b8cbc41cfca845b41d0d030be7d832fb568c40d0126056a1","observation_id":"f7b122f6-3751-40b7-88d4-f1b61f625e2c","resolution":{"observed_at":"2026-08-02T08:11:32.403020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.01347","snapshot_observed_at":"2026-08-04T04:31:28.536475Z","title":"MAD-OPD: Breaking the ceiling in On-Policy distillation via multi-agent debate.arXiv preprint arXiv:2605.01347, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.07050","last_updated":"2026-08-02T05:11:29Z","snapshot_observed_at":"2026-08-05T05:16:16.640626Z","submitted_at":"2026-07-08T06:26:13Z","title":"When Top-K Misses the Decision: Tool-Call Drift in Multi-Teacher On-Policy Distillation","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T04:31:28.536475Z"},"links":{"cited_paper":"/paper/2605.01347","citing_paper":"/paper/2607.07050"},"observation_digest":"sha256:d1dd60ae470a430410fb2eab1701cffc9126451b222b75d9bde7dac5491b45bd","observation_id":"f8b2d2c5-8f7d-4aa4-8275-c048f65352d7","resolution":{"observed_at":"2026-08-04T04:31:28.536475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.01347","snapshot_observed_at":"2026-08-01T07:15:04.810651Z","title":"Mad-opd: Breaking the ceiling in on-policy distillation via multi-agent debate, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21552","last_updated":"2026-07-23T17:35:56Z","snapshot_observed_at":"2026-08-04T05:53:57.555206Z","submitted_at":"2026-07-23T17:35:56Z","title":"MIRROR: Learning from the Other View for Multi-Modal Reasoning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T07:15:04.810651Z"},"links":{"cited_paper":"/paper/2605.01347","citing_paper":"/paper/2607.21552"},"observation_digest":"sha256:a94a351193ad72d80df2a5581a7253d004da1e5f66d8ab4e40f29df5e8b3943f","observation_id":"dfd3fc61-235a-4883-9358-1f569245d082","resolution":{"observed_at":"2026-08-01T07:15:04.810651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.01347/citation-record","integrity":"/paper/2605.01347/integrity","json":"/paper/2605.01347/citation-record.json","paper":"/paper/2605.01347"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On-policy distillation of language models: Learning from self-generated mistakes","venue":null,"work_id":"947fabac-9796-42cc-b34c-3733539cbe86","year":2024},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:e550bee46dd0ba5eb86217b285c8a7a5fbe84753aca4d0e57fa27d4968fe5f26","observation_id":"eef348e2-f599-4f49-8978-168331962a8e","resolution":{"observed_at":"2026-05-26T01:17:17.198866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.05528","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SMAGDi: Socratic multi agent interaction graph distillation for efficient high accuracy reasoning","venue":null,"work_id":"e724a499-b165-4d1b-8402-41ab28fbe657","year":2025},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:6d07b1f06ba94f6a7512f31e6e6640ff28d3fc6969fe4f2ad92f07ac2871186c","observation_id":"7be22d38-e786-4ce7-99dd-a40a7b03e74f","resolution":{"observed_at":"2026-05-11T16:41:19.166207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":"2108.07732","doi":"10.1007/s11390-025-5518-5","metadata_source":"pith","pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Program Synthesis with Large Language Models","venue":"cs.PL","work_id":"fd241a05-03b9-4de2-9588-9d77ce176125","year":2021},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:f1ce7cb1b38d5c7dd87201751461b7af4f4a8829fca8757d1e5526bbd8e0afb1","observation_id":"7efd699f-2ac4-4689-8594-eebdc0807367","resolution":{"observed_at":"2026-05-11T16:41:19.273752Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07982","last_updated":"2025-06-09T17:52:18Z","snapshot_observed_at":"2026-07-06T21:39:13.304260Z","submitted_at":"2025-06-09T17:52:18Z","title":"$\\tau^2$-Bench: Evaluating Conversational Agents in a Dual-Control Environment","version":1},"cited_work":{"arxiv_id":"2506.07982","doi":"10.48550/arxiv.2506.07982","metadata_source":"pith","pith_arxiv_id":"2506.07982","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\tau^2$-Bench: Evaluating Conversational Agents in a Dual-Control Environment","venue":"cs.AI","work_id":"3a498b1a-455f-4667-b572-c5216c99a89c","year":2025},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2506.07982","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:ef5d2cf0bc790d8e2c9083530e5726e79942e4af50a5e67b19df968c8c5b445f","observation_id":"1aaae547-f046-46cc-ae5e-b00e644638b4","resolution":{"observed_at":"2026-05-12T07:52:17.902869Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.129969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.129969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MAGDi: Structured distillation of multi-agent interaction graphs improves reasoning in smaller language models","venue":null,"work_id":"1891a62d-7f2c-4da5-a066-98f518cabed3","year":2024},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:b3c0d1cb1b9ec95bb812401698c7ee1a9a034093356e164e8bfd87c6bc14af86","observation_id":"f6ffb5d1-ad7b-4f03-b9a8-614487027435","resolution":{"observed_at":"2026-05-26T01:17:17.201683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ReConcile: Round-table con- ference improves reasoning via consensus among diverse LLMs","venue":null,"work_id":"ed21d6be-f873-42a2-a857-bf23b2cca6af","year":2024},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:6ea011eff6a6f082614960dfe1d61e7a743313ec768c4127a83f08eb817f17de","observation_id":"36546e9b-1139-4cc4-b9e2-938f1e0799c2","resolution":{"observed_at":"2026-05-26T01:17:17.193083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07928","last_updated":"2023-05-13T14:42:30Z","snapshot_observed_at":"2026-07-06T15:26:50.277211Z","submitted_at":"2023-05-13T14:42:30Z","title":"AMTSS: An Adaptive Multi-Teacher Single-Student Knowledge Distillation Framework For Multilingual Language Inference","version":1},"cited_work":{"arxiv_id":"2305.07928","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.07928","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AMTSS: An adaptive multi-teacher single-student knowledge distillation framework for multi- lingual language inference","venue":null,"work_id":"30b276d3-792a-4587-9605-99efb566f88d","year":2023},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2305.07928","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:1e9e596adb107f9287209b0030301a51ffdcdfaa31ebd1378ace388b4ba0d4cd","observation_id":"1beab1bd-b082-49fe-a436-1411be21ec7f","resolution":{"observed_at":"2026-05-11T16:41:19.781233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving retrieval-augmented generation through multi-agent reinforcement learning","venue":null,"work_id":"1c110d76-ea62-416b-9ecb-c22316c48db0","year":2025},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:695c81e4081130add62e91c9ef8c04e70d49484504cdd2b86be4cd8212455615","observation_id":"6b750b7e-e0ce-4b32-aaa1-9dfc0789a0f3","resolution":{"observed_at":"2026-05-26T01:17:17.190221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.17536","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:05:03.532070Z","title":"K., Zhu, X., and Li, S","venue":null,"work_id":"fccfecf8-da63-426e-a28c-b7d06572283b","year":2025},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:bb7a30d3dd59f8252be816dba472e23d32a16e2810d3bab82a57e42e5561e6aa","observation_id":"c154312b-a088-4cc6-972a-556f361a006e","resolution":{"observed_at":"2026-05-11T16:41:21.555087Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DeepSeek-V4 technical report","venue":null,"work_id":"4064f35c-d200-4017-8d3e-ca3a6ec4b59c","year":2026},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:76ed58319a872df6ac6eb924f0db9ef994550b8dc6beff4567b721479cbeb02f","observation_id":"9745eedf-504c-4090-9949-65f8de64a94c","resolution":{"observed_at":"2026-05-26T01:17:17.204185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14325","last_updated":"2023-05-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:55:11Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","version":1},"cited_work":{"arxiv_id":"2305.14325","doi":"10.48550/arxiv.2305.14325","metadata_source":"pith","pith_arxiv_id":"2305.14325","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","venue":"cs.CL","work_id":"a543e65c-1cf8-4182-b03b-33c0cd2c65d5","year":2023},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2305.14325","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:5d0de4a0f3d6a7b14c80813c06932af92c191fee1ff105219f3272552362929a","observation_id":"280a70af-6a0f-45c3-9982-80151f80577d","resolution":{"observed_at":"2026-05-12T03:01:45.301651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.25562","last_updated":"2026-04-27T06:21:52Z","snapshot_observed_at":"2026-07-06T22:50:41.736941Z","submitted_at":"2026-03-26T15:35:59Z","title":"Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes","version":2},"cited_work":{"arxiv_id":"2603.25562","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.25562","snapshot_observed_at":"2026-07-07T12:33:45.227324Z","title":"Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes","venue":"cs.LG","work_id":"8e059321-d6e4-4359-89eb-83ecbb93b657","year":2026},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2603.25562","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:9c0ab1fddb516754e057ecc454bcf7767ebdb28a23fa9b1acacab0aa33411a6f","observation_id":"b34186d4-dd9f-48a7-aff0-eaf6e843043c","resolution":{"observed_at":"2026-05-11T16:41:21.670733Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MiniLLM: Knowledge distillation of large language models","venue":null,"work_id":"76774739-174d-4f66-be62-b3bb1afab0a0","year":2024},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:32a23b5f84d23eb7854ddffbf667aa71c07ee4be623e93ba3ea5382ea6737a7e","observation_id":"fdc7602b-bdfa-4427-8360-9c3d536dc601","resolution":{"observed_at":"2026-05-26T01:17:17.209815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04178","last_updated":"2025-06-05T02:21:52Z","snapshot_observed_at":"2026-08-03T02:41:13.331563Z","submitted_at":"2025-06-04T17:25:39Z","title":"OpenThoughts: Data Recipes for Reasoning Models","version":2},"cited_work":{"arxiv_id":"2506.04178","doi":"10.48550/arxiv.2506.04178","metadata_source":"pith","pith_arxiv_id":"2506.04178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenThoughts: Data Recipes for Reasoning Models","venue":"cs.LG","work_id":"c7acbe41-27a0-4773-a7be-8f08d86cdf21","year":2025},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2506.04178","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:f21c94dcffc53a0a3daef3f07e0f4102e6225184f22cad7e638e908c505185f5","observation_id":"39037226-ef26-44be-adfb-c67c8ba4ad5a","resolution":{"observed_at":"2026-05-12T04:57:51.597669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:48.169741+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:48.169741+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.26490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:39:44.801876Z","title":"Vitabench: Benchmarking llm agents with versatile interactive tasks in real-world applications","venue":null,"work_id":"a9d216f9-8bb8-457e-a320-d1457744f75b","year":2025},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:a275d870f0e1563114693ca980f37623730d5c720dadb4f382747c9e984465ef","observation_id":"0ee95f87-7f24-469e-bd1e-db1b774f7518","resolution":{"observed_at":"2026-05-11T16:41:21.665570Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":"1503.02531","doi":"10.1109/cvpr52733.2024.01515","metadata_source":"pith","pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distilling the Knowledge in a Neural Network","venue":"stat.ML","work_id":"d927ab1f-17b8-4002-9d09-c3d55764fbad","year":2015},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:dcb0934ed055ee0bbc1189407c623ffda4e6e27ab568e8ada7ef328ad843a283","observation_id":"72bd42ca-d9d4-4b42-b228-60eb01054e6c","resolution":{"observed_at":"2026-05-11T16:41:19.795296Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20802","last_updated":"2026-02-16T14:49:34Z","snapshot_observed_at":"2026-07-29T19:52:32.104228Z","submitted_at":"2026-01-28T17:45:12Z","title":"Reinforcement Learning via Self-Distillation","version":2},"cited_work":{"arxiv_id":"2601.20802","doi":"10.48550/arxiv.2601.20802","metadata_source":"pith","pith_arxiv_id":"2601.20802","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reinforcement Learning via Self-Distillation","venue":"cs.LG","work_id":"b193541d-5853-4ea4-8e4b-8e4c08617eb6","year":2026},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2601.20802","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:bf81a717d7324f75fdb7a57149e5695b68254f21108ec1c17acde07a2e1eee5d","observation_id":"f0b10198-68ee-4689-a945-bf7cc93ede90","resolution":{"observed_at":"2026-05-12T04:29:18.795354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-21T06:23:12.649775+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T06:23:12.649775+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":"2403.07974","doi":"10.1109/icsme52107.2021.00025","metadata_source":"pith","pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","venue":"cs.SE","work_id":"ea9e51ce-1e75-4182-92d8-4d25f70d2ee4","year":2024},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:e47b4a0845da5029fcfdad93610a9a9c4601a29b182e7ed0fa09f055ef948261","observation_id":"3754dbe2-f1f9-4099-abd3-15acf850fcba","resolution":{"observed_at":"2026-05-11T16:41:20.240734Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07155","last_updated":"2026-07-11T08:43:13Z","snapshot_observed_at":"2026-08-03T11:14:50.541582Z","submitted_at":"2026-01-12T02:57:39Z","title":"Stable On-Policy Distillation through Adaptive Target Reformulation","version":3},"cited_work":{"arxiv_id":"2601.07155","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.07155","snapshot_observed_at":"2026-07-09T00:35:48.734855Z","title":"Stable On-Policy Distillation through Adaptive Target Reformulation","venue":"cs.LG","work_id":"d26b1f29-c96d-46cf-bf68-688d16583c89","year":2026},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2601.07155","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:77bdc92eb778a14de4cdaf02093a6032e91fcd2ae2de2977d151e47ba93dd3cb","observation_id":"6066dad1-c0ab-4a2e-b0c8-b5f9d322deef","resolution":{"observed_at":"2026-05-11T16:41:20.224411Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.07079","last_updated":"2026-05-22T17:34:18Z","snapshot_observed_at":"2026-07-06T22:48:13.053749Z","submitted_at":"2026-03-07T07:26:18Z","title":"Entropy-Aware On-Policy Distillation of Language Models","version":2},"cited_work":{"arxiv_id":"2603.07079","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.07079","snapshot_observed_at":"2026-07-09T21:06:34.837233Z","title":"Entropy-aware on-policy distillation of language models","venue":"cs.LG","work_id":"7dccbe12-e2aa-48d8-9b76-5521ccf02668","year":2026},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2603.07079","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:4a541206760f81798b42cd718de271fa98434e12d1db159c0fa7fdf02b723a55","observation_id":"12442ef8-7d89-4535-a882-7fa30df4ece8","resolution":{"observed_at":"2026-05-25T03:02:00.585154Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:13:44.981421Z","title":null,"venue":null,"work_id":"1fd5dc26-009c-412b-b8a9-bbc93722bdbf","year":2016},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:7e7c484f9113bec050721323fd3f683caa277e03735946c0f634f95b35206f0c","observation_id":"65f0a3bc-f6c2-4061-8fe5-f52b27a675f8","resolution":{"observed_at":"2026-05-26T01:17:17.212724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13016","last_updated":"2026-04-15T17:48:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-14T17:54:28Z","title":"Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe","version":2},"cited_work":{"arxiv_id":"2604.13016","doi":"10.48550/arxiv.2604.13016","metadata_source":"pith","pith_arxiv_id":"2604.13016","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe","venue":"cs.LG","work_id":"42b43df0-4c82-493f-9d9b-1be8c116d9af","year":2026},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2604.13016","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:50654abd1e76f80ea791fed69492d2323c101022594292b0f7f40d85ec54e494","observation_id":"b36d7507-e2e3-4a42-b496-77e1d1338da2","resolution":{"observed_at":"2026-05-11T16:41:19.052841Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Encouraging divergent thinking in large language models through multi-agent debate","venue":null,"work_id":"e3033def-c77d-4ce7-a580-15d5e270e8ee","year":2024},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:9ff32717711819e52222e9a1ee68bf02f6e3bf1db4dc67b163b4f4aecfde1e47","observation_id":"29e3a2a9-3821-4941-8947-568fd2774f1b","resolution":{"observed_at":"2026-05-26T01:17:17.181967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Divergence measures based on the shannon entropy.IEEE Transactions on Information Theory, 37(1):145–151","venue":null,"work_id":"bd603c69-489f-42c4-acb3-5fa34d990a33","year":1991},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:152c7cfdd50213136fc2a5d3a0e4466df6a5133629cb4ee9d6f87d9a60f52cc2","observation_id":"4f6b0ee9-1b1e-4774-9a74-766f9b88bcdc","resolution":{"observed_at":"2026-05-26T01:17:17.206978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Is your code generated by ChatGPT really correct? rigorous evaluation of large language models for code generation","venue":null,"work_id":"c83446ce-3760-4f40-b1b4-af6331392e96","year":2023},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:87b2bef76033dfa689f7ac2ee83d26459a9744391043a0a7c89f0018d85e51ed","observation_id":"97a1938b-4618-4f53-adaf-4e8c96672ac3","resolution":{"observed_at":"2026-05-26T01:17:17.195909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00920","last_updated":"2025-07-25T08:26:54Z","snapshot_observed_at":"2026-07-06T19:09:01.748727Z","submitted_at":"2024-09-02T03:19:56Z","title":"ToolACE: Winning the Points of LLM Function Calling","version":2},"cited_work":{"arxiv_id":"2409.00920","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.00920","snapshot_observed_at":"2026-07-05T04:40:40.695053Z","title":"ToolACE : Winning the points of LLM function calling","venue":null,"work_id":"1186dcff-a8d4-4766-84c4-1cda266a9852","year":2024},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2409.00920","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:4e5cd824ebea544da1aa62eae96ae4f81d9171a749c3c73386296a2263e316c6","observation_id":"ef65ccf7-2e1d-49e7-80d7-bdf882c95be4","resolution":{"observed_at":"2026-05-11T16:41:19.046738Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:36:29.521451Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"139a920c-85a1-42e5-937e-f14d907436d5","year":2019},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:1c7c7b01ace9f3174a3b4f89e643b45878cb118b628c4c72a1a7a19ec3e4c1de","observation_id":"677187ca-da3b-429a-a9d4-bf274c1edf3b","resolution":{"observed_at":"2026-05-26T01:17:17.184711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.64434/tml.20251026","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T16:57:24.393084Z","title":"On-policy distillation.Thinking Machines Lab: Con- nectionism","venue":null,"work_id":"bb76b11f-d59b-421e-88c6-fa0920ed09c3","year":2025},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:92c5436ebaedb5b7ea04335582d63c3a33533f126251c7365f8c2613425a467e","observation_id":"ce802ad6-1ea6-4a40-b7bd-426062262e7f","resolution":{"observed_at":"2026-05-09T22:08:57.583809Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-01T07:08:02.609025+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T07:08:02.609025+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13167","last_updated":"2025-08-06T17:01:02Z","snapshot_observed_at":"2026-08-04T15:45:01.998204Z","submitted_at":"2025-08-06T17:01:02Z","title":"Chain-of-Agents: End-to-End Agent Foundation Models via Multi-Agent Distillation and Agentic RL","version":1},"cited_work":{"arxiv_id":"2508.13167","doi":"10.48550/arxiv.2508.13167","metadata_source":"pith","pith_arxiv_id":"2508.13167","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Chain-of-agents: End-to-endagentfoundationmodelsviamulti-agentdistillation andagenticRL.arXivpreprint","venue":"cs.AI","work_id":"141bc3ea-6f2e-439d-ada6-ffa0902bf68f","year":2025},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2508.13167","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:06c9b9bc109016a5a4e4ac375ee2884029902deaf0afd07da174c91389fc0153","observation_id":"61c22ce0-a9eb-4916-b90d-779314c5c6a1","resolution":{"observed_at":"2026-05-11T16:41:20.540725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.04942","last_updated":"2026-02-16T18:57:38Z","snapshot_observed_at":"2026-07-06T22:44:37.993093Z","submitted_at":"2026-02-04T18:46:17Z","title":"Privileged Information Distillation for Language Models","version":3},"cited_work":{"arxiv_id":"2602.04942","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.04942","snapshot_observed_at":"2026-07-10T00:26:39.270366Z","title":"Privileged Information Distillation for Language Models","venue":"cs.LG","work_id":"674b7199-1d6e-4f36-89f1-fe1abe5b4db1","year":2026},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2602.04942","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:1397c0b267dcec82c84de3459373a5c0b4f8e4707ab52cb7c8174bc24f7a309c","observation_id":"baaebeef-1d64-40e4-b31f-bffd6e6052f3","resolution":{"observed_at":"2026-05-22T08:25:38.085126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:e4a9bea8b72c2cb1d20c26616d77e021118368f1e5a669b149e156bf40387c87","observation_id":"c4348353-cfc9-4e28-b446-83c796480f1e","resolution":{"observed_at":"2026-05-11T16:41:20.975823Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.08814","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cycle-instruct: Fully seed- free instruction tuning via dual self-training and cycle consistency","venue":null,"work_id":"f04e9ee5-4e7e-4e83-ba48-dee288f565a3","year":2025},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:7adfa30b7e8fd9aba5e71474304e19db32d89e726ecc484bb4ed2a0c3cd0619b","observation_id":"924f58a4-87f7-4381-bfa0-33e598fc3827","resolution":{"observed_at":"2026-05-11T16:41:19.478364Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.00626","last_updated":"2026-06-18T17:00:51Z","snapshot_observed_at":"2026-07-13T14:57:31.836214Z","submitted_at":"2026-04-01T08:32:34Z","title":"A Survey of On-Policy Distillation for Large Language Models","version":4},"cited_work":{"arxiv_id":"2604.00626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.00626","snapshot_observed_at":"2026-07-10T00:26:39.257599Z","title":"A Survey of On-Policy Distillation for Large Language Models","venue":"cs.LG","work_id":"f6aaea8e-1f0d-43e3-b28f-6066d3e0a66b","year":2026},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2604.00626","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:387844c9c0eb141069a419ed79339c3df4767b8413d14e1240160b2a92a90057","observation_id":"6a7ac809-0d5c-4c24-acd0-30eab8b39ff0","resolution":{"observed_at":"2026-05-13T02:47:19.238105Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06629","last_updated":"2023-06-11T09:17:21Z","snapshot_observed_at":"2026-08-04T05:07:34.717508Z","submitted_at":"2023-06-11T09:17:21Z","title":"GKD: A General Knowledge Distillation Framework for Large-scale Pre-trained Language Model","version":1},"cited_work":{"arxiv_id":"2306.06629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.06629","snapshot_observed_at":"2026-07-01T17:45:52.282143Z","title":"GKD: A general knowledge distillation framework for large-scale pre-trained language model","venue":null,"work_id":"83d93bfe-3ba1-4f79-9158-b05fc58ecbf1","year":2023},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2306.06629","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:b1720b7e6bb5af02a78f0c2c9700bdc51b538c222ac964aa01b998cc4f11e415","observation_id":"af531e27-ff4d-4dec-b69b-85a21ba8a24c","resolution":{"observed_at":"2026-05-11T16:41:19.061053Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":"2309.07864","doi":"10.1186/s12912-025-04245-9","metadata_source":"pith","pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","venue":"cs.AI","work_id":"985ca219-7e34-4c4f-bdc5-ccd39763ad61","year":2023},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:a360a976bbe9acf6a4dfbe642390e6e569e455562e285273ba1cf618c1f6dbdd","observation_id":"3daaa0ac-ade3-4ae6-8fc7-66ed0faa19b2","resolution":{"observed_at":"2026-05-11T16:41:19.629338Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15671","last_updated":"2024-02-24T01:04:19Z","snapshot_observed_at":"2026-07-06T17:34:49.001670Z","submitted_at":"2024-02-24T01:04:19Z","title":"Towards a Participatory and Social Justice-Oriented Measure of Human-Robot Trust","version":1},"cited_work":{"arxiv_id":"2402.15671","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.15671","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Berkeley function calling leaderboard","venue":null,"work_id":"b7fec25e-b195-40c6-80cf-e2515f50dcca","year":2024},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2402.15671","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:06edddf1594b939aeb4505dcfd8df41161e498473c9d88743b376a22971ebd59","observation_id":"f697bbc9-6970-4099-9497-72d95507cd58","resolution":{"observed_at":"2026-05-11T16:41:21.365199Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:3f539516b45ca180bfd59d4f48fbad69900be4ec6ca0848d50400696131f3cf1","observation_id":"32880efb-ae03-4888-8d16-e5b51cdaba33","resolution":{"observed_at":"2026-05-11T16:41:20.724373Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.03128","last_updated":"2026-04-08T08:22:36Z","snapshot_observed_at":"2026-08-03T04:49:13.270533Z","submitted_at":"2026-04-03T15:50:07Z","title":"Self-Distilled RLVR","version":2},"cited_work":{"arxiv_id":"2604.03128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.03128","snapshot_observed_at":"2026-07-07T12:33:45.187943Z","title":"Self-Distilled RLVR","venue":"cs.LG","work_id":"935a34f3-b83d-4214-b6a0-ae2395b3d107","year":2026},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2604.03128","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:7c382b0c79485e144aa56d545e84468df42d72005af1e5ecf066e872d3e76090","observation_id":"b9f40531-4cc6-438f-8d46-816875f81c84","resolution":{"observed_at":"2026-05-11T16:41:21.254424Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12125","last_updated":"2026-02-26T13:26:22Z","snapshot_observed_at":"2026-07-31T18:08:52.441829Z","submitted_at":"2026-02-12T16:14:29Z","title":"Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation","version":2},"cited_work":{"arxiv_id":"2602.12125","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.12125","snapshot_observed_at":"2026-07-09T00:35:48.740330Z","title":"Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation","venue":"cs.LG","work_id":"bb968107-1f43-4bf4-aa52-cc58000a6e89","year":2026},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2602.12125","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:14f437a6600b14e1c1c71e10846905c3af2727a40b54baa4c66a47c8e7bd955e","observation_id":"8288577f-4147-4f79-8902-03196e9bb9bd","resolution":{"observed_at":"2026-05-16T05:11:07.754859Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12275","last_updated":"2026-03-23T13:11:10Z","snapshot_observed_at":"2026-07-06T22:45:39.557598Z","submitted_at":"2026-02-12T18:58:28Z","title":"On-Policy Context Distillation for Language Models","version":2},"cited_work":{"arxiv_id":"2602.12275","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.12275","snapshot_observed_at":"2026-07-10T00:26:39.252472Z","title":"On-Policy Context Distillation for Language Models","venue":"cs.CL","work_id":"b56a7e15-d864-43f4-9212-59bc7ec70d21","year":2026},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2602.12275","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:3e82b5db8d822e3cda73a6ee2afee1c09ec348d60acafdd53fcca22c16dd58c6","observation_id":"0e86687f-99e6-4ac1-ab57-c698271932f2","resolution":{"observed_at":"2026-05-13T20:48:41.492604Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18734","last_updated":"2026-03-20T15:40:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-26T17:56:50Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","version":3},"cited_work":{"arxiv_id":"2601.18734","doi":"10.18653/v1/2025.emnlp-main.125.https://aclanthology.org/2025.emnlp-main.125/","metadata_source":"pith","pith_arxiv_id":"2601.18734","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","venue":"cs.LG","work_id":"bae00e84-9b0d-433d-a066-20b951f0b4d0","year":2026},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2601.18734","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:cc0d51da27b610e681c4a1c0ccdfeac0d6a1a710833bf21524a1951fb3435c86","observation_id":"4fc16924-36eb-4e97-83dc-c88954dacf01","resolution":{"observed_at":"2026-05-12T03:54:31.187112Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03541","last_updated":"2025-06-04T03:52:20Z","snapshot_observed_at":"2026-07-06T21:36:15.867826Z","submitted_at":"2025-06-04T03:52:20Z","title":"Debate, Reflect, and Distill: Multi-Agent Feedback with Tree-Structured Preference Optimization for Efficient Language Model Enhancement","version":1},"cited_work":{"arxiv_id":"2506.03541","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03541","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"next month","venue":null,"work_id":"2c4aa46f-9d9d-45fb-a18f-8489e0723390","year":2025},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"cited_paper":"/paper/2506.03541","citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:4fddc71737f9d2fc7b8e09bcc5c9e8ddbeb40d4f855da2c202b7bff4bf061b9e","observation_id":"779565d1-1f1c-430a-ae2f-16347951864e","resolution":{"observed_at":"2026-05-11T16:41:20.005103Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2020-10-16","venue":null,"work_id":"40e326b4-5626-4847-8f7c-9770a881a0e8","year":2020},"citing_paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-09T15:18:39.844534Z"},"links":{"citing_paper":"/paper/2605.01347"},"observation_digest":"sha256:7b235cc6981755958fc02641a65fc7bf73f92e484086c1b6048041a96abf2d9f","observation_id":"a8ba43c8-276c-4018-8787-fc76e122f7a9","resolution":{"observed_at":"2026-05-26T01:17:17.187516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.01347","last_updated":"2026-05-02T09:41:37Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:14:33.653260Z","submitted_at":"2026-05-02T09:41:37Z","title":"MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":1,"verified_exact":28,"verified_fuzzy":11},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 6 inbound Pith citation observations for arXiv:2605.01347."}