{"as_of":"2026-08-19T02:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:12252c1a14800973fd118614252ee98c401308d6824ab2396f32e1a991f54120","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T16:47:41.888680Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:30:56.200896Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-16T00:30:57.011169Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"cited_work":{"arxiv_id":"2608.05131","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.05131","snapshot_observed_at":"2026-08-16T00:30:57.011169Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","venue":"cs.CV","work_id":"5d413eba-0e4a-4f1e-82ae-90e2ddc32ef7","year":2026},"citing_paper":{"arxiv_id":"2608.12008","last_updated":"2026-08-12T12:45:45Z","snapshot_observed_at":"2026-08-18T23:47:47.026805Z","submitted_at":"2026-08-12T12:45:45Z","title":"Asymptotic Risk Calibration for Selective Question Answering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:30:56.200896Z"},"links":{"cited_paper":"/paper/2608.05131","citing_paper":"/paper/2608.12008"},"observation_digest":"sha256:dd9b264e4f838f98da200a916e9559b77136dc5cb4d7a422a29164f00eeb5ca2","observation_id":"2befa88c-35d5-4c60-9168-be9980f6f945","resolution":{"observed_at":"2026-08-16T00:30:57.037536Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2608.05131/citation-record","integrity":"/paper/2608.05131/integrity","json":"/paper/2608.05131/citation-record.json","paper":"/paper/2608.05131"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.713547Z","title":"Beyond nl2code: A structured survey of multimodal code intelligence,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.713547Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:26c3de2087eeae3f216aff94264327cc624b48e332f9e5bac46278189f8ac208","observation_id":"ed2759aa-4eb8-4ab2-b4d3-8af106b060cb","resolution":{"observed_at":"2026-08-08T16:47:41.713547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.722245Z","title":"Self-evolving multi-agent systems via textual backpropagation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.722245Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:71d30d475a0542ef01b8f738b5379a1b1b27f8da5cdd845435b4c06c0db1e965","observation_id":"a957e4b6-8496-453d-bd30-96c355e8b680","resolution":{"observed_at":"2026-08-08T16:47:41.722245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12919","last_updated":"2023-12-01T17:33:55Z","snapshot_observed_at":"2026-08-16T14:41:24.979087Z","submitted_at":"2023-11-21T18:43:07Z","title":"SPOT! Revisiting Video-Language Models for Event Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12919","snapshot_observed_at":"2026-08-08T16:47:41.729486Z","title":"Spot! revisiting video-language models for event understanding.arXiv preprint arXiv:2311.12919, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.729486Z"},"links":{"cited_paper":"/paper/2311.12919","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:dbed395a60a861e47eb0b02852623b4f93cb1be4f4d0fbf3aa9725632153b726","observation_id":"2b7d2f76-763a-4cae-aa54-c90bf61db022","resolution":{"observed_at":"2026-08-08T16:47:41.729486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:42.532510Z","title":"Loong: 10 Synthesize long chain-of-thoughts at scale through verifiers, 2025","venue":null,"work_id":"703c8505-6506-4db0-9dc4-698e63e53337","year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.733162Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:05f5c152da1be2dd45ae7a2c34c7f632961cf4766ecff7a0d4aac935fe7703b2","observation_id":"254e64fe-9d1e-48f9-bc76-a3401a47e5ae","resolution":{"observed_at":"2026-08-08T16:47:42.561478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.737267Z","title":"On-policy distillation of language models: Learning from self-generated mistakes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.737267Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:0dd2a9b90d5faec6736ff3c63ff51d29ab88c8de00d16b36294d779e8e3feeec","observation_id":"a06cf162-82a8-49af-88e0-2ab2085af74d","resolution":{"observed_at":"2026-08-08T16:47:41.737267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.740648Z","title":"On-policy distillation.Thinking Machines Lab: Connectionism,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.740648Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:d75362ff6f63d5f1c627686c3df45585d04098024f3586346abda50b65610a75","observation_id":"e501289c-cf77-407c-adf0-54fc0584ba2e","resolution":{"observed_at":"2026-08-08T16:47:41.740648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18734","last_updated":"2026-03-20T15:40:19Z","snapshot_observed_at":"2026-08-13T14:47:47.249767Z","submitted_at":"2026-01-26T17:56:50Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.18734","snapshot_observed_at":"2026-08-08T16:47:41.747694Z","title":"Self- distilled reasoner: On-policy self-distillation for large language models.arXiv preprint arXiv:2601.18734, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.747694Z"},"links":{"cited_paper":"/paper/2601.18734","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:ba9fdd40f8731cf17bce2223fb427374271d919ad668a32e47dd4f0e22ffb039","observation_id":"3feb1583-11b1-4f7c-bc09-36a6128c8d97","resolution":{"observed_at":"2026-08-08T16:47:41.747694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.30626","last_updated":"2026-06-29T17:55:53Z","snapshot_observed_at":"2026-08-16T09:45:55.312871Z","submitted_at":"2026-06-29T17:55:53Z","title":"DOPD: Dual On-policy Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.30626","snapshot_observed_at":"2026-08-08T16:47:41.751943Z","title":"Dopd: Dual on-policy distillation, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.751943Z"},"links":{"cited_paper":"/paper/2606.30626","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:36e7c4e43321c4ccae801f97772837f36368ae548bfb32a9267bf5d42b3c1198","observation_id":"055d4105-15f7-4174-b43c-ced02e7f4f16","resolution":{"observed_at":"2026-08-08T16:47:41.751943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2608.03972","last_updated":"2026-08-04T17:40:08Z","snapshot_observed_at":"2026-08-13T23:18:24.036024Z","submitted_at":"2026-08-04T17:40:08Z","title":"ReflectRL: Learning from Golden Negative Trajectories via Reflective-to-Direct Reasoning","version":1},"cited_work":{"arxiv_id":"2608.03972","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.03972","snapshot_observed_at":"2026-08-08T16:47:42.403064Z","title":"ReflectRL: Learning from Golden Negative Trajectories via Reflective-to-Direct Reasoning","venue":"cs.AI","work_id":"a0032dcf-bba0-4c7b-b225-5d5315f8c696","year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.755414Z"},"links":{"cited_paper":"/paper/2608.03972","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:2d0688f9c3d32ab2105b788b438bc69f6e1676b4738fdd9286dccaf27791970e","observation_id":"ca766d31-089c-4d82-a559-29b1bcc5222c","resolution":{"observed_at":"2026-08-08T16:47:42.408371Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18740","last_updated":"2026-06-02T16:34:00Z","snapshot_observed_at":"2026-08-18T02:42:18.339617Z","submitted_at":"2026-05-18T17:57:04Z","title":"Vision-OPD: Learning to See Fine Details for Multimodal LLMs via On-Policy Self-Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18740","snapshot_observed_at":"2026-08-08T16:47:41.759043Z","title":"Vision-opd: Learning to see fine details for multimodal llms via on-policy self-distillation.arXiv preprint arXiv:2605.18740, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.759043Z"},"links":{"cited_paper":"/paper/2605.18740","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:0d8798ef4067e8b935e645863f80ab280789cae71333497afe15fba7553a98ce","observation_id":"b8f55094-0812-40f8-84d9-ebf2da359fcc","resolution":{"observed_at":"2026-08-08T16:47:41.759043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.18974","last_updated":"2026-06-25T02:14:41Z","snapshot_observed_at":"2026-08-14T06:39:30.894450Z","submitted_at":"2026-06-17T11:59:15Z","title":"Visual-OPSD: Cross-Modal On-Policy Self-Distillation for Efficient Unified Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.18974","snapshot_observed_at":"2026-08-08T16:47:41.762461Z","title":"Visual- opsd: Cross-modal on-policy self-distillation for efficient unified multimodal reasoning.arXiv preprint arXiv:2606.18974, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.762461Z"},"links":{"cited_paper":"/paper/2606.18974","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:1c19cc2f40bc893e49820948109ac4736c7887f36088496849bf96ed933a3385","observation_id":"aad56867-fcd7-48c0-a791-7ac824617cab","resolution":{"observed_at":"2026-08-08T16:47:41.762461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.21924","last_updated":"2026-05-21T02:48:36Z","snapshot_observed_at":"2026-08-16T21:45:56.892632Z","submitted_at":"2026-05-21T02:48:36Z","title":"Visual-Advantage On-Policy Distillation for Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.21924","snapshot_observed_at":"2026-08-08T16:47:41.766048Z","title":"Visual-advantage on-policy distillation for vision-language models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.766048Z"},"links":{"cited_paper":"/paper/2605.21924","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:085be561892bbe205337e3c1b054a49fdd13fccdc55eaec49cce9ba52a6acf5f","observation_id":"9be022a1-7d4b-4b42-b393-b600bfac4269","resolution":{"observed_at":"2026-08-08T16:47:41.766048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.21556","last_updated":"2026-07-23T17:37:37Z","snapshot_observed_at":"2026-08-12T17:06:14.400229Z","submitted_at":"2026-07-23T17:37:37Z","title":"Visual Contrastive Self-Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.21556","snapshot_observed_at":"2026-08-08T16:47:41.769576Z","title":"Visual contrastive self-distillation.arXiv preprint arXiv:2607.21556, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.769576Z"},"links":{"cited_paper":"/paper/2607.21556","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:eda0b8def25a6f520a959d35ba359be624790dc4876f81d8c014913431af1287","observation_id":"5b746a6a-f9b9-496a-b6b6-55ac0388ecf3","resolution":{"observed_at":"2026-08-08T16:47:41.769576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.772811Z","title":"LLaVA steering: Visual instruction tuning with 500x fewer parameters through modality linear representation- steering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.772811Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:12f6a36b0bf087a76c12e61cab15956745ffe3587eeffb6535b8df88b9468945","observation_id":"060ef9cb-da57-4525-aacc-0a5d3c2dfd47","resolution":{"observed_at":"2026-08-08T16:47:41.772811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:42.509590Z","title":null,"venue":null,"work_id":"909f7600-a8e3-4adc-add8-f3021a2f397c","year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.776381Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:2da57743139b15f065f74cc8294df64d10bd6c343d5a099cc9fc8793e60d5b63","observation_id":"93dde378-685d-40f5-8ca2-430199bcc29a","resolution":{"observed_at":"2026-08-08T16:47:42.512743Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.779515Z","title":"Evaluating and steering modality preferences in multimodal large language model.arXiv preprint arXiv:2505.20977, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.779515Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:2420c92fa42eb4559e0d6f8a6492df876fd568490539312d2ef391b8536fe2b8","observation_id":"cda22931-260a-4b4a-8793-d93c19c0840f","resolution":{"observed_at":"2026-08-08T16:47:41.779515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.03677","last_updated":"2026-05-09T05:50:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-03T15:59:24Z","title":"Instruction Anchor: Dissecting the Mechanistic Dynamics of Modality Arbitration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.03677","snapshot_observed_at":"2026-08-08T16:47:41.782679Z","title":"Instruction anchor: Dissecting the mechanistic dynamics of modality arbitration, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.782679Z"},"links":{"cited_paper":"/paper/2602.03677","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:802c40de6afe2fb75340d0b5566a562b87590fd39fc0ea4cc97667ef282befe4","observation_id":"9a6c8aec-8f49-4b46-bc1b-d65693c338d4","resolution":{"observed_at":"2026-08-08T16:47:41.782679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:42.500415Z","title":"Qwen3.5: Towards native multimodal agents, February 2026","venue":null,"work_id":"79118519-5386-49f9-a8f1-1a98a94ad453","year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.785879Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:1a9b5e33a9b1258d8082462748c5dfb25a023ba323955abacd90a174292a9211","observation_id":"27326db0-6506-484b-8172-e2d398e169b6","resolution":{"observed_at":"2026-08-08T16:47:42.503922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-08T16:47:41.789313Z","title":"Qwen3-VL technical report.arXiv preprint arXiv:2511.21631, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.789313Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:f48d33bcaf2216813fce45a60eed7658cee6edd474eb393230f326427066be7c","observation_id":"721b0ae7-c96f-480c-aa05-6888ba63d76f","resolution":{"observed_at":"2026-08-08T16:47:41.789313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.792448Z","title":"V*: Guided visual search as a core mechanism in multimodal llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.792448Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:2fc5e409d73b47422d74b56809b438bc637c7313e4e0fe36cce01ae562f7ffe7","observation_id":"4a5d6c25-b766-49b4-af7a-d8a675397542","resolution":{"observed_at":"2026-08-08T16:47:41.792448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.795303Z","title":"Zooming without zooming: Region-to-image distillation for fine-grained multimodal perception.arXiv preprint arXiv:2602.11858, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.795303Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:5bdbfbc733f9e372b72ba81240ae9cdff691c714ef243910849e86e1d1e1a5f6","observation_id":"628510d3-0a09-402a-99ce-e7b255d5067d","resolution":{"observed_at":"2026-08-08T16:47:41.795303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.798498Z","title":"Divide, conquer and combine: A training-free framework for high-resolution image perception in multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.798498Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:6a21a5c17974092fe146f25cc1d8f8df6ab1afad9421451b90c33fbc9f69b188","observation_id":"bcf628de-e8a5-4926-9151-7830395329d9","resolution":{"observed_at":"2026-08-08T16:47:41.798498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13257","last_updated":"2025-02-05T08:44:02Z","snapshot_observed_at":"2026-08-13T00:35:03.634903Z","submitted_at":"2024-08-23T17:59:51Z","title":"MME-RealWorld: Could Your Multimodal LLM Challenge High-Resolution Real-World Scenarios that are Difficult for Humans?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13257","snapshot_observed_at":"2026-08-08T16:47:41.802360Z","title":"Mme-realworld: Could your multimodal llm challenge high-resolution real-world scenarios that are difficult for humans?arXiv preprint arXiv:2408.13257, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.802360Z"},"links":{"cited_paper":"/paper/2408.13257","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:d6d3ad8cb9fe4b75ec73046d8ccb3356a015cc9c903965b4a29bd55c09edd006","observation_id":"40158c7f-09e5-4552-9fba-b28ee91b0b2b","resolution":{"observed_at":"2026-08-08T16:47:41.802360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.806120Z","title":"Gemini 3.1 pro.https://deepmind.google/models/model-cards/gemini-3-1-pro/, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.806120Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:59d7e514b320c1f92deb9bf5f4fe24f2748ac2318b92dc3b194730b8784399c4","observation_id":"ab24a133-da4e-45bc-b676-7c79dcc5b530","resolution":{"observed_at":"2026-08-08T16:47:41.806120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.809291Z","title":"Gemini 3.5 flash","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.809291Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:edd67e983354e030b8fe5d745846d32ed5af1f5a2041d1266ae100f6806e3c70","observation_id":"2773812a-a9c9-4fa1-bb77-da9ed4ad9f51","resolution":{"observed_at":"2026-08-08T16:47:41.809291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.812775Z","title":"Introducing gpt-5.4.https://openai.com/index/introducing-gpt-5-4/, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.812775Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:efecd7b0bd83625827ce8844bbb4d02592e1433133e65c29be6857e43a1cc683","observation_id":"ca9e340c-f0d7-439e-8e83-26070ff7c657","resolution":{"observed_at":"2026-08-08T16:47:41.812775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.816002Z","title":"Introducing gpt-5.2.https://openai.com/index/introducing-gpt-5-2/, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.816002Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:19e6fd014cf0df40a8ab304c5f32e816f7bd0c4257b545aacc932b22f6cdc82a","observation_id":"27fc40de-414f-47f5-bf54-476a9b14687a","resolution":{"observed_at":"2026-08-08T16:47:41.816002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.11630","last_updated":"2025-08-15T17:59:49Z","snapshot_observed_at":"2026-08-16T04:57:28.480168Z","submitted_at":"2025-08-15T17:59:49Z","title":"Thyme: Think Beyond Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.11630","snapshot_observed_at":"2026-08-08T16:47:41.819444Z","title":"Thyme: Think beyond images.arXiv preprint arXiv:2508.11630, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.819444Z"},"links":{"cited_paper":"/paper/2508.11630","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:fdf1fcafaf44c70abb9cba1b978a58aff7c6dcc651633cfa38d0113e99a04f2d","observation_id":"a5e74056-a2b3-43a1-a194-f107f6c8bbdc","resolution":{"observed_at":"2026-08-08T16:47:41.819444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14362","last_updated":"2026-03-01T04:59:56Z","snapshot_observed_at":"2026-08-02T12:23:34.946873Z","submitted_at":"2025-05-20T13:48:11Z","title":"DeepEyes: Incentivizing \"Thinking with Images\" via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14362","snapshot_observed_at":"2026-08-08T16:47:41.823170Z","title":"thinking with images","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.823170Z"},"links":{"cited_paper":"/paper/2505.14362","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:70e9af80db513835b2f8e3e6263d02baf24c4464b4a5089da7619db76f03f39c","observation_id":"954c6a81-cf98-4f6d-9f58-34af42d9f9e4","resolution":{"observed_at":"2026-08-08T16:47:41.823170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.05271","last_updated":"2026-03-11T08:46:41Z","snapshot_observed_at":"2026-07-06T22:35:13.699594Z","submitted_at":"2025-11-07T14:31:20Z","title":"DeepEyesV2: Toward Agentic Multimodal Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.05271","snapshot_observed_at":"2026-08-08T16:47:41.826547Z","title":"Deepeyesv2: Toward agentic multimodal model.arXiv preprint arXiv:2511.05271, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.826547Z"},"links":{"cited_paper":"/paper/2511.05271","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:f36fe769c601ebd911b719f5b94733c4e6266c37458037f599b52c6ea24cd404","observation_id":"a028e577-74e6-4dc8-bb15-c040df5b32f3","resolution":{"observed_at":"2026-08-08T16:47:41.826547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03569","last_updated":"2025-06-04T04:32:54Z","snapshot_observed_at":"2026-08-19T02:16:45.377152Z","submitted_at":"2025-06-04T04:32:54Z","title":"MiMo-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03569","snapshot_observed_at":"2026-08-08T16:47:41.830087Z","title":"Mimo-vl technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.830087Z"},"links":{"cited_paper":"/paper/2506.03569","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:254ff87667ccb7cbcbd69e567cd51e67e9ccda57d79bb8a93ef565738516af10","observation_id":"ebcee3e8-f82b-45e2-ad3c-d79c23b1e969","resolution":{"observed_at":"2026-08-08T16:47:41.830087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.833295Z","title":"Sensenova-mars: Empowering multimodal agentic reasoning and search via reinforcement learning.arXiv preprint arXiv:2512.24330, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.833295Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:898ccec2dbf0c3adbde49c5de2cbe06e96fccf09512b122eff03c985e3ea88fe","observation_id":"22d24745-bb26-4331-9009-9623b51ffed3","resolution":{"observed_at":"2026-08-08T16:47:41.833295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.18154","last_updated":"2025-09-16T19:41:48Z","snapshot_observed_at":"2026-08-09T11:10:24.301223Z","submitted_at":"2025-09-16T19:41:48Z","title":"MiniCPM-V 4.5: Cooking Efficient MLLMs via Architecture, Data, and Training Recipe","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.18154","snapshot_observed_at":"2026-08-08T16:47:41.836012Z","title":"Minicpm-v 4.5: Cooking efficient mllms via architecture, data, and training recipe.arXiv preprint arXiv:2509.18154, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.836012Z"},"links":{"cited_paper":"/paper/2509.18154","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:b003031de3199f39869d1c427a9338fdf721ca2984b0df43658c1c3b94c8aa1b","observation_id":"4d9cd7de-c772-4acc-9483-641d3c458f37","resolution":{"observed_at":"2026-08-08T16:47:41.836012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-08T16:47:41.839109Z","title":"Glm-4.5 v and glm-4.1 v-thinking: Towards versatile multimodal reasoning with scalable reinforcement learning.arXiv preprint arXiv:2507.01006, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.839109Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:37dd41ac160f6333fc6a788ae4c434619572fb484e17310686e926fd6a2d1625","observation_id":"b12c61fa-0861-4964-b96d-ef8818118568","resolution":{"observed_at":"2026-08-08T16:47:41.839109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.842795Z","title":"Kimi k2.6: From code to creation, from one to many.https://www.kimi.com/ai-models/ kimi-k2-6/, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.842795Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:1f702d046a2d159a67cb8d92f6a47a25260e765c6a035d2535bf572f92858e6b","observation_id":"938cea84-7f31-4bf3-8013-9df19ce2a5c9","resolution":{"observed_at":"2026-08-08T16:47:41.842795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-08T16:47:41.845963Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.845963Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:512ba148cc2f4f358519f89d466b04aaf3810bd5adbd2efefe085c6f68132267","observation_id":"3d79de2b-d3b6-4fa2-8119-71a5949e1554","resolution":{"observed_at":"2026-08-08T16:47:41.845963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07266","last_updated":"2025-05-27T02:56:52Z","snapshot_observed_at":"2026-08-18T12:35:17.774398Z","submitted_at":"2025-02-11T05:28:59Z","title":"When More is Less: Understanding Chain-of-Thought Length in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07266","snapshot_observed_at":"2026-08-08T16:47:41.849279Z","title":"When more is less: Understanding chain-of-thought length in llms.ArXiv, abs/2502.07266, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.849279Z"},"links":{"cited_paper":"/paper/2502.07266","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:7dc37e168d19090d2f2b23fbde20fbcb47d4bff7e4686eed615fc628d7bd423b","observation_id":"8e24a82e-fd46-47e4-a818-60ce8542ff9d","resolution":{"observed_at":"2026-08-08T16:47:41.849279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.852570Z","title":"Don’t overthink it","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.852570Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:cf801a5e055cf3bb7c5d593b61840f0d499e340d1d431a611ef24a9f9ef0a7aa","observation_id":"18919af5-3d33-4cf9-ba2d-292157395f06","resolution":{"observed_at":"2026-08-08T16:47:41.852570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-08T16:47:41.855996Z","title":"Distilling the knowledge in a neural network.arXiv preprint arXiv:1503.02531, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.855996Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:9af932a9a76592424e5cfe5fdb5f412ddc6b040ec726c64132a7ec87fa34a54b","observation_id":"cfeaea17-b462-46fd-8be8-6090e63fc58a","resolution":{"observed_at":"2026-08-08T16:47:41.855996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.859547Z","title":"Sequence-level knowledge distillation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.859547Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:a88620e8c99c293a569704adac7693baa9f3cef9c86862cf2fb87452b72e1a76","observation_id":"d2995293-38ed-4ca9-b24b-f8d0e7c717b7","resolution":{"observed_at":"2026-08-08T16:47:41.859547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13408","last_updated":"2025-05-19T17:44:26Z","snapshot_observed_at":"2026-08-18T22:16:09.351430Z","submitted_at":"2025-05-19T17:44:26Z","title":"CoT-Kinetics: A Theoretical Modeling Assessing LRM Reasoning Process","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13408","snapshot_observed_at":"2026-08-08T16:47:41.862715Z","title":"Cot-kinetics: A theoretical modeling assessing lrm reasoning process.ArXiv, abs/2505.13408, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.862715Z"},"links":{"cited_paper":"/paper/2505.13408","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:65c72d3170aa3c0b52f71db387407e93216f3b1c7b9067187be360103112875a","observation_id":"d0421358-6d0a-41bc-a84d-e9e81061e875","resolution":{"observed_at":"2026-08-08T16:47:41.862715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.865808Z","title":"EchoRL: Reinforcement learning via rollout echoing","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.865808Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:05b8a68a02bf97ec9b69525a4c05d47fb6c3fe53aa8e4b24fbfef589082e5efd","observation_id":"f9e318d0-216f-48d2-9da8-063db2e87e94","resolution":{"observed_at":"2026-08-08T16:47:41.865808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.19120","last_updated":"2026-06-19T10:05:34Z","snapshot_observed_at":"2026-08-17T11:06:26.567714Z","submitted_at":"2026-06-17T14:33:38Z","title":"Seeing Before Reasoning: Decoupling Perception and Reasoning for Shortcut-Resilient Multimodal On-Policy Self-Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.19120","snapshot_observed_at":"2026-08-08T16:47:41.868728Z","title":"Seeing before reasoning: Decoupling perception and reasoning for shortcut-resilient multimodal on-policy self-distillation.arXiv preprint arXiv:2606.19120, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.868728Z"},"links":{"cited_paper":"/paper/2606.19120","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:28b8416e53c9013fe7ff1228369c5b067ecfe42f9861c164bae87b8a9ad0120e","observation_id":"d0961669-044a-4ccd-be6c-6128c5833ef8","resolution":{"observed_at":"2026-08-08T16:47:41.868728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12119","last_updated":"2026-05-29T11:31:58Z","snapshot_observed_at":"2026-08-16T12:57:36.047964Z","submitted_at":"2025-02-17T18:43:41Z","title":"PRISM: Self-Pruning Intrinsic Selection Method for Training-Free Multimodal Data Selection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12119","snapshot_observed_at":"2026-08-08T16:47:41.871888Z","title":"Prism: Self- pruning intrinsic selection method for training-free multimodal data selection.ArXiv, abs/2502.12119,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.871888Z"},"links":{"cited_paper":"/paper/2502.12119","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:3ec86f19f756cd9d4a8595bd41afb2e1be84742761c36d6ca060389fe4b8b3cc","observation_id":"b9ef025d-63b8-40d7-814f-e6f10cb4c6f6","resolution":{"observed_at":"2026-08-08T16:47:41.871888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.879240Z","title":"Can visual input be compressed? a visual token compression benchmark for large multimodal models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.879240Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:35b337269b0711b3d83a9c29e6e5d6575e0694a4711de0935470cf76ed527c11","observation_id":"91c9a79a-ae49-4731-a22b-707d9a1f3a32","resolution":{"observed_at":"2026-08-08T16:47:41.879240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.881958Z","title":"Ascd: Attention-steerable contrastive decoding for reducing hallucination in mllm.Proceedings of the AAAI Conference on Artificial Intelligence, 40(12): 10306–10314, Mar","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.881958Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:3455b48e8dd9efe230db635b3478c3f223a55ca5f8a0871c8af4256b7c0ed41c","observation_id":"09b0b6dc-c9de-40ff-8713-0cfd24cae192","resolution":{"observed_at":"2026-08-08T16:47:41.881958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.19457","last_updated":"2026-04-07T03:23:13Z","snapshot_observed_at":"2026-08-18T22:18:27.770594Z","submitted_at":"2025-10-22T10:41:57Z","title":"MINED: Probing and Updating with Multimodal Time-Sensitive Knowledge for Large Multimodal Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.19457","snapshot_observed_at":"2026-08-08T16:47:41.885039Z","title":"Mined: Probing and updating with multimodal time-sensitive knowledge for large multimodal models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.885039Z"},"links":{"cited_paper":"/paper/2510.19457","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:9c8824710b50d86f4a3450443069effa15dd63f0b974c7d2150ba2a6f9f099c2","observation_id":"3960ff7c-0418-4ebe-a215-3d0b33d472ee","resolution":{"observed_at":"2026-08-08T16:47:41.885039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.875763Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.875763Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:8c1be458b1c431a1f031ca71821742118eb46dcfd3c2085cb1ae7acc971ee020","observation_id":"2b07d251-cb74-4932-b2aa-62eeeac04ac8","resolution":{"observed_at":"2026-08-08T16:47:41.875763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.19316","last_updated":"2026-05-07T10:32:29Z","snapshot_observed_at":"2026-08-16T11:57:37.819242Z","submitted_at":"2025-10-22T07:26:55Z","title":"KORE: Enhancing Knowledge Injection for Large Multimodal Models via Knowledge-Oriented Controls","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.19316","snapshot_observed_at":"2026-08-08T16:47:41.888680Z","title":"Kore: Enhancing knowledge injection for large multimodal models via knowledge-oriented augmentations and constraints, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.888680Z"},"links":{"cited_paper":"/paper/2510.19316","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:31d659894d693e97b33243478b7d9dff8b8a38b673be8dfcd895036f3ca3da4c","observation_id":"2e658217-1d48-4b4b-b506-bca35bec248c","resolution":{"observed_at":"2026-08-08T16:47:41.888680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.725852Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":483,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.725852Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:965bda1012d75c5f6af6db12a8506f689837b87258c3a404fa0088d6ce275da2","observation_id":"1e974154-47f1-47f6-b8ea-890b31dc9ab4","resolution":{"observed_at":"2026-08-08T16:47:41.725852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:47:41.744100Z","title":"https://thinkingmachines.ai/blog/on-policy-distillation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.744100Z"},"links":{"citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:11481fcb5846fa2cc7cba70b0b1bef807b0a31da865719b648ef29c774c93f5e","observation_id":"8d93984f-861c-4542-a334-2b3f02ea1762","resolution":{"observed_at":"2026-08-08T16:47:41.744100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.15932","last_updated":"2026-06-16T15:28:03Z","snapshot_observed_at":"2026-07-06T23:52:37.922109Z","submitted_at":"2026-06-14T17:21:43Z","title":"Beyond NL2Code: A Structured Survey of Multimodal Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.15932","snapshot_observed_at":"2026-08-08T16:47:41.718003Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-08T16:47:41.718003Z"},"links":{"cited_paper":"/paper/2606.15932","citing_paper":"/paper/2608.05131"},"observation_digest":"sha256:47af2130fd89e2e09d3acbb77454ce7dc290d03715be97cb16c976425cfb7f6f","observation_id":"9a0e09c0-0eba-4c85-84b6-bb1f5ed476ed","resolution":{"observed_at":"2026-08-08T16:47:41.718003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05131","last_updated":"2026-08-06T08:22:41Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T23:12:56.553078Z","submitted_at":"2026-08-05T17:53:06Z","title":"OPD-V: Visual On-Policy Self-Distillation with Modality Balance"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":49,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 1 inbound Pith citation observation for arXiv:2608.05131."}