{"as_of":"2026-08-22T20:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:25f7dabbf98e0848a6e0325bac1c321a8e15d4ebe7e098ad836b0bfba1d1bb9d","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T16:13:17.573307Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.28154/citation-record","integrity":"/paper/2607.28154/integrity","json":"/paper/2607.28154/citation-record.json","paper":"/paper/2607.28154"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T16:13:17.266524Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.266524Z"},"links":{"citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:572aa2c003230f3ae68675eac3021b0b28207ad0e4ebda10070f0cc23c742f27","observation_id":"efbfca01-863d-43ab-83b3-b0c4bff63c9a","resolution":{"observed_at":"2026-07-31T16:13:17.266524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T16:13:17.278960Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.278960Z"},"links":{"citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:3c88f88f517f912d04a1310acdc991dd7d71a29990801204bae4611a18334f5f","observation_id":"31672daf-69be-4393-8020-11d9e7edd583","resolution":{"observed_at":"2026-07-31T16:13:17.278960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00923","last_updated":"2024-05-20T06:43:48Z","snapshot_observed_at":"2026-08-21T19:00:44.723890Z","submitted_at":"2023-02-02T07:51:19Z","title":"Multimodal Chain-of-Thought Reasoning in Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00923","snapshot_observed_at":"2026-07-31T16:13:17.286960Z","title":"arXiv preprint arXiv:2302.00923 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.286960Z"},"links":{"cited_paper":"/paper/2302.00923","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:99b038c357721b1f4fff8cebdca8ce848e8bdc2e86e558cec67f5f83a5a6e662","observation_id":"08133fae-4588-40c0-9230-1d70dc38cf68","resolution":{"observed_at":"2026-07-31T16:13:17.286960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14362","last_updated":"2026-03-01T04:59:56Z","snapshot_observed_at":"2026-08-21T07:49:59.038746Z","submitted_at":"2025-05-20T13:48:11Z","title":"DeepEyes: Incentivizing \"Thinking with Images\" via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14362","snapshot_observed_at":"2026-07-31T16:13:17.294794Z","title":"arXiv preprint arXiv:2505.14362 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.294794Z"},"links":{"cited_paper":"/paper/2505.14362","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:955d3780ce45653d572cf591d24696393d797d8fbcb7ca963c8eed52315eac1a","observation_id":"d03149d2-1220-46fe-8be8-c84389268dd5","resolution":{"observed_at":"2026-07-31T16:13:17.294794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15436","last_updated":"2025-12-05T05:44:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-21T12:18:15Z","title":"Adaptive Chain-of-Focus Reasoning via Dynamic Visual Search and Zooming for Efficient VLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15436","snapshot_observed_at":"2026-07-31T16:13:17.305044Z","title":"arXiv preprint arXiv:2505.15436 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.305044Z"},"links":{"cited_paper":"/paper/2505.15436","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:488ddb6683a5db8dc70b11d96161760d33d084c389b6cd60f21c4b6cb8728bf2","observation_id":"b061f461-04e0-440a-be47-e91cd03ec2f6","resolution":{"observed_at":"2026-07-31T16:13:17.305044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T16:13:17.315848Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.315848Z"},"links":{"citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:24bc59792c08f165e1fc345f86cf7c4f3c104d162604b519e00bee0f68fe4941","observation_id":"2307b368-701f-4a36-b7b6-08dc6ca3a7bc","resolution":{"observed_at":"2026-07-31T16:13:17.315848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T16:13:17.332394Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.332394Z"},"links":{"citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:eb29260fb8ed51941bfa96722ee4441fd3f1216e2d6fd98c899fa292b88ae2e5","observation_id":"d689afc4-eaa7-45b4-8e6d-f6a8d11675fc","resolution":{"observed_at":"2026-07-31T16:13:17.332394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-17T06:12:37.525438Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-07-31T16:13:17.340022Z","title":"arXiv preprint arXiv:2412.06769 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.340022Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:13254770a59ea238f31ebba16f3ffa13db19fff6321892e11e38e157ceecdcab","observation_id":"193810e4-9f61-4131-b1ab-663b29347c24","resolution":{"observed_at":"2026-07-31T16:13:17.340022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.04476","last_updated":"2026-05-12T10:07:13Z","snapshot_observed_at":"2026-08-11T01:23:00.247206Z","submitted_at":"2026-02-04T12:04:02Z","title":"Vision-aligned Latent Reasoning for Multi-modal Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.04476","snapshot_observed_at":"2026-07-31T16:13:17.350563Z","title":"arXiv preprint arXiv:2602.04476 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.350563Z"},"links":{"cited_paper":"/paper/2602.04476","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:9e2b3daea0ab0cd60f4049a2f296e68ea809ea7de30e9691ac1fce7b14ece073","observation_id":"667f354f-03bf-43ed-9332-91f73713d5b5","resolution":{"observed_at":"2026-07-31T16:13:17.350563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T16:13:17.356506Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.356506Z"},"links":{"citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:f8de7a1da7eae9512fce282511979e97155b6464cfd8e815507579e6d088e441","observation_id":"3606acac-a121-4a0e-91e3-4a30304a7ec2","resolution":{"observed_at":"2026-07-31T16:13:17.356506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16999","last_updated":"2024-11-04T05:50:56Z","snapshot_observed_at":"2026-08-16T14:06:34.438455Z","submitted_at":"2024-03-25T17:59:23Z","title":"Visual CoT: Advancing Multi-Modal Language Models with a Comprehensive Dataset and Benchmark for Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16999","snapshot_observed_at":"2026-07-31T16:13:17.366575Z","title":"arXiv preprint arXiv:2403.16999 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.366575Z"},"links":{"cited_paper":"/paper/2403.16999","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:699538fa90197404a5e3da817d3faf6d41372c87d28eddc8df936aea1f07157d","observation_id":"c033642c-60a7-4408-9949-bd55076bc182","resolution":{"observed_at":"2026-07-31T16:13:17.366575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13872","last_updated":"2024-05-29T02:24:36Z","snapshot_observed_at":"2026-08-16T13:50:31.641345Z","submitted_at":"2024-05-22T17:56:51Z","title":"Image-of-Thought Prompting for Visual Reasoning Refinement in Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13872","snapshot_observed_at":"2026-07-31T16:13:17.377287Z","title":"arXiv preprint arXiv:2405.13872 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.377287Z"},"links":{"cited_paper":"/paper/2405.13872","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:59493b6d7c0866bb0564995bd4c59843f7771feccdfed94a5ff4e1abe4bb82e4","observation_id":"487bb3fd-8ebb-4d00-a682-05f2a4364431","resolution":{"observed_at":"2026-07-31T16:13:17.377287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12799","last_updated":"2025-03-24T11:30:58Z","snapshot_observed_at":"2026-08-16T12:49:29.988082Z","submitted_at":"2025-03-17T04:07:47Z","title":"Grounded Chain-of-Thought for Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12799","snapshot_observed_at":"2026-07-31T16:13:17.383178Z","title":"arXiv preprint arXiv:2503.12799 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.383178Z"},"links":{"cited_paper":"/paper/2503.12799","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:869502d79c49014e1ff1f591196a02d3a988ad088ecf7d620b7e70c1890b1f58","observation_id":"5c1400db-a6ca-4bb0-afa2-ed604e0e375d","resolution":{"observed_at":"2026-07-31T16:13:17.383178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23766","last_updated":"2025-05-29T17:59:56Z","snapshot_observed_at":"2026-08-15T12:59:59.091660Z","submitted_at":"2025-05-29T17:59:56Z","title":"Argus: Vision-Centric Reasoning with Grounded Chain-of-Thought","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23766","snapshot_observed_at":"2026-07-31T16:13:17.389147Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.389147Z"},"links":{"cited_paper":"/paper/2505.23766","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:36bcc287de3a82088aa87adbced2aa08d5646a3754b6718264e6909b8e489b47","observation_id":"05d5a947-1c4f-410d-a019-dc3e9c4702cf","resolution":{"observed_at":"2026-07-31T16:13:17.389147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11991","last_updated":"2026-05-01T04:30:18Z","snapshot_observed_at":"2026-08-15T04:02:04.964450Z","submitted_at":"2025-06-13T17:47:43Z","title":"VGR: Visual Grounded Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11991","snapshot_observed_at":"2026-07-31T16:13:17.394521Z","title":"arXiv preprint arXiv:2506.11991 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.394521Z"},"links":{"cited_paper":"/paper/2506.11991","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:feb9e33146605c5a397ee7557f5ac8390e923b8af9641a969b0db15fb69a3637","observation_id":"605e9097-1e2c-4765-9007-ef4e18b46c50","resolution":{"observed_at":"2026-07-31T16:13:17.394521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-08-15T22:45:25.590250Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-07-31T16:13:17.400413Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.400413Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:d53fa0a13a2b6394bfcd8f2ecc79e556e6ba99df82c7ca9fd2c369e75a770e87","observation_id":"0608c6b9-0449-4965-9822-d85057b798a4","resolution":{"observed_at":"2026-07-31T16:13:17.400413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.08464","last_updated":"2026-06-07T05:58:39Z","snapshot_observed_at":"2026-08-15T15:16:57.255291Z","submitted_at":"2026-06-07T05:58:39Z","title":"TVI-CoT: Text-Visual Interleaved Chain-of-Thought Reasoning for Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.08464","snapshot_observed_at":"2026-07-31T16:13:17.406614Z","title":"arXiv preprint arXiv:2606.08464 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.406614Z"},"links":{"cited_paper":"/paper/2606.08464","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:38dac42e5a5e29939644146c921e1be894f451f438af396b03500d9b8b739cbc","observation_id":"43b6c382-033a-4e3d-a13e-60c13f857deb","resolution":{"observed_at":"2026-07-31T16:13:17.406614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T16:13:17.423270Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.423270Z"},"links":{"citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:957f0b93da8b44437d6b3ebcfd8e81314f35a17c9d5bbaec4853b1f6bf36c637","observation_id":"a721350e-d124-47b0-9046-f30dac698500","resolution":{"observed_at":"2026-07-31T16:13:17.423270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T16:13:17.431873Z","title":"Proceedings of the 42nd International Conference on Machine Learning , series =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.431873Z"},"links":{"citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:243dc4b1cd10dc718d93b3cd8654e72da12f81f6d7e93d4db3226df8c54d63c1","observation_id":"9b865099-eb63-44dd-8dc8-6d44cc596857","resolution":{"observed_at":"2026-07-31T16:13:17.431873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22525","last_updated":"2025-05-28T16:12:45Z","snapshot_observed_at":"2026-08-17T08:25:58.418151Z","submitted_at":"2025-05-28T16:12:45Z","title":"Thinking with Generated Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22525","snapshot_observed_at":"2026-07-31T16:13:17.436811Z","title":"arXiv preprint arXiv:2505.22525 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.436811Z"},"links":{"cited_paper":"/paper/2505.22525","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:5bda49a2579ab0eb7a5c215285639f673e23de58f32323576d2ae3ba36710e7c","observation_id":"705ca317-21e5-4db6-ad7f-2798b656a2ad","resolution":{"observed_at":"2026-07-31T16:13:17.436811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T16:13:17.452696Z","title":"arXiv preprint arXiv:2606.16783 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.452696Z"},"links":{"citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:4575fa525fc15ae4e3832503b1edb5300b9630cbd0f55e8bb138fe041b2ea740","observation_id":"95a7cfe0-d304-41ab-9afd-4c2145171e5a","resolution":{"observed_at":"2026-07-31T16:13:17.452696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T16:13:17.460928Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.460928Z"},"links":{"citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:586ebe7317ac02107f6849e061087218147ac9af9918132db62516edeb497dc8","observation_id":"232757da-2f90-49d9-ba41-62b1376d95ec","resolution":{"observed_at":"2026-07-31T16:13:17.460928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T16:13:17.472038Z","title":"arXiv preprint arXiv:2603.01893 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.472038Z"},"links":{"citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:b38a3ce60cae2cd7e51a0d57a9df542692aa33c593e814e659df558f49259373","observation_id":"b7debf5e-671d-47be-bebb-d76d7285c49a","resolution":{"observed_at":"2026-07-31T16:13:17.472038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24251","last_updated":"2025-10-05T04:01:18Z","snapshot_observed_at":"2026-08-10T21:20:13.670725Z","submitted_at":"2025-09-29T03:52:01Z","title":"Latent Visual Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.24251","snapshot_observed_at":"2026-07-31T16:13:17.486483Z","title":"arXiv preprint arXiv:2509.24251 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.486483Z"},"links":{"cited_paper":"/paper/2509.24251","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:a4e1a4b7d114bf2836496ade582dac382d56bccbf22581ad0c8a7314fa239596","observation_id":"9cc7b059-a2e5-4e12-8b8e-b32187e21111","resolution":{"observed_at":"2026-07-31T16:13:17.486483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17218","last_updated":"2025-06-20T17:59:31Z","snapshot_observed_at":"2026-08-13T03:28:19.590253Z","submitted_at":"2025-06-20T17:59:31Z","title":"Machine Mental Imagery: Empower Multimodal Reasoning with Latent Visual Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17218","snapshot_observed_at":"2026-07-31T16:13:17.497272Z","title":"arXiv preprint arXiv:2506.17218 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.497272Z"},"links":{"cited_paper":"/paper/2506.17218","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:a8bbceb738b3c3f00e2599520af4206d11718393b91e83f538bc98525b513c63","observation_id":"2dd301e0-1288-4f03-aad9-e60e3a6b54d8","resolution":{"observed_at":"2026-07-31T16:13:17.497272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T16:13:17.504510Z","title":"arXiv preprint arXiv:2512.16584 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.504510Z"},"links":{"citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:00c77f8caa8f6429e43968d6d1059d4b940e0e5c5b3fda8f01deb035bf51cc1e","observation_id":"9d058208-4e7c-4c2a-b036-a37f5bbad6e0","resolution":{"observed_at":"2026-07-31T16:13:17.504510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.06803","last_updated":"2026-04-20T09:04:42Z","snapshot_observed_at":"2026-08-11T12:24:59.401094Z","submitted_at":"2026-01-11T08:30:49Z","title":"Forest Before Trees: Latent Superposition for Efficient Visual Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.06803","snapshot_observed_at":"2026-07-31T16:13:17.513246Z","title":"arXiv preprint arXiv:2601.06803 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.513246Z"},"links":{"cited_paper":"/paper/2601.06803","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:5969428459bef09c1d8c443dfde2764ee2b8f162a99f2c031dca09bed21e4405","observation_id":"553ae65b-597c-4a82-a8f6-4032e6af916e","resolution":{"observed_at":"2026-07-31T16:13:17.513246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T16:13:17.522000Z","title":"Findings of the Association for Computational Linguistics: NAACL 2025 , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.522000Z"},"links":{"citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:679cdeccaf55a138ec1a76c6cc55b1f3ec2dae81d88580df3ccd7d4f2dc9bd9a","observation_id":"4f2f6bb0-08bb-4fd8-98ee-aa36cee72a18","resolution":{"observed_at":"2026-07-31T16:13:17.522000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T16:13:17.533526Z","title":"arXiv preprint arXiv:2507.16746 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.533526Z"},"links":{"citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:4912e1bbf16187a13673243fed8d7ce7c39a15fcabd0f996ee45391c1905f5d4","observation_id":"ca887fd2-53b0-4e3e-95d8-df9476e5af1c","resolution":{"observed_at":"2026-07-31T16:13:17.533526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T16:13:17.539673Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.539673Z"},"links":{"citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:b878950304c4bc007482876e570742fff35f03f4bf405abb0996b5db36206bf7","observation_id":"a5e9d44a-ea2b-41d7-8fc4-96d4f4fcd7c1","resolution":{"observed_at":"2026-07-31T16:13:17.539673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.20328","snapshot_observed_at":"2026-07-31T16:13:17.560110Z","title":"arXiv preprint arXiv:2604.20328 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.560110Z"},"links":{"cited_paper":"/paper/2604.20328","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:5843e1f645c402d8157f7fc7f947fd6fbc1daf52264a95793a8e20d2d281f2ee","observation_id":"8713d1dc-cb60-4e01-b1e3-bb1cd2f1d69f","resolution":{"observed_at":"2026-07-31T16:13:17.560110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22766","last_updated":"2026-06-07T11:29:15Z","snapshot_observed_at":"2026-08-06T01:15:52.220969Z","submitted_at":"2026-02-26T08:56:23Z","title":"Imagination Helps Visual Reasoning, But Not Yet in Latent Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.22766","snapshot_observed_at":"2026-07-31T16:13:17.566716Z","title":"arXiv preprint arXiv:2602.22766 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.566716Z"},"links":{"cited_paper":"/paper/2602.22766","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:2d37ca6f8bf910c88207827bac817beaca1fdf0100807a0c42defd01ef43ed44","observation_id":"e5f1ee6e-e977-453f-a050-81c227dbd18e","resolution":{"observed_at":"2026-07-31T16:13:17.566716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.02735","last_updated":"2026-05-04T15:36:12Z","snapshot_observed_at":"2026-08-18T22:45:54.392550Z","submitted_at":"2026-05-04T15:36:12Z","title":"Visual Latents Know More Than They Say: Unsilencing Latent Reasoning in MLLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.02735","snapshot_observed_at":"2026-07-31T16:13:17.573307Z","title":"arXiv preprint arXiv:2605.02735 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.573307Z"},"links":{"cited_paper":"/paper/2605.02735","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:3fcec7e57223732a64e8732060567bb32092af7d5a62d26a05eeb5f355c19e74","observation_id":"577b9ca7-52c3-4b31-a8f4-fca40918c88f","resolution":{"observed_at":"2026-07-31T16:13:17.573307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2607.28154."}