Pith. sign in

Paper Citation Record · LEDGER

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation

As of 6 August 2026, this Paper Citation Record lists 98 of 98 outbound references and 0 inbound Pith citation observations for arXiv:2607.28590.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.28590 v1

Coverage vector

measured 98 of 98 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-07-31T02:56:58.321943Z

measured 98 of 98 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-06T06:34:29.942622+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

98 of 98 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved98
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation a387e034-fcee-445a-8521-a19c11473b38 · outbound

This paper cites 2015 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2015 , eprint=

Reference 1

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:51.603880Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:51.603880Z digest=sha256:7a607188932391161d9118cd8a22e4c6fb6eb00c0b7afd9618c2f63cd8313337

Observation c7c44410-f026-47be-91fc-460cd082ec35 · outbound

This paper cites 2024 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2024 , eprint=

Reference 3

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:51.769941Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:51.769941Z digest=sha256:6249482fbfc4091d963abc64134651c985283360f1502f62347642ae847a29fa

Observation 13f5a1f2-e943-409e-913a-af86f8fb0dc7 · outbound

This paper cites 2023 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2023 , eprint=

Reference 4

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:51.838304Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:51.838304Z digest=sha256:87baa800de68a511269a31dab9275a17f8e613f714d484a925447078d274ae4b

Observation e45ed18f-e725-4fda-9401-5d05556582b7 · outbound

This paper cites 2023 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2023 , eprint=

Reference 5

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:51.898625Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:51.898625Z digest=sha256:4c9a90165f12d1c27b10eabe161c5470ce7ad473e6df205038fdd9beae3a4e64

Observation d8246cb3-95ee-4cba-9f63-a698d0d2e7e4 · outbound

This paper cites 2023 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2023 , eprint=

Reference 6

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:51.958674Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:51.958674Z digest=sha256:1f13958c35e227efcbae0b15fc16cf8a9014ca0ce83c4a1e0a082250c376ae7e

Observation c5b04e63-a357-4e47-9e53-a58c70d6d4ea · outbound

This paper cites 2024 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2024 , eprint=

Reference 7

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:52.014306Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:52.014306Z digest=sha256:f17dbc41110405ec252459528053fe3dea5bf39bdfe774d3259e4bf3e3272027

Observation 1d751689-020f-43ad-90f8-b7f738b8082d · outbound

This paper cites 2025 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2025 , eprint=

Reference 8

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:52.160849Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:52.160849Z digest=sha256:12f2506b20c776673a82b2902db55b51da4d1cc1d885edef9dfaef1621d6affc

Observation 775c6036-8af5-46bd-969d-85ba917221df · outbound

This paper cites 2023 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2023 , eprint=

Reference 9

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:52.249557Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:52.249557Z digest=sha256:1fa87fbf8e18a2e0bf26233179923bc5b7afd36e9fc0e4e9b452cdba67ce118b

Observation d775d955-791c-411d-be1c-9fe49a1e83f2 · outbound

This paper cites 2025 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2025 , eprint=

Reference 10

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:52.334165Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:52.334165Z digest=sha256:8a5226983dc97555c1e2c90945bc431d0c53a58543b690051a567d052019fac4

Observation b6d9869b-3471-4cd2-b1b5-a75dcef6acd0 · outbound

This paper cites 2024 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2024 , eprint=

Reference 11

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:52.428511Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:52.428511Z digest=sha256:a007025154284422963435f725877bde370a4c39e025de39c6943019b30bbe0f

Observation 101f9169-3cd9-4e91-9084-2fc724c5fc34 · outbound

This paper cites 2025 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2025 , eprint=

Reference 12

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:52.606698Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:52.606698Z digest=sha256:1bfca33a3eab23c793da897f3bec8974f63836c0d18be789d37db964a80acc28

Observation 296f07ab-ee6f-4066-a6f7-f8e5d7215ba0 · outbound

This paper cites 2026 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint=

Reference 13

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:52.672035Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:52.672035Z digest=sha256:7fdac3f102d45ad2d56fc9450d334921d59946f4f666421aa62c8127bb6c57a1

Observation 438dcbba-7977-4ef8-b51d-bf6a5febe3d5 · outbound

This paper cites 2026 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint=

Reference 14

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:52.726731Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:52.726731Z digest=sha256:e17e7c44b7a6bd4f2251eafa29550b8e9600581b5b6c943982c34bac46fe0997

Observation 80388580-485c-418d-a4b7-83ce3de7222a · outbound

This paper cites 2026 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint=

Reference 15

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:52.794479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:52.794479Z digest=sha256:19d5686f2925f16b78dc9a9ac45b3e15f8ff66463a3bf08a1a360ce707e38b24

Observation 5c120f74-fa82-421e-b096-c17eecf9175b · outbound

This paper cites 2026 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint=

Reference 16

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:52.844657Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:52.844657Z digest=sha256:09ffc8694aeed0727f335238c0a3e3ab97674bfaa5aada35ab4eac339df8ebdd

Observation ad3da30e-c502-4a77-a6e1-e4718e141765 · outbound

This paper cites 2026 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint=

Reference 17

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:52.909718Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:52.909718Z digest=sha256:c21de1034b3600365ae31d0924516ec266d24c062758605a44d6f737c05123e2

Observation 900a5af7-bd68-49e0-ad93-e0bb97aedf9d · outbound

This paper cites 2026 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint=

Reference 18

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:52.998495Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:52.998495Z digest=sha256:820918dc9bff0b45d5ba01fecf8f98445c3f3bc5d8bd4bdd62c1c6a13cf3dd02

Observation ac85da2f-73be-4f84-af69-d6ae59efd5fb · outbound

This paper cites 2026 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint=

Reference 19

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:53.087068Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:53.087068Z digest=sha256:47243f6fa720f37b2dfedbbe64e880cb705289342b351ec5366d6bd3995f3de5

Observation d1627e28-be58-4b89-bed7-a4e13860324c · outbound

This paper cites 2026 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint=

Reference 20

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:53.153981Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:53.153981Z digest=sha256:ce309e18eca40884759ee62b8ad9b7258599778115ab8b9aedcae1fcf31432ae

Observation b8c103dc-acfd-4160-9618-feacd07c1d9b · outbound

This paper cites 2024 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2024 , eprint=

Reference 21

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:53.238266Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:53.238266Z digest=sha256:0229c224ae8b98b232e16115f15fc8e71e286753abafdd4aa9ee6e842b8fd793

Observation 06466097-af7f-4b6f-871b-8d9d5076ea3e · outbound

This paper cites 2024 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2024 , eprint=

Reference 22

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:53.332401Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:53.332401Z digest=sha256:092b19fc076c2be3c608e66e051fc37fd9d5a16efa441c7eecd87e7945745752

Observation 8a87aff6-9cb2-4a1f-8c84-84454789813d · outbound

This paper cites 2024 , eprint=.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2024 , eprint=

Reference 23

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:53.465378Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:53.465378Z digest=sha256:f9649b9064e68aa77553a5d24379e94fd5955682d8179118dc324df1591566a8

Observation fbdc0947-e415-4a64-a8c5-cfac4d11a728 · outbound

This paper cites MiniLLM: Knowledge Distillation of Large Language Models , url =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation MiniLLM: Knowledge Distillation of Large Language Models , url =

Reference 25

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:53.613940Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:53.613940Z digest=sha256:db1366cee50e3318fea8b17090a65a8db241ccdf8cff40a7426bbdcc8d07e873

Observation 2ce2fa63-c8b7-46f7-8be9-64f4d341d266 · outbound

This paper cites 2024 , editor =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2024 , editor =

Reference 26

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:53.732302Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:53.732302Z digest=sha256:f3c48e130bc7d1e25686a9d825fdd7b359e388009b33d21980183dba852ec375

Observation 3fa76670-16ce-4aee-a302-5dc26f5ad98d · outbound

This paper cites 2025 , editor =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2025 , editor =

Reference 27

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:53.853292Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:53.853292Z digest=sha256:be13632770c7e2d3a5d427c53b94945fe8f252df21b9fa28581a7f45620e7f05

Observation 332ee0d0-cc18-4b5c-872a-6abd0e8d00ed · outbound

This paper cites 2026 , eprint =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint =

Reference 28

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:53.968553Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:53.968553Z digest=sha256:0b728fb9989c3b45ef0c488280268c4b3b0e89257726fec8cbd965d0a86cddd0

Observation 65b8193b-6e56-4853-872b-d47431d2663f · outbound

This paper cites 2024 , eprint =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2024 , eprint =

Reference 29

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:54.095439Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:54.095439Z digest=sha256:552b0f0f6ec9d6bed06b67c37d3762ce69bd0dd8cd44c968d34a28ba1eec73de

Observation c7312312-a6e7-4007-a367-c83644ad461f · outbound

This paper cites 2024 , eprint =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2024 , eprint =

Reference 30

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:54.235776Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:54.235776Z digest=sha256:1373279bbff9e35e6ed460e52c62ca123c5f88807b35a3ed64f65c83d38be998

Observation ac097d46-05f1-4f81-b090-6c332c6e57d9 · outbound

This paper cites Z oom E ye: Enhancing Multimodal LLM s with Human-Like Zooming Capabilities through Tree-Based Image Exploration.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Z oom E ye: Enhancing Multimodal LLM s with Human-Like Zooming Capabilities through Tree-Based Image Exploration

Reference 31

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:54.322610Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:54.322610Z digest=sha256:da626872c92bd59e1b9288f86cd53c6e2762bf81b2a2c2e9774086ed9d8573ef

Observation 038328f3-90f4-4cf9-8d1c-d4a6f8395b49 · outbound

This paper cites 2025 , eprint =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2025 , eprint =

Reference 32

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:54.439920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:54.439920Z digest=sha256:6c8970094948f2c95c24cec7be5a36633ff721c0c9f0eaad1c56aa71ffb20b4e

Observation 0a746129-2a21-4d33-8f45-6578281f02bb · outbound

This paper cites Thinking with Images.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Thinking with Images

Reference 33

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:54.558206Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:54.558206Z digest=sha256:9f256fda915919341dcb404076a2ca1f47071caa6d82e4d877d7c441de9d0aa9

Observation 5718387f-4155-44ed-985f-ffae335d429c · outbound

This paper cites 2025 , eprint =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2025 , eprint =

Reference 34

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:54.659683Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:54.659683Z digest=sha256:63a1340173d8929ace7768ec2d0b84aae6cee0d91293506d356a1214a1caa801

Observation 9dc4a51d-8c50-4b99-a85c-0c72678263a5 · outbound

This paper cites 2026 , eprint =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint =

Reference 35

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:54.794511Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:54.794511Z digest=sha256:91a5dba007aebc0ccc2a6097df4f27d03f5c9b6c324b183a9bb49e4202ed09da

Observation 0b190101-bde2-405b-9fac-298517c583f6 · outbound

This paper cites 2026 , eprint =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint =

Reference 36

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:54.910315Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:54.910315Z digest=sha256:717b3501287bb9a85a7d816a3b6531d902cdab55347000249f7257e459a40b8c

Observation 70868d82-ab1d-418b-8a01-fda6ff8dc8e5 · outbound

This paper cites Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =

Reference 37

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:55.023879Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:55.023879Z digest=sha256:32a87c9b84fbcfea1a6515bb1cb49c1b31a41009ced41281e00816d29975199c

Observation 513248d4-59b6-440b-8bdc-17a20dabafed · outbound

This paper cites 2024 , editor =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2024 , editor =

Reference 38

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:55.082239Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:55.082239Z digest=sha256:b652e5d494e0bd30eef940337d29b0a54437d32bedafdaf5e687c87f70ea3c8c

Observation a04a5816-0c96-4b1d-8088-9751d2250cb0 · outbound

This paper cites 2024 , eprint =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2024 , eprint =

Reference 39

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:55.131875Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:55.131875Z digest=sha256:8054b7d497366702c700ff9115631b56961ed140626cea86c75007451e28d534

Observation b067e561-9dc4-4fc5-9e58-73542515b02b · outbound

This paper cites 2026 , eprint =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint =

Reference 40

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:55.187346Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:55.187346Z digest=sha256:9dab83984455bf4667cb92e341d71560d46a2c2f83ea9be5741ab90da2a60a11

Observation 4fd0e318-580f-42bf-8b40-a96b0dac46b0 · outbound

This paper cites 2026 , eprint =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint =

Reference 41

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:55.283957Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:55.283957Z digest=sha256:695a1a177e69e1d5e5186df60b16b1757f4ce808d3ff4c03f9e269b16b255ff0

Observation 018113aa-2621-4c52-a69a-7deb8e6bef00 · outbound

This paper cites 2026 , eprint =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint =

Reference 42

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:55.346902Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:55.346902Z digest=sha256:2b26ce7416e77cec40d6bb91a3d94eb1d21621e27b9857ea83436d44bce2500e

Observation 451b73b6-0a13-4c13-9e69-329c0545da46 · outbound

This paper cites 2026 , eprint =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , eprint =

Reference 43

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:55.432799Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:55.432799Z digest=sha256:12f80e77d44a288237052e48b743420d52fa8cdb4020a4f3f5a064186a1f6086

Observation d44c8b8e-e3be-4e59-8ab5-3dbb0aa1baa9 · outbound

This paper cites an unresolved cited work.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Unresolved cited work

Reference 46

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:55.602974Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:55.602974Z digest=sha256:fcd03b4f3ab0269f8919e0e7e21019d9f81838084826937874795b0c925dae5d

Observation 0d8100ba-7859-4530-998f-f5ce6117c450 · outbound

This paper cites an unresolved cited work.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Unresolved cited work

Reference 47

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:55.654826Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:55.654826Z digest=sha256:827bc2f2c2424c7122636c4e95634d7d3048751dc27181a5c0b1c819c3a0d5c0

Observation e6c9aa16-9af4-4c6b-8ea4-b6dd1bd111b5 · outbound

This paper cites 2025 , month = dec, url =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2025 , month = dec, url =

Reference 48

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:55.722342Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:55.722342Z digest=sha256:7ef615e9bc1ab6d59cbb71cc001983033af48959281085f4e989e59f2c300ae2

Observation 7f862e55-f281-486b-81b4-fea5cd230bad · outbound

This paper cites 2026 , month = mar, url =.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation 2026 , month = mar, url =

Reference 49

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:55.794643Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:55.794643Z digest=sha256:01254861f40907c4d4eb9efb2d01cc5e55184776f9a19fc2730df360b79d3bd0

Observation e655b7a6-4b7f-416d-b9af-74149f092054 · outbound

This paper cites gpt-oss-120b & gpt-oss-20b Model Card.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation gpt-oss-120b & gpt-oss-20b Model Card

Reference 50

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:55.865931Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:55.865931Z digest=sha256:73ab090acebd0d263b0586ad8f62226815b601912c63ef43ceafdad51155236a

Observation 1938315e-b872-4745-a975-8a8034d2a6c4 · outbound

This paper cites On-Policy Distillation of Language Models: Learning from Self-Generated Mistakes.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation On-Policy Distillation of Language Models: Learning from Self-Generated Mistakes

Reference 51

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:55.930939Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:55.930939Z digest=sha256:26a8b7110e14f29864510201f60f7da6231250dbd633a0596f5172a524018a81

Observation 2e93543f-b346-455c-8fe8-8d64fefd2f6d · outbound

This paper cites Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond

Reference 52

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.011512Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.011512Z digest=sha256:26143fe0626088fb85df9e41c14a3bd8a81f4c15f7e1a4420c180e4fe3477ca6

Observation 1d26f997-8c89-48bb-a4a9-4df95d2769da · outbound

This paper cites Qwen3-VL Technical Report.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Qwen3-VL Technical Report

Reference 53

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.082602Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.082602Z digest=sha256:5494cf697492dccedbab3319ad0684eb66c872d691170168061496b1a71e1f30

Observation f5b8d6b5-c501-49de-8289-d59457e1b00b · outbound

This paper cites Qwen2.5-VL Technical Report.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Qwen2.5-VL Technical Report

Reference 54

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.144169Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.144169Z digest=sha256:df66c42829338c4ac895c9265f47fa51d6ebc3210979c2304fc5cb9a62ac7fde

Observation 4548282f-c229-4924-b451-8d15dbf63cfd · outbound

This paper cites Are We on the Right Way for Evaluating Large Vision-Language Models?.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Are We on the Right Way for Evaluating Large Vision-Language Models?

Reference 55

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.215062Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.215062Z digest=sha256:4d191263945431ce51da129402f10898197c3bba22c77c43c81b91ff2658ad47

Observation 3218f434-ea87-4e07-8468-b59c004dcb80 · outbound

This paper cites HALC : Object hallucination reduction via adaptive focal-contrast decoding.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation HALC : Object hallucination reduction via adaptive focal-contrast decoding

Reference 56

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.290766Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.290766Z digest=sha256:ab1207eecdf4d190e1e3ae12573963a9b14319c6a007313acbd0604ce963ce17

Observation ea88f219-adae-4354-9401-d06e604a6473 · outbound

This paper cites Sensenova-mars: Empowering multimodal agentic reasoning and search via reinforcement learning, 2026.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Sensenova-mars: Empowering multimodal agentic reasoning and search via reinforcement learning, 2026

Reference 57

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.332882Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.332882Z digest=sha256:466d32e32282cdb127ee30b7d8711d4a16a36ccb03545c6524ecabb3a57ee4b4

Observation 165a4110-47d4-47bc-bb99-e5adb046a304 · outbound

This paper cites InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning

Reference 58

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.391695Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.391695Z digest=sha256:38df3cbe406f40ff1d96be3a4c4148fa4b00b418a2d3ad8cc4e9a04927fa24ee

Observation 84d35572-6fcf-4aa5-89c6-796679fd1500 · outbound

This paper cites ReFocus: Visual Editing as a Chain of Thought for Structured Image Understanding.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation ReFocus: Visual Editing as a Chain of Thought for Structured Image Understanding

Reference 59

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.445550Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.445550Z digest=sha256:1abeb0fd45b99d417619da16df76e7374c40d16734b516b2af867d3aae5ca0f2

Observation 7bcf449f-18a7-4723-80d1-e290462b7e9d · outbound

This paper cites Thinking with deltas: Incentivizing reinforcement learning via differential visual reasoning policy, 2026.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Thinking with deltas: Incentivizing reinforcement learning via differential visual reasoning policy, 2026

Reference 60

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.482479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.482479Z digest=sha256:0c7b6f680270d7165086faeb2a5ea66f6b866f7a75f6eab21e138e17c72c74ef

Observation 6ff9db73-4674-407c-ba9f-198d89862a74 · outbound

This paper cites Gemini 3 Flash : Model card, December 2025.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Gemini 3 Flash : Model card, December 2025

Reference 61

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.551166Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.551166Z digest=sha256:c1213a84e26f499cbf22b00ae49e228d4afb6aadea0b8d1109fd1149664feb01

Observation ea7c6b6f-6d8f-41d3-bd5f-73d881148b81 · outbound

This paper cites Gemini 3.1 Pro : Model card, February 2026.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Gemini 3.1 Pro : Model card, February 2026

Reference 62

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.584562Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.584562Z digest=sha256:a8dca72c9191a1fa95f7d144600fe9b879821660c1d859655636c5db76c6e01c

Observation 442adfdb-05ff-4489-9cb7-b23f6b3728aa · outbound

This paper cites Minillm: Knowledge distillation of large language models.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Minillm: Knowledge distillation of large language models

Reference 63

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.648037Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.648037Z digest=sha256:9e9cbce57679befadd9b22c139a395464bf23c85c76a1f5b3c1b0d0a6e8f2256

Observation 329ff58e-4ee0-41f8-a2ec-9df6b85eb0c4 · outbound

This paper cites Distilling the Knowledge in a Neural Network.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Distilling the Knowledge in a Neural Network

Reference 64

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.690989Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.690989Z digest=sha256:b73329a2c6321381fbb8ac474efd6a2d14656da01599d50a22793b7aeeaa816b

Observation 73f3ba72-d8c8-46b2-900d-02b0538646af · outbound

This paper cites DeepEyesV2: Toward Agentic Multimodal Model.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation DeepEyesV2: Toward Agentic Multimodal Model

Reference 65

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.780851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.780851Z digest=sha256:1370a8d7089f01a8007418ce2406658fd5808f7151b1ffeedbeb632638d6bd92

Observation 45bab644-faa5-47cc-954e-4fbad2161d51 · outbound

This paper cites an unresolved cited work.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Unresolved cited work

Reference 66

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.868155Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.868155Z digest=sha256:90be2f6f7eeed319c6bc541ba54f85c4fb4bb059a0b80d5f3e8e38201100b47d

Observation 80bbd39a-cf24-40d5-9453-2472813fa6c8 · outbound

This paper cites D isti LLM : Towards streamlined distillation for large language models.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation D isti LLM : Towards streamlined distillation for large language models

Reference 67

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:56.931558Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:56.931558Z digest=sha256:cea9f04b69308207012968fbe71d099243b44f162e1fe48e49ee7d6896281d72

Observation c062be7e-f3f2-40c4-a765-da27d7c36d59 · outbound

This paper cites D isti LLM -2: A contrastive approach boosts the distillation of LLM s.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation D isti LLM -2: A contrastive approach boosts the distillation of LLM s

Reference 68

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:57.012108Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:57.012108Z digest=sha256:f5dbebf29812ec3b6672fed09681786ece3314b87b8076840eab51d28be819d9

Observation b6858d32-aa28-412d-bd2e-cee69eb4cc7c · outbound

This paper cites Delve into Visual Contrastive Decoding for Hallucination Mitigation of Large Vision-Language Models.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Delve into Visual Contrastive Decoding for Hallucination Mitigation of Large Vision-Language Models

Reference 69

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:57.075696Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:57.075696Z digest=sha256:835e3e3ea2ad546d9d9795e2ab64e555edd3bd529fc7f87f0e63802b03ecf4a5

Observation 1df67567-5be9-4880-878c-5abc0ff7e2ad · outbound

This paper cites Mitigating object hallucinations in large vision-language models through visual contrastive decoding.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Mitigating object hallucinations in large vision-language models through visual contrastive decoding

Reference 70

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:57.131651Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:57.131651Z digest=sha256:731202d816ef5917fb880174eaf1f3762625d743d31fdfd83e050631d944dde0

Observation 67276e56-415a-41ad-9373-38500b1dd3b0 · outbound

This paper cites Visual-OPSD: Cross-Modal On-Policy Self-Distillation for Efficient Unified Multimodal Reasoning.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Visual-OPSD: Cross-Modal On-Policy Self-Distillation for Efficient Unified Multimodal Reasoning

Reference 71

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:57.208674Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:57.208674Z digest=sha256:8c9ca065bceac490e17163163492f5a6740a79ee46c729178e16853c27d8b52f

Observation fd8e593d-2e06-4536-aaa7-cc41438a6358 · outbound

This paper cites Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models

Reference 72

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:57.285409Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:57.285409Z digest=sha256:eff0d4e1a23de097b080af52bcb600f2822b88fc37386538957c9e6053ff07ec

Observation 3f81486b-f60c-44e4-8373-71115d5f6971 · outbound

This paper cites Evaluating object hallucination in large vision-language models.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Evaluating object hallucination in large vision-language models

Reference 73

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:57.363077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:57.363077Z digest=sha256:861250dceee332120a3ecc3c5972d710b285cce86e840fab09f59086ea28007c

Observation f05b5c04-abc4-444d-b1b1-3962501fb568 · outbound

This paper cites Visual Instruction Tuning.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Visual Instruction Tuning

Reference 74

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:57.408087Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:57.408087Z digest=sha256:a030a30489e2410bcb683a1784d9c42ebd0b8072deb6505cf749bce5524e7451

Observation eccef601-1aed-4070-909c-bcfbb4451ee3 · outbound

This paper cites Visual-Advantage On-Policy Distillation for Vision-Language Models.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Visual-Advantage On-Policy Distillation for Vision-Language Models

Reference 75

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:57.472108Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:57.472108Z digest=sha256:2ffde7d723b3039c430259f9e16f23704635561ea8f96325f5ff7d16135b2932

Observation 545b15da-5973-4bd1-90e5-fccf113ff2ba · outbound

This paper cites Kimi K2.6 : From code to creation, from one to many, 2026.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Kimi K2.6 : From code to creation, from one to many, 2026

Reference 76

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:57.527641Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:57.527641Z digest=sha256:0bdf8c2f4520fb9c3723a70292c8a8c9921ea3df5135fc850755562cafdee347

Observation 22accd0f-5391-4938-bbfa-116cf476a044 · outbound

This paper cites Introducing GPT-5.2 , December 2025 a.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Introducing GPT-5.2 , December 2025 a

Reference 77

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:57.607311Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:57.607311Z digest=sha256:c6cceaccc439f5a54068009d1d1c00723916cbccf9a8a739e3f3a90abcf84c06

Observation f1c5199d-3f8f-4b06-8c1d-0545cb99692e · outbound

This paper cites gpt-oss-120b & gpt-oss-20b Model Card.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation gpt-oss-120b & gpt-oss-20b Model Card

Reference 78

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:57.764209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:57.764209Z digest=sha256:06d849a456fb40cd2c6ffc2053dc15d06c1fac930624fc58355c222f754feac4

Observation 3896b2fd-ed49-4f9c-b460-e3889988510c · outbound

This paper cites Introducing GPT-5.4 , March 2026.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Introducing GPT-5.4 , March 2026

Reference 79

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:57.892121Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:57.892121Z digest=sha256:ea61522bd51adedcf69d117a248ae3b728c838069cece223aa660df5122aa63a

Observation 3691bb4b-f122-4d6d-95e0-233853627d8c · outbound

This paper cites Med-OPD: Improving Medical Vision-Language Models via Evidence-Aware On-Policy Distillation.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Med-OPD: Improving Medical Vision-Language Models via Evidence-Aware On-Policy Distillation

Reference 80

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:57.969468Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:57.969468Z digest=sha256:d23cd5e9f2faec0119cd55c676c8ab96009e9276afb7ef65337745e0d0256be3

Observation 871248b4-97d7-41ca-b2b4-0e36a7fa58d4 · outbound

This paper cites Qwen3.5 : Towards native multimodal agents, 2026.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Qwen3.5 : Towards native multimodal agents, 2026

Reference 81

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:57.980547Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:57.980547Z digest=sha256:4e2142a9488ead9b84c7fce0382083cb238e9d0bfee06741bfeb0bc6a9ea9e0f

Observation b0a6f67f-5f37-47ee-b93b-757d35002dfa · outbound

This paper cites Contrastive On-Policy Distillation.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Contrastive On-Policy Distillation

Reference 82

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.020990Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.020990Z digest=sha256:51262a84451c7cd14043030a7caa967cfb4ea10ac717cae87bb4c6bc1ffc80ca

Observation 3885d9c3-41a7-4246-9b0c-2aba11a7e8bd · outbound

This paper cites DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models

Reference 83

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.083276Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.083276Z digest=sha256:39e908e8460f8cf27b4df3d885c5fb37b49792e7235b9d5c752395b256e33b34

Observation 0c862bbf-7c48-4d1f-83e3-ae75f2f57609 · outbound

This paper cites Z oom E ye: Enhancing multimodal LLM s with human-like zooming capabilities through tree-based image exploration.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Z oom E ye: Enhancing multimodal LLM s with human-like zooming capabilities through tree-based image exploration

Reference 84

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.138959Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.138959Z digest=sha256:9bb786ba25bc0a7b8a1931c9380cf007e99b585b14785ddcb29050eee45d7e09

Observation 9e2b0aa4-67fc-4abb-8979-e74dafd249f7 · outbound

This paper cites V-Zero: Answer-Label-Free On-Policy Distillation with Contrastive Evidence Gating for Fine-Grained Visual Reasoning.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation V-Zero: Answer-Label-Free On-Policy Distillation with Contrastive Evidence Gating for Fine-Grained Visual Reasoning

Reference 85

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.221049Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.221049Z digest=sha256:b51f75dc8fb240b27ac32cd711b9b3b6a2ee9cbc063f7a7f8a9c7ed5e3e56888

Observation 09280411-966e-4d8c-a076-0dd7cf940adb · outbound

This paper cites ViCuR: Visual Cues as Recoverable Privilege for Multimodal On-Policy Distillation.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation ViCuR: Visual Cues as Recoverable Privilege for Multimodal On-Policy Distillation

Reference 86

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.229599Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.229599Z digest=sha256:03f17584c66ee72dac9b41e5f4c6dd50f94722040cff30f11f26a1c7eaac7173

Observation c27224aa-c90a-4f59-9ba0-3012d76638f4 · outbound

This paper cites Cambrian-1: A Fully Open, Vision-Centric Exploration of Multimodal LLMs.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Cambrian-1: A Fully Open, Vision-Centric Exploration of Multimodal LLMs

Reference 87

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.232934Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.232934Z digest=sha256:1879a11993f991a6adfd097c81fbe0b8c8ecfaa9506fdce6e207c1147645ab63

Observation 9c1a1b0b-26a0-4323-8fdc-0a01a5581cfa · outbound

This paper cites Eyes Wide Shut? Exploring the Visual Shortcomings of Multimodal LLMs.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Eyes Wide Shut? Exploring the Visual Shortcomings of Multimodal LLMs

Reference 88

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.277821Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.277821Z digest=sha256:df6f2725ee025c7f0f9b28a168a457aa051821d2fa8620939caf10a34d35f5ce

Observation bbbe4ac2-9d5d-4ab3-93b2-e42a2be2ae85 · outbound

This paper cites Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution

Reference 89

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.281180Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.281180Z digest=sha256:6f36358c07589febdd09005b3dd81f4a47aca00da190e948fa839854fa80dc1c

Observation aa723826-0f6f-48dd-8d98-7c120e7a0deb · outbound

This paper cites Divide, Conquer and Combine: A Training-Free Framework for High-Resolution Image Perception in Multimodal Large Language Models.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Divide, Conquer and Combine: A Training-Free Framework for High-Resolution Image Perception in Multimodal Large Language Models

Reference 90

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.284636Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.284636Z digest=sha256:7f17015517873cb68f4c71dad4a4d14e98e698b05ee1ce1da81242839a76946f

Observation 1d826726-eb9c-4bb9-9e48-ddf678d1c1e7 · outbound

This paper cites Zooming without zooming: Region-to-image distillation for fine-grained multimodal perception, 2026.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Zooming without zooming: Region-to-image distillation for fine-grained multimodal perception, 2026

Reference 91

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.287800Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.287800Z digest=sha256:0602fa87378cbbdee399f5de731f104a2c973f2b375449b4f5ef2587439b9947

Observation 54c1de77-47be-4752-be6a-b354061bc3c3 · outbound

This paper cites V*: Guided Visual Search as a Core Mechanism in Multimodal LLMs.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation V*: Guided Visual Search as a Core Mechanism in Multimodal LLMs

Reference 92

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.290582Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.290582Z digest=sha256:202adeb17628fd4c41fd248c4aba471e12c1e58b8a4fbb794b405d6b745a3eab

Observation ba25bc3d-d543-41ea-ba6b-fe2f83f6904b · outbound

This paper cites LLaVA-UHD: an LMM Perceiving Any Aspect Ratio and High-Resolution Images.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation LLaVA-UHD: an LMM Perceiving Any Aspect Ratio and High-Resolution Images

Reference 93

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.293552Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.293552Z digest=sha256:ecc2405c5dc1b42c720213348e37a324cd5f4d32a52b8dfa8d32dfcea4a8295b

Observation 75de6691-3794-49ce-b24a-ec0718e3da4e · outbound

This paper cites On-Policy Context Distillation for Language Models.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation On-Policy Context Distillation for Language Models

Reference 94

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.296731Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.296731Z digest=sha256:8328ff51446c1db1036ad4d73dfff3a54468b8b1a1683653fa66a27aaf7dec1b

Observation 013c5385-6923-4caa-8a0b-a02bbe89f442 · outbound

This paper cites Decomposed On-Policy Distillation for Vision-Language Reasoning: Steering Gradients for Visual Grounding.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Decomposed On-Policy Distillation for Vision-Language Reasoning: Steering Gradients for Visual Grounding

Reference 95

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.299832Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.299832Z digest=sha256:424d583bd69d967d6c280be73835e5c31dccb7eba95514359f9d973494885c20

Observation 66e6eee0-0aa0-4e89-8203-c7d410b9830b · outbound

This paper cites DOPD: Dual On-policy Distillation.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation DOPD: Dual On-policy Distillation

Reference 96

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.303219Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.303219Z digest=sha256:d2184aeb91750b7f10f9b955dc625586d5c203f485773c9dee19c048916289e9

Observation b32ffac7-2ea5-4350-ac06-453c93634aef · outbound

This paper cites Vision-OPD: Learning to See Fine Details for Multimodal LLMs via On-Policy Self-Distillation.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Vision-OPD: Learning to See Fine Details for Multimodal LLMs via On-Policy Self-Distillation

Reference 97

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.306518Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.306518Z digest=sha256:0c3dead0533894424279088e7e414edbde7fd7cd76aed60442ac55df5840e389

Observation e3402560-1af6-4622-9e36-881501a522be · outbound

This paper cites Beyond Absolute Imitation: Anchored Residual Guidance for Privileged On-Policy Distillation.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Beyond Absolute Imitation: Anchored Residual Guidance for Privileged On-Policy Distillation

Reference 98

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.309825Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.309825Z digest=sha256:233d8d87e0290d24d3b2393c73d102433e2086ae5216b48390b01a6b51d2d4b6

Observation 19032e72-684c-4f86-9ac2-7bba4df5be2a · outbound

This paper cites Thyme: Think Beyond Images.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation Thyme: Think Beyond Images

Reference 99

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.312918Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.312918Z digest=sha256:f3273dafaab02149678a48406d8ce1a02465f271be423a2234885dcaaa80f15e

Observation abce2db9-c536-4818-acb4-c9452cf76313 · outbound

This paper cites MME-RealWorld: Could Your Multimodal LLM Challenge High-Resolution Real-World Scenarios that are Difficult for Humans?.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation MME-RealWorld: Could Your Multimodal LLM Challenge High-Resolution Real-World Scenarios that are Difficult for Humans?

Reference 100

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.315965Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.315965Z digest=sha256:58d37242f22cf68af714d24a3703c53b1b079544b023a207d02dbb8d2642279c

Observation c830f302-c0eb-490a-aa94-92c4d7244101 · outbound

This paper cites DeepEyes: Incentivizing "Thinking with Images" via Reinforcement Learning.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation DeepEyes: Incentivizing "Thinking with Images" via Reinforcement Learning

Reference 101

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.318844Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.318844Z digest=sha256:aa838b77eee6f03b0b22414de21e8900da6fbf8fd0e8650f03fb304caec34cf7

Observation f2f392b0-7c3d-4817-98a6-4c1d460746d8 · outbound

This paper cites GLM-4.6V , 2026.

VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation GLM-4.6V , 2026

Reference 102

Resolution
unresolved
no resolver link, observed 2026-07-31T02:56:58.321943Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T02:56:58.321943Z digest=sha256:bc3a9433008a4b39a3257a2d5b5db11bb47460044edb98b2d489653a637b43f3

Pith citing papers

No inbound Pith citation observations are available.