Pith. sign in

Paper Citation Record · LEDGER

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images

As of 7 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2608.03322.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.03322 v1

Coverage vector

measured 49 of 49 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-05T21:07:09.893269Z

measured 49 of 49 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

49 of 49 outbound references displayed

  • verified exact2
  • verified fuzzy23
  • unresolved24
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 8139d1e2-3c3a-4309-a652-b50b58240e49 · outbound

This paper cites International conference on medical image computing and computer-assisted intervention , pages=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images International conference on medical image computing and computer-assisted intervention , pages=

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:14.440464Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:07.291303Z digest=sha256:345089de4fc5cc2b77e74dcf25bdd8e231b42881315da14917ce5c897dbb6e44

Observation 798da038-d359-4dd3-bc2b-29e39aaafa7f · outbound

This paper cites International Conference on Medical Image Computing and Computer-Assisted Intervention , pages=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images International Conference on Medical Image Computing and Computer-Assisted Intervention , pages=

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:14.235802Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:07.323838Z digest=sha256:a0f8f42f3e6b7e11200c5db4726e7f7cd4b6f4cca475226df55058e788d4d769

Observation 34ec7a43-e77e-4a12-864b-b65bc4ffd6fd · outbound

This paper cites IEEE Transactions on Pattern Analysis and Machine Intelligence , year=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images IEEE Transactions on Pattern Analysis and Machine Intelligence , year=

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:14.039872Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:07.354778Z digest=sha256:02ca7758d0785e3d2d409891389945661aa774ec0820ca1b533c03d039444c45

Observation f3ceb8d4-476c-4986-b790-39f15fb39ec7 · outbound

This paper cites LocateAnything: Fast and High-Quality Vision-Language Grounding with Parallel Box Decoding.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images LocateAnything: Fast and High-Quality Vision-Language Grounding with Parallel Box Decoding

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:07.387536Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:07.387536Z digest=sha256:174faa07481240cff008470236b96030c8ad9ddab397606e2334cb22110139be

Observation 6ec4edd4-a18a-4843-b5a9-59152b7a7b83 · outbound

This paper cites Nature communications , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Nature communications , volume=

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:13.872592Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:07.433529Z digest=sha256:7f8eaec7b4a360dde405678e03d5efd1a9ad3a9faa3c1753a8b8600db1dec87e

Observation 4f2736d8-74e2-4d5b-8d6c-91256a884cde · outbound

This paper cites Nature methods , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Nature methods , volume=

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:13.738062Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:07.468330Z digest=sha256:3c73cee8ae2f64a4e3133a0908d34e752e86e8061a71918b643181f9eb686c89

Observation 59b2ecb1-120e-491d-b221-857adb44898f · outbound

This paper cites international conference on medical image computing and computer-assisted intervention , pages=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images international conference on medical image computing and computer-assisted intervention , pages=

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:13.575409Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:07.508242Z digest=sha256:483b1d08935b90e620ecab6b7ea27e6081d0c62c68ba3a6f86bb38e0ffe565d5

Observation 57e88c4d-9892-4f82-997b-395e7c3a7058 · outbound

This paper cites MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:07.540354Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:07.540354Z digest=sha256:b7a65f3d829ee30d856437dcd1fc50901c0afbba0b5059a432db01bb857119e9

Observation f388ae50-5da8-4c7b-828c-16459a5034e2 · outbound

This paper cites Rex-Thinker: Grounded Object Referring via Chain-of-Thought Reasoning.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Rex-Thinker: Grounded Object Referring via Chain-of-Thought Reasoning

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:07.567191Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:07.567191Z digest=sha256:802ae9a92d204f148167b9fff5c77733c0a985112cde75327525869308d7979b

Observation a2fcd220-4af4-4ced-9811-a1969e258422 · outbound

This paper cites arXiv preprint arXiv:2510.04477 , year=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images arXiv preprint arXiv:2510.04477 , year=

Reference 10

Resolution
verified exact
raw_fallback, observed 2026-08-05T21:07:10.819578Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:07.598807Z digest=sha256:250c740f9f2221ccd1fea9192cf1eb145638deb8fd24412e5964e702f5f908c2

Observation 2f6eb89d-c272-4b9b-87fc-d06fe82f5a8f · outbound

This paper cites Journal of medical imaging , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Journal of medical imaging , volume=

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:13.464628Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:07.657756Z digest=sha256:5772012bbbd07ac91ea05e1b1a70ea358f36cefb5dc704137a501a331db2290d

Observation 544d608b-642c-49db-8be5-36ac71182503 · outbound

This paper cites Proceedings of the IEEE/CVF international conference on computer vision , pages=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Proceedings of the IEEE/CVF international conference on computer vision , pages=

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:07.693581Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:07.693581Z digest=sha256:403b0de6e2cb4477a4337460bef1567e421836bf527d2ee587edf867bd701b63

Observation 7f3499f1-877e-4ae3-bcf6-7a721c8371a0 · outbound

This paper cites Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:13.334089Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:07.735063Z digest=sha256:aae66f12c9d480cc0c30858c7a999d6ea139d58d37e5d05d84dc2957dc116a21

Observation 2bd2698e-bf62-4d58-94e7-124c85a2665d · outbound

This paper cites European conference on computer vision , pages=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images European conference on computer vision , pages=

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:13.172153Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:07.778837Z digest=sha256:e7ac975c8a09445df809967fe33cecbae58c3d90906ac9071a729fbae6b93952

Observation 6a4eae3b-817b-4988-a3fd-315e68536dc9 · outbound

This paper cites European conference on computer vision , pages=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images European conference on computer vision , pages=

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:07.802293Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:07.802293Z digest=sha256:f0c748ea5351c82518257af42e0eb4b14910c4b0b589c4d41f9edffbf37aa54b

Observation c8c46346-8a68-4dcd-8c56-1a320ba32416 · outbound

This paper cites International Conference on Learning Representations , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images International Conference on Learning Representations , volume=

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:07.838697Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:07.838697Z digest=sha256:eabd8a512e5d2b18e0bde3d0cf864b00c8f3178352a9850105697f0d623da548

Observation a378364e-1e5e-42da-acba-05ca18c631c6 · outbound

This paper cites arXiv preprint arXiv:2510.12798 , year=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images arXiv preprint arXiv:2510.12798 , year=

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:07.882591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:07.882591Z digest=sha256:f7a055a75e1e9b64378d05e993d5bd0586d37f19cc2360f05bdad61d9cbf42e3

Observation 085a2332-2867-4624-a043-da1bf3de5719 · outbound

This paper cites 2026 IEEE/CVF Winter Conference on Applications of Computer Vision (WACV) , pages=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images 2026 IEEE/CVF Winter Conference on Applications of Computer Vision (WACV) , pages=

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:12.986260Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:07.931795Z digest=sha256:a9d6a9ccd1c9bb19ae701cc9ba6a013fbcc0d99de41c2d804bdf892f3351d97a

Observation 110f6385-b605-4c39-94a6-bc57dde51b2b · outbound

This paper cites VividMed: Vision Language Model with Versatile Visual Grounding for Medicine.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images VividMed: Vision Language Model with Versatile Visual Grounding for Medicine

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:08.007254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:08.007254Z digest=sha256:4100f93a8945b16cd35921292d2eedcca6bb2d9304c9ed5ee4cc041baa117551

Observation 49ad6160-661a-4c88-b080-3bc11726618b · outbound

This paper cites Proceedings of the Computer Vision and Pattern Recognition Conference , pages=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Proceedings of the Computer Vision and Pattern Recognition Conference , pages=

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:12.882338Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:08.069248Z digest=sha256:56f22de6e447c39558e122a476d45880e3d100668182a8d87a2ff965e277e06f

Observation 92b64d50-bfb0-4007-8452-c2d84cb062ac · outbound

This paper cites Proceedings of the AAAI Conference on Artificial Intelligence , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Proceedings of the AAAI Conference on Artificial Intelligence , volume=

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:12.776827Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:08.158591Z digest=sha256:077476784e24a28124c9ae80353572bb7579e09dca5bde6218023a60cf4e1fa8

Observation 539ca9fe-d91c-4f3f-8426-223cdba068c4 · outbound

This paper cites Nature Communications , year=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Nature Communications , year=

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:12.672341Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:08.218339Z digest=sha256:bc0b835c620cd8abc19cb3e020edd04fac2077bfb0b6132478c0bcb9e7dd98aa

Observation 3652678f-b974-46c2-a861-824a124d0c48 · outbound

This paper cites European conference on computer vision , pages=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images European conference on computer vision , pages=

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:08.287875Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:08.287875Z digest=sha256:2be0ac181cc0b57f929ee9018e2fe22bb07412778592d673bd15e0ca000d86ed

Observation d0f5a677-cf76-4f15-b909-147757ebb773 · outbound

This paper cites arXiv preprint arXiv:2601.06847 , year=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images arXiv preprint arXiv:2601.06847 , year=

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:08.385821Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:08.385821Z digest=sha256:7c26ea6b23f7dabf4d4f7654683ecfa315371487fc1e9d4bb86b252dec1f61bb

Observation bfc923ed-8082-4118-8eb6-30463cbad083 · outbound

This paper cites Advances in Neural Information Processing Systems , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Advances in Neural Information Processing Systems , volume=

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:12.461937Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:08.421805Z digest=sha256:c9b03dafe37b593436a3fa66ef68652fd877f74a2b1cdc153bf535f1dedada1f

Observation c88710ae-06f9-4c58-bc6f-b9a7e8c8a542 · outbound

This paper cites UniVG-R1: Reasoning Guided Universal Visual Grounding with Reinforcement Learning.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images UniVG-R1: Reasoning Guided Universal Visual Grounding with Reinforcement Learning

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:08.465735Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:08.465735Z digest=sha256:14707863c53d3a936d62686027df833a4b57e665f86daa5bdb3487d1d8d37e09

Observation 0021fea5-eb31-41b4-b5db-4ee7239a1c2d · outbound

This paper cites Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:12.310068Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:08.521244Z digest=sha256:188d000747ac24522c4ad13b664b7d3f095ce9652c27821a713e942b022071f7

Observation 7baefc8b-2614-44e4-84bb-7fa50f48fa78 · outbound

This paper cites Better Eyes, Better Thoughts: Why Vision Chain-of-Thought Fails in Medicine.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Better Eyes, Better Thoughts: Why Vision Chain-of-Thought Fails in Medicine

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:08.563485Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:08.563485Z digest=sha256:000a1c3bdc6e270942b117aceb323ab22a23381d7cd98b6e3cfc77237b133c46

Observation 0cdb2e9e-7bca-4770-9a48-2ba6af965c1b · outbound

This paper cites Nature communications , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Nature communications , volume=

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:08.634558Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:08.634558Z digest=sha256:baed39e6fb16582bcc525d1bcc61f4e6560eee05156d9ae5b2fa469f00d8be26

Observation 98196b98-4ce3-4d47-94f3-30ac11d264a5 · outbound

This paper cites Radiology: Artificial Intelligence , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Radiology: Artificial Intelligence , volume=

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:08.695541Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:08.695541Z digest=sha256:995df955a8596799058d71a1e63cea6125b3812bbea4f24a228f84361389ffd6

Observation b9446222-422b-47a8-bf0e-47cd25906429 · outbound

This paper cites Medical image analysis , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Medical image analysis , volume=

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:08.748748Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:08.748748Z digest=sha256:1110d1f3717c80f64158cc6529ceee4c134e607b01f224b5af19f7f9a2ddbd2d

Observation e28eec6a-38e8-4e3f-b8bf-f709c7521296 · outbound

This paper cites International Conference on Medical Image Computing and Computer-Assisted Intervention , pages=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images International Conference on Medical Image Computing and Computer-Assisted Intervention , pages=

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:12.099143Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:08.786746Z digest=sha256:8e20f9ba1a179774ced4ab8e69b27ba7a83485d2c24a4b338a1ac33b0696fc9a

Observation 3728f14f-26b9-4c6b-b8b5-5b7838536633 · outbound

This paper cites Medical physics , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Medical physics , volume=

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:11.934478Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:08.815007Z digest=sha256:3589e207d086fdc2c494724158a320bb526781d9002cac84f7e095cedaec1dd1

Observation 886c2177-2804-4377-a1c5-8790a793c558 · outbound

This paper cites Scientific data , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Scientific data , volume=

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:11.770374Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:08.851524Z digest=sha256:6d4b5c70ae1f4a8faf4c9467d83114ef64b16b6bfbca481275e000ff214d51e7

Observation 160b1582-f6be-48de-a60d-5ff7ccd42fd2 · outbound

This paper cites Scientific data , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Scientific data , volume=

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:11.537733Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:08.877954Z digest=sha256:f06de9047e07f4bce3dc35369249f662fc4cbe4bce5c5d325a7a43ec393bfa50

Observation 53f19895-266c-44f3-b1cd-03a41cd2adbe · outbound

This paper cites arXiv preprint arXiv:2305.19112 , year=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images arXiv preprint arXiv:2305.19112 , year=

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:08.919218Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:08.919218Z digest=sha256:55811e9013fb45c616d4e0d96fac1e57bd3eeb5bacea7ece45eb07858e4e614b

Observation c8535cf8-1809-4a3e-8a35-262a22cdbf41 · outbound

This paper cites International conference on multimedia modeling , pages=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images International conference on multimedia modeling , pages=

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:08.948707Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:08.948707Z digest=sha256:7a80c40540288934e27e73ddb2c6feaf4ac9d48ca5d989231b89009e53d4bcb4

Observation ee625d8d-b7fe-43bd-bcf2-062ab53d7f6f · outbound

This paper cites saliency maps from physicians , author=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images saliency maps from physicians , author=

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:11.392202Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:08.996716Z digest=sha256:ee0e35023ea7381b2f1b3c8e12c0f983e058cee2825a5b003a6b326afabdc873

Observation 7cade63a-ecd3-4fc1-9294-c121ba9e450b · outbound

This paper cites Information Sciences , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Information Sciences , volume=

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:11.308346Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:09.028296Z digest=sha256:4d2fdd7e996f6c09e5e945c2f89fb805c2a58d294656ff38d41d7a6b19a8411c

Observation c60c39ba-7f7b-4009-bbea-c50fe9b3cc2b · outbound

This paper cites IEEE transactions on medical imaging , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images IEEE transactions on medical imaging , volume=

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:11.227731Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:09.065811Z digest=sha256:e2ba1b482808caa12ac7c8859e60bff8a3845d8acbc17201267dad6092ecf1c4

Observation 5dfb962e-91c8-4480-b4ce-152c824890a8 · outbound

This paper cites IEEE Transactions on Medical imaging , volume=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images IEEE Transactions on Medical imaging , volume=

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-05T21:07:11.062611Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:09.098336Z digest=sha256:6907e3fadc91c9942e4e2e5eb02fa37dd4ea2dc36efb6f8b1facea06e3bdfd17

Observation efe2f606-036d-4080-978e-e841ff6e7743 · outbound

This paper cites European conference on computer vision , pages=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images European conference on computer vision , pages=

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:09.170037Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:09.170037Z digest=sha256:c232e6870082b5a7eae2f25fcce31020ed7f531b2190f1a2f926b0ff53e7ed7e

Observation 9d5ab858-d88d-4c63-bfa5-96bcbb3c514d · outbound

This paper cites Ultralytics YOLO26: Unified Real-Time End-to-End Vision Models.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Ultralytics YOLO26: Unified Real-Time End-to-End Vision Models

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:09.213500Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:09.213500Z digest=sha256:173ff13a474935f20e85a3683ac9a6a58fcd287e362ffe9192c89d0043b26c05

Observation a9cd5b55-8b47-41bd-be3f-a25d42f77648 · outbound

This paper cites LW-DETR: A Transformer Replacement to YOLO for Real-Time Detection.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images LW-DETR: A Transformer Replacement to YOLO for Real-Time Detection

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:09.302031Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:09.302031Z digest=sha256:9bbc1806e0c02e34eb6458191084cc0aefe2b2160f4006be86ad16e50e655e6a

Observation 6c6cbf1d-23fb-4ccb-85cf-f5d563015e11 · outbound

This paper cites arXiv preprint arXiv:2603.18739 , year=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images arXiv preprint arXiv:2603.18739 , year=

Reference 45

Resolution
verified exact
raw_fallback, observed 2026-08-05T21:07:10.299260Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-05T21:07:09.384132Z digest=sha256:f892a27c375921525545470c03cce42842e4001b6e74fa96990f492f8be7823a

Observation cb508499-4c1a-41a4-a672-9f366aa90408 · outbound

This paper cites DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:09.449564Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:09.449564Z digest=sha256:4a1291df3dc53d5a84d4a9cc7d8583805dd4108370cfba7e7f25f9ac8f29bccb

Observation db45a968-61e3-45d5-b5c7-a97ac6f009bd · outbound

This paper cites arXiv preprint arXiv:2512.17436 , year=.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images arXiv preprint arXiv:2512.17436 , year=

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:09.599566Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:09.599566Z digest=sha256:b820d9b0b26b50d7276edd75994918564437e9544d07503aa7f1a768255ae539

Observation 07a1f85b-7386-431d-b18e-40ed5284516e · outbound

This paper cites Ovis2.5 Technical Report.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Ovis2.5 Technical Report

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:09.717152Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:09.717152Z digest=sha256:60530534f53a6b2a7663c061a851e3af2320f05da7ecab193b2c88c626ed9cce

Observation 6ebcfbae-2f97-459c-9f74-b717d95ccad2 · outbound

This paper cites Qwen3-VL Technical Report.

LocAnyMed: Vision-Language Grounding for Multimodal Medical Images Qwen3-VL Technical Report

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-05T21:07:09.893269Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:07:09.893269Z digest=sha256:156f9e2377ede8b527d82494fc6e5ab1206404b1bd171cde24ee66bb406f32c3

Pith citing papers

No inbound Pith citation observations are available.