Pith. sign in

Paper Citation Record · LEDGER

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking

As of 9 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 0 inbound Pith citation observations for arXiv:2606.29357.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2606.29357 v1

Coverage vector

measured 74 of 74 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-06-30T07:20:54.642591Z

measured 74 of 74 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

74 of 74 outbound references displayed

  • verified exact12
  • verified fuzzy0
  • unresolved62
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 2ee7bc57-efa1-487d-a684-58c830a80bc6 · outbound

This paper cites Tracking by natural language specification,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Tracking by natural language specification,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:ee41af51eb4accbad0b2bc5b05e45855667dfdce9e0456c1e4d2290107b42fc4

Observation 5cfd51e9-47b8-4d53-a36d-f3577f98d4a6 · outbound

This paper cites Towards more flexible and accurate object tracking with natural lan- guage: Algorithms and benchmark,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Towards more flexible and accurate object tracking with natural lan- guage: Algorithms and benchmark,

Reference 2

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:c01dec498be2b0e44ffb20415c9215510f632e886619c667771a90f0da82f8c1

Observation 20d3570b-28d6-4b44-9131-ef3c86870e92 · outbound

This paper cites Describe and Attend to Track: Learning Natural Language guided Structural Representation and Visual Attention for Object Tracking.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Describe and Attend to Track: Learning Natural Language guided Structural Representation and Visual Attention for Object Tracking

Reference 3

Resolution
verified exact
local_arxiv, observed 2026-06-30T07:24:21.276420Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:1477154e97e22ddeda62ef460ebdd3be8b7931065a871c48625fc9c3ef906090

Observation 90e79796-2b5a-40ea-bf3c-e2b661cd6f51 · outbound

This paper cites Grounding-tracking- integration,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Grounding-tracking- integration,

Reference 4

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:be2a5183f3a605a10e014da00d2b5f9264fe4fffccd2cfe39c0cd95a947e4d1c

Observation b4edd94e-b4b7-473d-beca-3d109995b3ac · outbound

This paper cites Joint visual grounding and tracking with natural language specification,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Joint visual grounding and tracking with natural language specification,

Reference 5

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:c2dc66d6e2ebad9031483ab87960ca9204d4b8cf3882196742ae1becc7889e84

Observation 3dbfc87c-0bc3-49f2-9a61-a99a84a62193 · outbound

This paper cites Large-scale multi-modal pre-trained models: A comprehensive survey,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Large-scale multi-modal pre-trained models: A comprehensive survey,

Reference 6

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:b29757e256cf131001ea96573077729af1ba757dcfe2d1ae6a3b6ee0f64ee57c

Observation c379308a-95e1-43d6-a258-416c4045dd13 · outbound

This paper cites Llmformer: Large language model for open-vocabulary semantic segmentation,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Llmformer: Large language model for open-vocabulary semantic segmentation,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:0bf7955a764bf8323692c34812ef76b4dfa479048b28bc12dddd4f73e7965760

Observation 86159438-afd8-4022-b0e1-4951909d06c3 · outbound

This paper cites Pedestrian attribute recognition: A new benchmark dataset and a large language model augmented framework,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Pedestrian attribute recognition: A new benchmark dataset and a large language model augmented framework,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:382cf57b1f34e5fb0dd77a38f16888ed0583f3d20f9d960d3d843cbd0323a5c9

Observation e18e8391-d297-44a6-a553-57f0034764ef · outbound

This paper cites Language decou- pling with fine-grained knowledge guidance for referring multi-object tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Language decou- pling with fine-grained knowledge guidance for referring multi-object tracking,

Reference 9

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:4617b9f65fded134831187463406e2beb76c1adc7fccaf83e8a64e182864de66

Observation cc15022b-8ae9-4afb-8d7f-5569aab4935e · outbound

This paper cites Chattracker: Enhancing visual tracking performance via chatting with multimodal large language model,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Chattracker: Enhancing visual tracking performance via chatting with multimodal large language model,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:6c748c1b41b7699d8ad81beb275c178bbd798a9c960e9f4b98f07974703836c1

Observation 3a202221-71a7-47a6-b4a3-e7982016e427 · outbound

This paper cites Dynamic Updates for Language Adaptation in Visual-Language Tracking.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Dynamic Updates for Language Adaptation in Visual-Language Tracking

Reference 11

Resolution
verified exact
arxiv_id, observed 2026-06-30T07:24:21.275032Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:2d80f7a9fa7c1d11662284175b4cde98e8896ff1b366a659b9a1d618977a7845

Observation 45e9876b-24c4-4eaa-a10e-5a986a801e73 · outbound

This paper cites Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:39ce7778fc7a65937ba55958a07451d0abe242ff14fae28804647a718dd25833

Observation 2972d4c7-3ab8-4f8e-8718-ffef0744bfb6 · outbound

This paper cites Glad: Generative language-assisted visual tracking for low-semantic templates: X. luo et al.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Glad: Generative language-assisted visual tracking for low-semantic templates: X. luo et al

Reference 13

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:d75a9cb4bee345b199cab892eb8afa8953a87a10fbb972b46317426fe8617dbd

Observation 93a07e9f-7024-4795-8a9f-d6fc54334c2b · outbound

This paper cites Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution

Reference 14

Resolution
verified exact
local_arxiv, observed 2026-06-30T07:24:21.260957Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:7db6e615028174d8103c92ea913a2415b3b3166ef4372dab76b1698fee5c5e78

Observation f8c1c0df-f7f9-43ae-a570-3d6198a5ed84 · outbound

This paper cites ReasoningTrack: Chain-of-Thought Reasoning for Long-term Vision-Language Tracking.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking ReasoningTrack: Chain-of-Thought Reasoning for Long-term Vision-Language Tracking

Reference 15

Resolution
verified exact
arxiv_id, observed 2026-06-30T07:24:21.263627Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:12f4af7747fce5dac138d75158caec3b117dea0363cb71c6423859200a688dc9

Observation b56cccd9-b699-4b4b-9245-e133709a3d03 · outbound

This paper cites Lasot: A high-quality benchmark for large-scale single object tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Lasot: A high-quality benchmark for large-scale single object tracking,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:bca9420888b3d9081f675a85cacaf9bb13299fa121d5348b93d1a6879ce0ebde

Observation f2509db2-45c8-43a3-8baf-bd76d79567b5 · outbound

This paper cites Towards more flexible and accurate object tracking with natural lan- guage: Algorithms and benchmark,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Towards more flexible and accurate object tracking with natural lan- guage: Algorithms and benchmark,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:e389f49c07e21292d70e1a1792817769332f585e449bb4bed2a8535ccda20e27

Observation d8a707bb-ced9-4556-8229-a034d8ebbf33 · outbound

This paper cites Divert more attention to vision- language tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Divert more attention to vision- language tracking,

Reference 18

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:a3f2f2129002212aaeb841ecf3bb506291ad353951c06343fd63937ab6014554

Observation 2f567368-95fb-4210-bdee-5cd2a083a468 · outbound

This paper cites All in one: Exploring unified vision-language tracking with multi-modal alignment,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking All in one: Exploring unified vision-language tracking with multi-modal alignment,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:2abb67fea2adc76e4a62c75302859847f7fd0cfc96282578efb9678410515665

Observation b6c08702-e3f7-4662-aee5-e31580cd1a3f · outbound

This paper cites Toward unified token learning for vision-language tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Toward unified token learning for vision-language tracking,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:32ddb910ba058ff56a0974bbcd8c1487e2b46792936e65d8ce0122b220c64074

Observation 7263e4d6-7720-4e4a-96fa-3005181881c6 · outbound

This paper cites Context- aware integration of language and visual references for natural language tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Context- aware integration of language and visual references for natural language tracking,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:1ff6547b8617abd82b3c3434ffd781078f7ac55777386d41f597dfb755c8f9d3

Observation 10568d39-cd20-43b6-b425-154368eb911d · outbound

This paper cites Unifying visual and vision-language tracking via contrastive learning,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Unifying visual and vision-language tracking via contrastive learning,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:5e4495fe5926fa1e9711419e4a4ed31c16f3019afa81b1f9393feca729079e20

Observation 4bf12eb4-7c80-475f-a962-0a3bd0708d89 · outbound

This paper cites Mambavlt: Time- evolving multimodal state space model for vision-language tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Mambavlt: Time- evolving multimodal state space model for vision-language tracking,

Reference 23

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:40ab7e81d52bcf87261fdfba43088f5274dbd9b3e7b8d1a60ce5df75215b351a

Observation eb7b5ea7-443a-485d-b4e6-34414a7aa398 · outbound

This paper cites Atctrack: Aligning target-context cues with dynamic target states for robust vision-language tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Atctrack: Aligning target-context cues with dynamic target states for robust vision-language tracking,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:2ff17946ab33ce3d1d99a03012e8a8f7006828f1c041424b6d4a9003bc7abee9

Observation b33afb71-b608-46c7-90ed-04d5afd6b0f6 · outbound

This paper cites Cross-modal retrieval via deep and bidirectional representation learning,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Cross-modal retrieval via deep and bidirectional representation learning,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:17a12a724de9fe42c2cb0e59e119082d65ad728014bf19cfd0dc846b90a9c477

Observation 964b2abf-62d1-4428-8662-4cdffb5c0222 · outbound

This paper cites Adversarial attribute-text embed- ding for person search with natural language query,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Adversarial attribute-text embed- ding for person search with natural language query,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:07dfb35466742a84cde2c818f8374abe73ada06119e6e829b026576c616d4ccd

Observation 225360c7-b354-4be5-a759-e814a5c596c4 · outbound

This paper cites Align and tell: Boosting text-video retrieval with local alignment and fine-grained supervision,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Align and tell: Boosting text-video retrieval with local alignment and fine-grained supervision,

Reference 27

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:ac82735e01c05b1c1e2e19d8944f9a1496f274cba691c4db4ee547974845f234

Observation 9af85916-64cf-4639-adab-5d13955eef3f · outbound

This paper cites Multi-task cnn model for attribute prediction,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Multi-task cnn model for attribute prediction,

Reference 28

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:955a605361b7e59d61273c9085e11e76f68e4f9fc99d86de7a13befed21f0f1f

Observation a09c1093-2fbf-4257-be83-08e8c35af0a8 · outbound

This paper cites Correlation graph convolu- tional network for pedestrian attribute recognition,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Correlation graph convolu- tional network for pedestrian attribute recognition,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:d0aaa55c10f9d7f72db62d32661665c9befa9cffd192569bce29e1cded8b26c2

Observation e24f4b1b-5763-4821-8685-e08c1fd2e758 · outbound

This paper cites Learning transferable visual models from natural language supervision,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Learning transferable visual models from natural language supervision,

Reference 30

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:3274396a3c0fdac5d4d918f64d4c3a3e845b106c2b0c44e0171478daa6a4e208

Observation 09725e22-c036-4b34-9173-c22949da9ee8 · outbound

This paper cites DINOv2: Learning Robust Visual Features without Supervision.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking DINOv2: Learning Robust Visual Features without Supervision

Reference 31

Resolution
verified exact
local_arxiv, observed 2026-06-30T07:24:21.265504Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:5de4f048c5e57783b80d7c53549ecb52c1e3d87b40aec177af4cdd0363767669

Observation e73e62fd-d0d2-4abc-b5f7-860a7f5beba2 · outbound

This paper cites Segment anything,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Segment anything,

Reference 32

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:9dc0097cbec2e9c5d0352f0d1a79a2a7dd468eae217e17db80b73a2544c273c6

Observation a4788d4a-1515-41e3-ba6a-2bb2ff7012fc · outbound

This paper cites Sam 2: Segment anything in images and videos,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Sam 2: Segment anything in images and videos,

Reference 33

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:d312ca2d820b015150a9d4993a26e115783d26dfae672988258720159f6690ec

Observation defb28a9-e50c-44b2-8729-fbb0ede1beeb · outbound

This paper cites Florence-2: Advancing a unified representation for a variety of vision tasks,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Florence-2: Advancing a unified representation for a variety of vision tasks,

Reference 34

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:559f54813d9ef38e921a86852cdbdb435ca21ed8330af4f48058b7bdf110fef8

Observation 4910220f-9b5e-42c5-812f-c66cfca3b268 · outbound

This paper cites LLaVA-OneVision: Easy Visual Task Transfer.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking LLaVA-OneVision: Easy Visual Task Transfer

Reference 35

Resolution
verified exact
local_arxiv, observed 2026-06-30T07:24:21.273048Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:70290afd09b7c59509bc250cd10fa35d099537cb82cf5f702bead52865a7eb19

Observation 105a7c76-6c3a-4233-82e4-d38cc2baac3d · outbound

This paper cites Qwen2.5-VL Technical Report.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Qwen2.5-VL Technical Report

Reference 36

Resolution
verified exact
local_arxiv, observed 2026-06-30T07:24:21.258391Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:ac9d2082c046a1f47879ba00bf350ccc03d04a931132bf379f7b5c45a54e1eae

Observation 237d682c-c674-4c7a-919d-5a3f979fd039 · outbound

This paper cites R1-Track: Direct Application of MLLMs to Visual Object Tracking via Reinforcement Learning.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking R1-Track: Direct Application of MLLMs to Visual Object Tracking via Reinforcement Learning

Reference 37

Resolution
verified exact
arxiv_id, observed 2026-06-30T07:24:21.253447Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:ec2b6185b3dd2a3535a5d2d118504b7bd3a64e6075baf00ea5ad73e133bb05f7

Observation f3335b67-1f4a-44ad-b463-cbd573bd8207 · outbound

This paper cites VPTracker: Global Vision-Language Tracking via Visual Prompt.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking VPTracker: Global Vision-Language Tracking via Visual Prompt

Reference 38

Resolution
verified exact
local_arxiv, observed 2026-06-30T07:24:21.281526Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:f04ee74cda2900877023273752fb28708b8577f6389dff044ce3eb0234c73cc5

Observation e495ff10-cd13-40e0-8374-287c2c771147 · outbound

This paper cites Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Generative Semantic Multi-Object Tracking: A Large-Scale Benchmark and an MLLM-Driven Reasoning Framework

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-07-07T04:17:58.620756Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:b00cf12e2c94122e7392f50008a9935fb5e8934af8842dcf29782c00ddabc2be

Observation 2c82bfab-3e76-42fa-82ac-1a5fe352c572 · outbound

This paper cites Deep biaffine attention for neural dependency parsing,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Deep biaffine attention for neural dependency parsing,

Reference 40

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:2e7ca403811fde77ed66d4cca46da96e85ba03dfcdffc69badbaca8b1f7c7d0f

Observation 4ef82fea-9f7f-4eb8-a894-dffe7dff3f4b · outbound

This paper cites Universal dependencies v1: A multilingual treebank collection,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Universal dependencies v1: A multilingual treebank collection,

Reference 41

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:90087ff8cd754d5bf1bb844f038e511342b32d0c30382d771ee941a9af9a764f

Observation 55472819-53fe-439e-a186-7f766a543b26 · outbound

This paper cites A gold standard dependency corpus for english,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking A gold standard dependency corpus for english,

Reference 42

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:4ffa21fad161e8c8f834fcbc49664ea0042ec4877561781124456133937a037b

Observation a662e581-debb-4ce3-9624-1351f51eda1f · outbound

This paper cites Lora: Low-rank adaptation of large language models,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Lora: Low-rank adaptation of large language models,

Reference 43

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:3f418a8677ec038a4488d7933344a2ebb51ae5f2d17afd3a9d66716dec13dbb7

Observation 41f27cd3-ea62-4804-9441-628ff07d78ff · outbound

This paper cites Generalized intersection over union: A metric and a loss for bound- ing box regression,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Generalized intersection over union: A metric and a loss for bound- ing box regression,

Reference 44

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:2f7c7fa35c9794af52daa990e4f9499355afe2f9d71d0786b0711bfdab05fe10

Observation 8b4e050a-8353-49ef-bda8-d0c55cc20d28 · outbound

This paper cites Focal loss for dense object detection,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Focal loss for dense object detection,

Reference 45

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:547060929031dea36041f0b820e6a004c40462d8f5a36799d38fec93f4304960

Observation 9d3c2d7a-db08-45c7-96da-d58f303250ee · outbound

This paper cites Decoupled weight decay regularization,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Decoupled weight decay regularization,

Reference 46

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:e9d93320d2cae4c2e38b00daf6888be554967199d03796c711ea63cf943fb3b8

Observation 95cf6f3a-cedc-4171-91b1-8f55ffbb1726 · outbound

This paper cites Joint feature learning and relation modeling for tracking: A one-stream framework,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Joint feature learning and relation modeling for tracking: A one-stream framework,

Reference 47

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:2d59cb41e57bc9e3106edc2976559b1473b2c9de1d0080c8bd8963f63dfb262b

Observation 31d4cb89-410e-4021-8791-aeb285d51370 · outbound

This paper cites Mixformer: End-to-end tracking with iterative mixed attention,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Mixformer: End-to-end tracking with iterative mixed attention,

Reference 48

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:2e07b1930e28b99e30701346e43be93aa43ca3d961e1c14e270290aa446f4088

Observation 9a827872-de91-4ad1-8991-f37cc8e7f635 · outbound

This paper cites Aiatrack: Attention in attention for transformer visual tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Aiatrack: Attention in attention for transformer visual tracking,

Reference 49

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:6993b917d6090c135f330eb464a15139785f1b867882c9d7836d07db4e53314b

Observation 6d801357-ff2e-4655-9026-e9a90b77eef3 · outbound

This paper cites Citetracker: Correlating image and text for visual tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Citetracker: Correlating image and text for visual tracking,

Reference 50

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:9d4af200bad9a55b675a467a8cf71052bb0c5198ed6f44dd7ac1f53a95c9decb

Observation 06637f69-cc3d-410d-a7f6-6f82657f4edd · outbound

This paper cites Robust object modeling for visual tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Robust object modeling for visual tracking,

Reference 51

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:59657f0542801265e6b07c3482ecc4616a97da2f6fef562bbd4c19f92eeee4dd

Observation 0cdcee00-2f48-4f36-92fb-247bb8341354 · outbound

This paper cites Generalized relation modeling for transformer tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Generalized relation modeling for transformer tracking,

Reference 52

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:0cb3e475dc6f47dacd26d28a789e6bc1cf8dbdd33b72292afdd1c10acd4414eb

Observation a4dc9ac8-27d2-49cc-9e38-a37099a4d087 · outbound

This paper cites Odtrack: Online dense temporal token learning for visual tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Odtrack: Online dense temporal token learning for visual tracking,

Reference 53

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:4901976d1a5a42164b8eb8b00f657e842cefa1f02da92a6b4b2bd403d5bf3c58

Observation dd2ddee0-3ba5-41a5-8258-ff61f8f4bd31 · outbound

This paper cites Explicit visual prompts for visual object tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Explicit visual prompts for visual object tracking,

Reference 54

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:16720257778f7e87e694c7c39e9a50cad610e0ad4d1053d6ea2fa28ffdbb8ffe

Observation 81c63ac4-8dd9-4d48-8d79-60a1f14571dd · outbound

This paper cites Autoregressive queries for adaptive tracking with spatio-temporal trans- formers,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Autoregressive queries for adaptive tracking with spatio-temporal trans- formers,

Reference 55

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:d601c44a4e6417bdcc5c77304b34a6eb4ef190e65f3a5279121c856bfd1af21c

Observation 3f20c244-2d38-44f2-8e19-39e6576d9dea · outbound

This paper cites Less is more: Token context-aware learning for object tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Less is more: Token context-aware learning for object tracking,

Reference 56

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:7c5285a733ec17bca1960cbda34cacc8d235c92439f7d7cb5013b902dd6b0997

Observation e689a555-e109-405c-9709-c8d630f19c79 · outbound

This paper cites Enhancing vision-language tracking by effectively con- verting textual cues into visual cues,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Enhancing vision-language tracking by effectively con- verting textual cues into visual cues,

Reference 57

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:e589ecc480d1597229322e98fc12258f9552fbd4e1b767827d659ccf8ec17c68

Observation e609eda5-4997-40e9-80bd-b9fc21ae3b14 · outbound

This paper cites Sutrack: Towards simple and unified single object tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Sutrack: Towards simple and unified single object tracking,

Reference 58

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:66388990e33938b8188af0e06fcaa0a207d173e93996ff4069883691e8a67622

Observation 9c043613-a869-49d4-b8fc-7ba71f4c5b47 · outbound

This paper cites Dynamic updates for language adaptation in visual-language tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Dynamic updates for language adaptation in visual-language tracking,

Reference 59

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:0683337e89ce2c2431f3858ed9a6a1a0bd0ed9e5fabdd1523e03405bdfaf39d2

Observation 01c277ed-6336-463d-b457-ed55ac9f05f7 · outbound

This paper cites Selective distillation of lan- guage tokens for redundancy suppression in vision-language tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Selective distillation of lan- guage tokens for redundancy suppression in vision-language tracking,

Reference 60

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:7dac5fec7b971dc6cd078b26e4a4826282efec168729ee9352638fe4416b12fc

Observation 49086bbf-2f9f-4d4d-b92c-2da7642af3b3 · outbound

This paper cites Seqtrack: Sequence to sequence learning for visual object tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Seqtrack: Sequence to sequence learning for visual object tracking,

Reference 61

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:de81cb57e461e8a1a8330a7a79ac042c56c71928c6345045254acbfe944538f6

Observation 45c32c9c-1097-4dbf-bd94-ee979991c940 · outbound

This paper cites Tdcl: Dense seman- tic contrastive learning for vision-language tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Tdcl: Dense seman- tic contrastive learning for vision-language tracking,

Reference 62

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:832c225a0dd5a7565fd6443eee04754e90aae48bebc1c96eb94db8b22d272b03

Observation d726839e-8c86-4918-a325-1dbbfc551fab · outbound

This paper cites Consistencies are all you need for semi-supervised vision-language tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Consistencies are all you need for semi-supervised vision-language tracking,

Reference 63

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:b77b3b533588a177e1458a20d87f0bb68abef2a8482af15208a46b4fac636e3d

Observation dc277698-4fb8-4f61-9458-93869052e045 · outbound

This paper cites One-stream stepwise decreasing for vision-language tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking One-stream stepwise decreasing for vision-language tracking,

Reference 64

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:d21804660391c3faf29995e8c89997dfe90b2b23a6ffe3601ad331952876fdfc

Observation 9bd60c18-a9cc-4ce4-9dc2-387bbc900887 · outbound

This paper cites ATSTrack: Enhancing Visual-Language Tracking by Aligning Temporal and Spatial Scales.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking ATSTrack: Enhancing Visual-Language Tracking by Aligning Temporal and Spatial Scales

Reference 65

Resolution
verified exact
arxiv_id, observed 2026-06-30T07:24:21.279204Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:370f45d5166135107d22196cec5c324feef91175230eae62272acf4a9932020e

Observation 1561aa8e-dfcc-417c-ac7f-530fd6d1396f · outbound

This paper cites Robust tracking via mamba-based context-aware token learning,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Robust tracking via mamba-based context-aware token learning,

Reference 66

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:7a4d7c62d477740f95c5b0f2dc2318ecf119de035dab6e5c758be1f30badced7

Observation 574127d4-b9a6-4f1b-a44a-29f4c89cec5b · outbound

This paper cites Aware distilla- tion for robust vision-language tracking under linguistic sparsity,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Aware distilla- tion for robust vision-language tracking under linguistic sparsity,

Reference 67

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:8e2588f900b3439e83ddb7ee466c65e3383932996e276909bfbfd523b2cba97f

Observation 700c6093-854e-48b2-978e-6d287d1a6282 · outbound

This paper cites Vision-language tracking with attention-based optimization,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Vision-language tracking with attention-based optimization,

Reference 68

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:a919993e6b08b3a8f1b0f7cc2843908d1dc4247882fdc552109ed6034cb75e63

Observation 4ac4e4fc-dd39-4b29-87f0-c3a5b1f0ff49 · outbound

This paper cites Sematrack: semantic-driven unified vision-language tracking: J. zhang et al.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Sematrack: semantic-driven unified vision-language tracking: J. zhang et al

Reference 69

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:2072f83d7b085fee351e75318ad6c54fd7835b8418003c693963c1f4d5787d31

Observation 1e31ead8-8ef1-45f6-99ed-a3d8523d396a · outbound

This paper cites Rwkv-inspired multi-modal relation modeling for vision-language tracking,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Rwkv-inspired multi-modal relation modeling for vision-language tracking,

Reference 70

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:d68dfaca7daaea67c0d6701a2f3592a7159f6c324114ac444f3c4da620418ef5

Observation 5fddf6f9-67cf-4110-a1c9-2343129c729e · outbound

This paper cites Transformer Tracking with Cyclic Shifting Window Attention.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Transformer Tracking with Cyclic Shifting Window Attention

Reference 71

Resolution
verified exact
arxiv_id, observed 2026-06-30T07:24:21.278948Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:4b66b377a78a090711a3e15b507442447411b718a02bc9777e6a648af7e2b07b

Observation 35379813-be47-46b8-92aa-ace61b7ef44c · outbound

This paper cites Transformer vision- language tracking via proxy token guided cross-modal fusion,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Transformer vision- language tracking via proxy token guided cross-modal fusion,

Reference 72

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:7d494010337ee1d9493da6887e4a5442afff58e43f56b1161497116178d79b1c

Observation 401366df-9a03-4a21-9929-74d04c67c735 · outbound

This paper cites Real-time visual object tracking with natural language description,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Real-time visual object tracking with natural language description,

Reference 73

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:9b44a867d4729ff892b60f9e91a9fe5319caa309fde77c28fcb8f8feac32786c

Observation da0e173f-74e4-4cc2-a2b8-57960ae710f8 · outbound

This paper cites Siamese natural language tracker: Tracking by natural language descriptions with siamese track- ers,.

Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking Siamese natural language tracker: Tracking by natural language descriptions with siamese track- ers,

Reference 74

Resolution
unresolved
no resolver link, observed 2026-06-30T07:20:54.642591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-30T07:20:54.642591Z digest=sha256:b58f1d04e3908e13760e61d2b9b83527a789d6c76ba653ecc5ab96993c5fb7b2

Pith citing papers

No inbound Pith citation observations are available.