Pith. sign in

Paper Citation Record · LEDGER

Collaborative Edge-to-Server Inference for Vision-Language Models

As of 23 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 2 inbound Pith citation observations for arXiv:2512.16349.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2512.16349 v2

Coverage vector

measured 43 of 43 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-03T15:37:51.027208Z

measured 45 of 45 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-23T06:30:58.430688+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-31T22:24:19.238442Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-12T09:31:25.570140Z

Reference resolution

43 of 43 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved43
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 5ea58c87-488c-4205-a8b1-c1e319ab77c6 · outbound

This paper cites Learning transferable visual models from natural language supervision,.

Collaborative Edge-to-Server Inference for Vision-Language Models Learning transferable visual models from natural language supervision,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:46.098439Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:46.098439Z digest=sha256:7d2d3199d6396e6ac876fec9cb07e4760ad0cb6a8f428e8098514c32b9bd7b12

Observation d9066750-7f8d-4221-a1a2-523081d9a568 · outbound

This paper cites Vision-language mo dels for vision tasks: a survey,.

Collaborative Edge-to-Server Inference for Vision-Language Models Vision-language mo dels for vision tasks: a survey,

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:46.243645Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:46.243645Z digest=sha256:4f43796431495454bea6a116468e863328ce9f34ea062dbbe0ae4cc2486ece1b

Observation 56450dae-7570-430e-a692-095e6d7667e7 · outbound

This paper cites Improved baselines wit h visual in- struction tuning,.

Collaborative Edge-to-Server Inference for Vision-Language Models Improved baselines wit h visual in- struction tuning,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:46.409507Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:46.409507Z digest=sha256:1ae759d0fd8783c7324b7315b281904387247784f81ec3007846bb31b7d7c902

Observation 42c01d30-2ed0-4d7b-bbc3-9ee7e4a0f872 · outbound

This paper cites InstructBLIP: Towards general-purpose vision -language models with instruction tuning,.

Collaborative Edge-to-Server Inference for Vision-Language Models InstructBLIP: Towards general-purpose vision -language models with instruction tuning,

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:46.587664Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:46.587664Z digest=sha256:81ac3bb6dc4f17176734c2a3665941b9b0f6b61baf3a2ad979d062c1ca8bf07b

Observation b6e5c192-da06-4a1f-9ae8-288abe456ddb · outbound

This paper cites Qwen2.5-VL Technical Report.

Collaborative Edge-to-Server Inference for Vision-Language Models Qwen2.5-VL Technical Report

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:46.756728Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:46.756728Z digest=sha256:082f6e5c6849418b117b632302d0db5e8096c9b382ddc411e523972c71ac2e5a

Observation 1c72c860-9df8-4854-8425-f0b97404df86 · outbound

This paper cites Vision -language models for edge networks: A comprehensive survey,.

Collaborative Edge-to-Server Inference for Vision-Language Models Vision -language models for edge networks: A comprehensive survey,

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:46.901390Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:46.901390Z digest=sha256:6ce3a5fcec4571bfd847cbbefb23d95a322a816bdb74777373b5f32331b630a6

Observation d2773722-48cc-4ffd-9ec6-cca37239e2b1 · outbound

This paper cites Task- oriented feature compression for multimodal understandin g via device- edge co-inference,.

Collaborative Edge-to-Server Inference for Vision-Language Models Task- oriented feature compression for multimodal understandin g via device- edge co-inference,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:47.042649Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:47.042649Z digest=sha256:bfb78294269aa790c4f67eeb745f93543a1c9916a037405308cc1d5dfad30286

Observation f56f103b-8ad4-4950-9da5-d87db867292e · outbound

This paper cites V aVLM: Toward efficient edge-cloud video analytics with vision- language models,.

Collaborative Edge-to-Server Inference for Vision-Language Models V aVLM: Toward efficient edge-cloud video analytics with vision- language models,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:47.196475Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:47.196475Z digest=sha256:1c709d29b8d968256bc296891ae39a33a1a6f1e43c6b4d0daccd6afd0edff832

Observation 30a5ef0a-8f78-4bb5-87fa-a756ea80ac59 · outbound

This paper cites An image is worth 16x16 words: Transformers for image recog nition at scale,.

Collaborative Edge-to-Server Inference for Vision-Language Models An image is worth 16x16 words: Transformers for image recog nition at scale,

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:47.347325Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:47.347325Z digest=sha256:befa085c24902ab7549a267248a6190bead57be01558475a682b50976e074b62

Observation 3a121aa3-ad9b-4973-9c11-2fb3f370800f · outbound

This paper cites Sigmo id loss for language image pre-training,.

Collaborative Edge-to-Server Inference for Vision-Language Models Sigmo id loss for language image pre-training,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:47.476369Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:47.476369Z digest=sha256:55a3fce6a0de636086400958a95beef9528b29a57a5c14a69b0faab8621f6937

Observation de37b8ea-03d5-430e-b5f9-a5b4a6f38f66 · outbound

This paper cites MLLMs know where to look: Training-free perception of small visual det ails with multimodal LLMs,.

Collaborative Edge-to-Server Inference for Vision-Language Models MLLMs know where to look: Training-free perception of small visual det ails with multimodal LLMs,

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:47.611366Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:47.611366Z digest=sha256:65565e2b8ffa9be699a33d67f46864337b59fce44225cfff47be04b3e1238d1f

Observation b428fb37-831b-47b1-b562-6f7435c7d61a · outbound

This paper cites Reducing activation recompu tation in large transformer models,.

Collaborative Edge-to-Server Inference for Vision-Language Models Reducing activation recompu tation in large transformer models,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:47.738890Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:47.738890Z digest=sha256:4fb190a43680d14aebe2ef7fb3f98351add0d88d1ba47977a11a2fdb0f401a9b

Observation 350f408b-651d-423a-8f85-e12527ce26f5 · outbound

This paper cites The operational meaning of min- and max-entropy,.

Collaborative Edge-to-Server Inference for Vision-Language Models The operational meaning of min- and max-entropy,

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:47.834799Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:47.834799Z digest=sha256:3c43cd38a18d7206837fb88d2381b967f1f5f3de5cd8852b08f15d3cccb8610f

Observation cacec9fc-fe24-44c1-ac2d-e6d980b978cc · outbound

This paper cites A mathematical theory of communication ,.

Collaborative Edge-to-Server Inference for Vision-Language Models A mathematical theory of communication ,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:47.939465Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:47.939465Z digest=sha256:09ae3b522b4290c38b11cdc7b942cc2a70c182d6fcb8f7984a97a702ba77ea95

Observation e9448300-2e82-4258-91bc-c9588a2f0300 · outbound

This paper cites Settles, Active Learning.

Collaborative Edge-to-Server Inference for Vision-Language Models Settles, Active Learning

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:48.039866Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:48.039866Z digest=sha256:ad6289089e3ac29351da1da8bd03cbee185d32edb54b49a89ad4c947d1fc381c

Observation 7dc207d2-6bc3-427a-84db-a8e0b31a99b2 · outbound

This paper cites Llama 2: Open Foundation and Fine-Tuned Chat Models.

Collaborative Edge-to-Server Inference for Vision-Language Models Llama 2: Open Foundation and Fine-Tuned Chat Models

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:48.106247Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:48.106247Z digest=sha256:a5ebeb77df877cc25feef39e0b91a768375e915fe488782c16f92a331bb5ac6f

Observation 047ec4f7-9c92-47f9-998e-52b9795a8975 · outbound

This paper cites Gemma: Open Models Based on Gemini Research and Technology.

Collaborative Edge-to-Server Inference for Vision-Language Models Gemma: Open Models Based on Gemini Research and Technology

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:48.165219Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:48.165219Z digest=sha256:c31524001974884cb9ed4fc48e3450bbcffd6c2db68b5d69b97c07309db5ef63

Observation 761d2c2f-932a-4f52-8e20-8466386296e1 · outbound

This paper cites Vicuna: An open-source chatbot impressing GPT- 4 with 90%* chatGPT quality,.

Collaborative Edge-to-Server Inference for Vision-Language Models Vicuna: An open-source chatbot impressing GPT- 4 with 90%* chatGPT quality,

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:48.251127Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:48.251127Z digest=sha256:2e4f0bbb20d5d069cd54cf6108e0fc9e625f259f55f4ba0b879f7b82f0c58d30

Observation f78f37a0-15b2-493e-877d-87c4c8ad5070 · outbound

This paper cites Sentencepiece: A simple and language independent subword tokenizer and detokenizer for neural t ext process- ing,.

Collaborative Edge-to-Server Inference for Vision-Language Models Sentencepiece: A simple and language independent subword tokenizer and detokenizer for neural t ext process- ing,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:48.343741Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:48.343741Z digest=sha256:5dd155b089b6e79a7148bc5feabd2b13cb5a7538120984b0ba507cc90e61ca25

Observation 9d32617a-63db-4c92-a9c9-6f241b7808b8 · outbound

This paper cites Attention is all you need,.

Collaborative Edge-to-Server Inference for Vision-Language Models Attention is all you need,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:48.420489Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:48.420489Z digest=sha256:9e2f11d3e3ddedd221333100df9402460ea9d3a1eceb77a9c074170379d5c7c5

Observation 00bca13a-86ba-49ec-bc4e-efd61c307a78 · outbound

This paper cites Attent ion-aware semantic communications for collaborative inference,.

Collaborative Edge-to-Server Inference for Vision-Language Models Attent ion-aware semantic communications for collaborative inference,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:48.513951Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:48.513951Z digest=sha256:3033ddc9b7ee6db62443a5284e6cfeb6f7568385887d0a810b2cb8b62e3f19b5

Observation 85c2e35b-2efd-4287-86bf-6a435bd994b7 · outbound

This paper cites Vision transform er-based semantic communications with importance-aware quantizat ion,.

Collaborative Edge-to-Server Inference for Vision-Language Models Vision transform er-based semantic communications with importance-aware quantizat ion,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:48.586978Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:48.586978Z digest=sha256:9c9e7c6e9cc1940f00c6dc263648fe13d0fbbed72b25e42f9e8bcefea9c6db46

Observation bbc4b75a-6b1e-44a6-aaf0-4c945ee002f1 · outbound

This paper cites An image is worth 1/2 tokens after layer 2: Plug-and-play in ference acceleration for large vision-language models,.

Collaborative Edge-to-Server Inference for Vision-Language Models An image is worth 1/2 tokens after layer 2: Plug-and-play in ference acceleration for large vision-language models,

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:48.634368Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:48.634368Z digest=sha256:0ee6b6e45f37ca26e480de78c287eb901ac7c291926f710ac0af91fd8c82d31b

Observation f383a59d-88a2-4564-9f55-2697344a1350 · outbound

This paper cites Beyond text-visual attention: Exploiting vi sual cues for effective token pruning in VLMs,.

Collaborative Edge-to-Server Inference for Vision-Language Models Beyond text-visual attention: Exploiting vi sual cues for effective token pruning in VLMs,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:48.695349Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:48.695349Z digest=sha256:4e2629d406657ada9fd8615f0fb5869f1b6a9b7b5b5153638aa9a27a062c1f86

Observation fe6f0464-c1b2-441c-8b7f-fba67127f8e8 · outbound

This paper cites Beyond transmitting bits: Conte xt, seman- tics, and task-oriented communications,.

Collaborative Edge-to-Server Inference for Vision-Language Models Beyond transmitting bits: Conte xt, seman- tics, and task-oriented communications,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:48.735983Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:48.735983Z digest=sha256:f725f195c0b01bcc37e5ecb82752a451a2ea9548635f81b562f147e4e5506935

Observation 020baf28-dc28-4faf-99c0-af9e82d93e07 · outbound

This paper cites From semantic communi cation to semantic-aware networking: Model, architecture, and open problems,.

Collaborative Edge-to-Server Inference for Vision-Language Models From semantic communi cation to semantic-aware networking: Model, architecture, and open problems,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:48.844527Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:48.844527Z digest=sha256:759a51772c695d074d15cbbfeadee6f11bf6eef17eb0d55969e9d94d4c578f1c

Observation df67b556-0885-4bcc-adcf-3aad05718aa4 · outbound

This paper cites What is semantic communication? A view on conveyi ng meaning in the era of machine intelligence,.

Collaborative Edge-to-Server Inference for Vision-Language Models What is semantic communication? A view on conveyi ng meaning in the era of machine intelligence,

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:48.928744Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:48.928744Z digest=sha256:675bab40e7fd4fe7c5ea6b8edc86823782e2445073b64bb2b7f6aca2805c700b

Observation ae04d61b-8f46-4e7b-8e63-b15623a64aa6 · outbound

This paper cites Toward semanti c communications: Deep learning-based image semantic codin g,.

Collaborative Edge-to-Server Inference for Vision-Language Models Toward semanti c communications: Deep learning-based image semantic codin g,

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:49.001518Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:49.001518Z digest=sha256:ab79e154036ff41316145418ce680d36591c9ba02ee204f854dff800f7b9c6f7

Observation d3b52840-9817-445e-b792-30132a890261 · outbound

This paper cites A lite distributed semantic communic ation system for internet of things,.

Collaborative Edge-to-Server Inference for Vision-Language Models A lite distributed semantic communic ation system for internet of things,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:49.099879Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:49.099879Z digest=sha256:ee6d77c48c266783a90c6afcec5a3d8ff8fa98d3df9d0a01dc17358eccdd469d

Observation 6eb50103-bc93-4ac2-9431-80aafecb2708 · outbound

This paper cites A unified multi- task semantic communication system for multimodal data,.

Collaborative Edge-to-Server Inference for Vision-Language Models A unified multi- task semantic communication system for multimodal data,

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:49.170859Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:49.170859Z digest=sha256:c94330273a34281f4103ef470e7b3f04917f9f4f67326f22046711a6bab00e0e

Observation cfb95885-e871-419d-ace2-34d975c8a8e1 · outbound

This paper cites A survey on hallucination in large language models: Principles, taxonomy, challenges, and op en questions,.

Collaborative Edge-to-Server Inference for Vision-Language Models A survey on hallucination in large language models: Principles, taxonomy, challenges, and op en questions,

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:49.297636Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:49.297636Z digest=sha256:c61d574e8d62bf73749319c650986f499f9ca6185b8fee6c31fe362e5f79ff74

Observation 245daf9e-d256-498f-aaaf-ce14afcedf14 · outbound

This paper cites Fact-checking the output of large la nguage models via token-level uncertainty quantification,.

Collaborative Edge-to-Server Inference for Vision-Language Models Fact-checking the output of large la nguage models via token-level uncertainty quantification,

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:49.397102Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:49.397102Z digest=sha256:b5007309ac2f1eda4fad2494a246dea4ff36d710d2b73906362a6bfd73bcdb46

Observation 760c39af-4adb-4b2c-b448-8897b370d55b · outbound

This paper cites Language model cascades: Token-level uncert ainty and beyond,.

Collaborative Edge-to-Server Inference for Vision-Language Models Language model cascades: Token-level uncert ainty and beyond,

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:49.526554Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:49.526554Z digest=sha256:4cf8ebb43732bb6b0d26932fa76219a39de0309b7f252938988bf6f0b08562fb

Observation 9d0e2625-deb7-449e-b195-31c909012850 · outbound

This paper cites On the efficient estimat ion of min- entropy,.

Collaborative Edge-to-Server Inference for Vision-Language Models On the efficient estimat ion of min- entropy,

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:49.652883Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:49.652883Z digest=sha256:15feb8af84a877997e8b1659845b8e3afeb5c85bcc029f15a34574b727529d8d

Observation 99eb5949-ed62-4a2f-9d05-5ead20552de7 · outbound

This paper cites Towards VQA models that can read,.

Collaborative Edge-to-Server Inference for Vision-Language Models Towards VQA models that can read,

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:49.810945Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:49.810945Z digest=sha256:3272576a04e1557cf846e2f5b4dc1675224edce166584b8b4667945f9fef5b99

Observation 624c3bb9-8256-4c28-88d5-262a000f56eb · outbound

This paper cites Or ca: A distributed serving system for Transformer-based generat ive models,.

Collaborative Edge-to-Server Inference for Vision-Language Models Or ca: A distributed serving system for Transformer-based generat ive models,

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:49.942638Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:49.942638Z digest=sha256:cce9db3e0d45bb3ef6ee4b1d0722f440135d48209895eebc059090344be324ba

Observation 789730f9-d18a-49ab-a344-be80b54b257c · outbound

This paper cites Taming throughput-latency trad eoff in LLM inference with Sarathi-serve,.

Collaborative Edge-to-Server Inference for Vision-Language Models Taming throughput-latency trad eoff in LLM inference with Sarathi-serve,

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:50.075277Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:50.075277Z digest=sha256:c0ec454e9848816251f99e6b34bafb85977cccd32339336aba43ea8c35c177e8

Observation e91eb12c-3b5e-449d-832e-545eb6b7c479 · outbound

This paper cites PaliGemma: A versatile 3B VLM for transfer.

Collaborative Edge-to-Server Inference for Vision-Language Models PaliGemma: A versatile 3B VLM for transfer

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:50.241466Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:50.241466Z digest=sha256:6c7893544526b9c9168cf3cff13653bc6b3e9fee8cbac95e5bcda55cc2c1c613

Observation 9aaec763-bec5-4c5d-8a9c-eaf8377a34d3 · outbound

This paper cites E valuating object hallucination in large vision-language models,.

Collaborative Edge-to-Server Inference for Vision-Language Models E valuating object hallucination in large vision-language models,

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:50.362158Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:50.362158Z digest=sha256:4377e064d9af78f6667596ca6dc55048bac60524d7594fb2eeb4cd8625ea429b

Observation e2b0d292-6e0b-4b61-b221-8b4491f0c51e · outbound

This paper cites A-OKVQA: A benchmark for visual question answering using w orld knowledge,.

Collaborative Edge-to-Server Inference for Vision-Language Models A-OKVQA: A benchmark for visual question answering using w orld knowledge,

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:50.497050Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:50.497050Z digest=sha256:11147c4afa8df92b1307b1fdf29bd976b956e5815f53d8b4e8911df7d01b40c6

Observation 58eb65ed-7714-4c86-9a69-2d948c98afc4 · outbound

This paper cites GQA: A new dataset for rea l-world visual reasoning and compositional question answering,.

Collaborative Edge-to-Server Inference for Vision-Language Models GQA: A new dataset for rea l-world visual reasoning and compositional question answering,

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:50.661858Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:50.661858Z digest=sha256:2a0545d96ddd8e3143174d0dd9ea141ee143deaaa35e25cd20f67cd8c386b0d0

Observation 6de63489-34f5-43c9-a7a2-803ba56a96df · outbound

This paper cites Making the V in VQA matter: Elevating the role of image understandin g in visual question answering,.

Collaborative Edge-to-Server Inference for Vision-Language Models Making the V in VQA matter: Elevating the role of image understandin g in visual question answering,

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:50.837956Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:50.837956Z digest=sha256:acaff8fdcc9f6240dad18a56d6711e7e291f91dcc19077e18d600e8eb0822ce4

Observation 08ef5b74-e758-4598-86ae-350bddf140cb · outbound

This paper cites On a measure of divergence between t wo multino- mial populations,.

Collaborative Edge-to-Server Inference for Vision-Language Models On a measure of divergence between t wo multino- mial populations,

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-03T15:37:51.027208Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:37:51.027208Z digest=sha256:04162eb2e4b42556dfa8ee299fcd3a005f1639582cca7e563d5970e4cc86b811

Pith citing papers

Observation 724d9d35-6568-465b-90f8-c266f6616baf · inbound

Progressive Semantic Communication for Efficient Edge-Cloud Vision-Language Models cites this paper.

Progressive Semantic Communication for Efficient Edge-Cloud Vision-Language Models Collaborative Edge-to-Server Inference for Vision-Language Models

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-06-09T03:08:03.242030Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-07T10:45:20.829708Z digest=sha256:33e9c16ccc2c991359f32d4b844e69190b103a2f19a08830e5d8b4a2bf1150bd

Observation bef0fc3b-9390-43eb-9614-0282e69eae04 · inbound

LAST: The Last Query Token Guides Visual Token Pruning for Edge-Cloud Collaborative MLLM Inference cites this paper.

LAST: The Last Query Token Guides Visual Token Pruning for Edge-Cloud Collaborative MLLM Inference Collaborative Edge-to-Server Inference for Vision-Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-07-31T22:24:19.238442Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T22:24:19.238442Z digest=sha256:f0d8a4b0211a37c545d8f7b03ff1f4094b0e656efb8d283ad99efaf681d43d1b