Pith. sign in

Paper Citation Record · LEDGER

ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 18 inbound Pith citation observations for arXiv:2410.06625.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2410.06625 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 18 of 18 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-22T06:32:14.747728+00:00

measured 18 of 18 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-16T10:36:48.083772Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-01T14:45:49.583188Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 2474ca4e-e866-4dc3-8446-10d964c193e0 · inbound

VLSBench: Unveiling Visual Leakage in Multimodal Safety cites this paper.

VLSBench: Unveiling Visual Leakage in Multimodal Safety ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-12T05:56:46.354498Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-12T05:56:46.354498Z digest=sha256:fed91abe6c391c1dea45febc0d17271081dc9e47251ad70460f25dafed95af9f

Observation 9280adeb-be5e-47b6-9f7a-94c536b1025f · inbound

Analyzing Finetuning Representation Shift for Multimodal LLMs Steering cites this paper.

Analyzing Finetuning Representation Shift for Multimodal LLMs Steering ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-10T22:03:24.723180Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:03:24.723180Z digest=sha256:84ce00e42627dd9ca3163b622a61f86941bb7a930c7a18851f6dc1a3e1f528ff

Observation a3729146-d713-4eb7-8004-9220fe90bc84 · inbound

A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations cites this paper.

A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T19:45:18.216185Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T19:45:18.216185Z digest=sha256:e41d1f721b228ef3614569f542edfcc8839a6e33037304fb61f8675cafe33e89

Observation 634f42b0-c071-4ebb-8437-de28733da301 · inbound

Safety in Large Reasoning Models: A Survey cites this paper.

Safety in Large Reasoning Models: A Survey ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-16T10:36:48.083772Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T10:36:48.083772Z digest=sha256:4bce2e4eb6bb3a32c97b8d41f5f94d95614af7ede9fbf928d7757d980c4161ec

Observation b38f74aa-c96f-4e64-b2cc-6841eb7b6813 · inbound

GuardReasoner-VL: Safeguarding VLMs via Reinforced Reasoning cites this paper.

GuardReasoner-VL: Safeguarding VLMs via Reinforced Reasoning ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-15T21:05:17.345848Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:05:17.345848Z digest=sha256:fe8ade0f5de29070299381b472c7463aa55e40f3d6b238e629261efab85c1e58

Observation 71c06227-c851-4b21-a88d-dc330c50fe68 · inbound

Seeing the Threat: Vulnerabilities in Vision-Language Models to Adversarial Attack cites this paper.

Seeing the Threat: Vulnerabilities in Vision-Language Models to Adversarial Attack ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T13:22:00.577809Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T13:22:00.577809Z digest=sha256:7e2880347ee532980baba7b124dc5580231d4c6ba3d4e199439c721e7fe7b2ad

Observation 10490e61-fe9e-4378-8a94-1dcea2e4c117 · inbound

Bootstrapping LLM Robustness for VLM Safety via Reducing the Pretraining Modality Gap cites this paper.

Bootstrapping LLM Robustness for VLM Safety via Reducing the Pretraining Modality Gap ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-07T12:37:20.634917Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:37:20.634917Z digest=sha256:9d311a7a88decd263015e4ee5e8a4494bc265f037d7266c294aa92b3f9cff893

Observation 71bdcb01-8904-4e8f-96c7-830263e41da1 · inbound

AMIA: Automatic Masking and Joint Intention Analysis Makes LVLMs Robust Jailbreak Defenders cites this paper.

AMIA: Automatic Masking and Joint Intention Analysis Makes LVLMs Robust Jailbreak Defenders ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:26.553538Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:35:26.553538Z digest=sha256:c769e968660ce776f0a28d521a5310e4079fbfb7a46e0283f737358d49859a7e

Observation d39f1b4b-062a-4184-b81e-7ed8a721595d · inbound

Mitigating Object Hallucination via Robust Local Perception Search cites this paper.

Mitigating Object Hallucination via Robust Local Perception Search ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T05:53:58.538546Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T05:53:58.538546Z digest=sha256:75f873547addb76a5cd5f851452d540287dd772075951abb15d2554f75767013

Observation 46b7d000-77e8-41a7-a883-caccc8755ba0 · inbound

Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities cites this paper.

Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-06T17:21:35.186888Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T17:21:35.186888Z digest=sha256:04840288d8beed0fa381f60b2865c128045bee160aa84c3b0549db22fd2dd0a9

Observation 101c3ec7-e871-4ef9-a72e-30496f0e8a9b · inbound

A Survey on Training-free Alignment of Large Language Models cites this paper.

A Survey on Training-free Alignment of Large Language Models ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-05T21:18:39.389808Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:18:39.389808Z digest=sha256:91bb7c596779fe8c46850f1cc554b8e7079063e62f81ea0d7a7737febe795f2f

Observation 9044901f-3b95-4c4e-9c8d-d5160c9003fa · inbound

Empowering Multimodal LLMs with External Tools: A Comprehensive Survey cites this paper.

Empowering Multimodal LLMs with External Tools: A Comprehensive Survey ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 244

Resolution
unresolved
no resolver link, observed 2026-08-05T20:29:07.659178Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T20:29:07.659178Z digest=sha256:a325138ebf4d23733639a6c560a2f92235b264f0d7687e9bffdbd1dd8760a305

Observation 34f8e112-816e-4c98-81cb-ba0ce7dd8714 · inbound

Attention Misses Visual Risk: Risk-Adaptive Steering for Multimodal Safety Alignment cites this paper.

Attention Misses Visual Risk: Risk-Adaptive Steering for Multimodal Safety Alignment ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 2009

Resolution
unresolved
no resolver link, observed 2026-08-04T09:47:23.180246Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T09:47:23.180246Z digest=sha256:a05a917daddd754802f45b25bb001874791c78a1a07ccdf73cc2807aad9d2f51

Observation cbfed91c-c0b4-4291-8d23-bcd3a87acbb2 · inbound

Targeted Interpretable Safety Neuron Enhancement for Multilingual Vision-Language Large Models cites this paper.

Targeted Interpretable Safety Neuron Enhancement for Multilingual Vision-Language Large Models ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-05-11T05:20:57.958576Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-05-10T18:12:34.909229Z digest=sha256:5d308369d3f8a7f466b42c309bc783d83aaa6d16b9c777979718c108b4f7c3aa

Observation fca7e6c5-d50e-4c32-8ea1-84d9756bbc11 · inbound

Targeted Interpretable Safety Neuron Enhancement for Multilingual Vision-Language Large Models cites this paper.

Targeted Interpretable Safety Neuron Enhancement for Multilingual Vision-Language Large Models ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-02T16:34:02.952337Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:34:02.952337Z digest=sha256:b1a46be783c9e841191ca6ba57e63a69cb02d6de9aa6164882fc90492d7c5ad0

Observation 64bfa40e-666f-40c4-b59f-b8a0e6938496 · inbound

WARD: Adversarially Robust Defense of Web Agents Against Prompt Injections cites this paper.

WARD: Adversarially Robust Defense of Web Agents Against Prompt Injections ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-07-01T14:45:49.584717Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-06-30T20:16:13.413064Z digest=sha256:440d7122a3fc2d51fd83f94016b3c926792de804e5e09485dadc8888a163d5db

Observation 55077588-5b9a-4486-83d6-82cb93ab2013 · inbound

Visual Token Compression Enhances Robustness of MLLMs cites this paper.

Visual Token Compression Enhances Robustness of MLLMs ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-01T13:10:37.290149Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T13:10:37.290149Z digest=sha256:07cfea71d0408b03abcde9a7ddcb698d964c832cdb209c7a2e6a15b8041c467c

Observation 27035e5d-4456-46c9-8155-230aefb14533 · inbound

One Anchor for All: Unified Multilingual and Multimodal Safety Alignment for LVLMs cites this paper.

One Anchor for All: Unified Multilingual and Multimodal Safety Alignment for LVLMs ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 36

Resolution
unresolved
no resolver link, observed 2026-07-31T23:07:40.056533Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T23:07:40.056533Z digest=sha256:884467146f05297a730a9d45e2b9ff1ce88f36ecfcb89536b0748d40fe4634f5