Pith. sign in

Jailbreak vision language models via bi-modal adversarial prompt

8 Pith papers cite this work, alongside 1 external citations. Polarity classification is still indexing.

8 Pith papers citing it
1 external citations · external index

citation-role summary

background 4

citation-polarity summary

verdicts

UNVERDICTED 8

roles

background 4

polarities

background 4

representative citing papers

Visual Adversarial Attack on Vision-Language Models for Autonomous Driving

cs.CV · 2024-11-27 · unverdicted · novelty 7.0

ADvLM is the first visual adversarial attack framework for VLMs in autonomous driving, using semantic-invariant induction via LLM-generated prompt libraries and scenario-associated attention-based enhancement to achieve SOTA attack effectiveness across benchmarks and real-world tests.

Laundering AI Authority with Adversarial Examples

cs.CR · 2026-05-05 · unverdicted · novelty 5.0

Adversarial examples enable AI authority laundering by causing production VLMs to give authoritative but wrong responses on subtly perturbed images, with success rates of 22-100% using decade-old attack methods.

citing papers explorer

Showing 8 of 8 citing papers.