A multi-loss adversarial image search that combines scenario-aware image generation and flat-minima-inspired loss range selection improves VLM jailbreak success rates.
Minigpt- v2: large language model as a unified interface for vision- language multi-task learning, 2023
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.CV 1years
2024 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Exploring Visual Vulnerabilities via Multi-Loss Adversarial Search for Jailbreaking Vision-Language Models
A multi-loss adversarial image search that combines scenario-aware image generation and flat-minima-inspired loss range selection improves VLM jailbreak success rates.