Skip to content

Multimodal attacks

Probe vision-, audio-, and mixed-input generative models with modality-typed transforms.

Transform-based probing across vision, audio, and text modalities. Applies the transform catalog to multimodal inputs (images, audio, or mixed) before scoring the model’s response.

from dreadnode.airt import multimodal_attack

When to use: Testing multimodal models that accept images, audio, or mixed inputs.