I2VShield: Difesa Proattiva Contro i Modelli Immagine-Video Basati su DiT
I ricercatori propongono I2VShield, un metodo di attacco generativo avversario per proteggere la privacy contro i modelli immagine-video (I2V) basati su Diffusion Transformer (DiT). Le attuali difese proattive si basano su attacchi basati sul gradiente che richiedono un'elevata memoria GPU, ma I2VShield riduce il carico computazionale attraverso un framework di perturbazione adattivo al testo e un attacco non mirato di Disruzione dell'Attenzione Multimodale (MAD). Il metodo mira a prevenire l'uso improprio dei modelli I2V mantenendo l'impercettibilità visiva.
Fatti principali
- I2VShield è una difesa proattiva contro i modelli I2V basati su DiT
- Utilizza attacchi generativi avversari invece di metodi basati sul gradiente
- Include un framework di generazione di perturbazioni adattivo al testo
- Include un attacco non mirato di Disruzione dell'Attenzione Multimodale (MAD)
- Riduce il carico computazionale e i requisiti di memoria GPU
- Mantiene l'impercettibilità visiva delle perturbazioni
- Affronta l'uso improprio dei modelli di generazione video
- Pubblicato su arXiv con ID 2607.25522
Entità
Istituzioni
- arXiv