Vulnérabilités choquantes des IA : jailbreaks à petit prix
Un outil développé par FAR.AI révèle que les modèles d'IA frontaliers comme Grok (448 jailbreaks) et Gemini (249) peuvent être facilement manipulés pour générer des contenus dangereux. Le coût pour contourner leurs sécurités est minime : 58$ pour Grok, 278$ pour Gemini. Les experts appellent à une régulation externe.
« "AI models right now are less regulated than restaurants," says Adam Gleave, the CEO of FAR.AI. » — Wired AI
Que faut-il retenir ?
- Grok est le modèle le plus vulnérable avec 448 jailbreaks identifiés.
- Gemini présente 249 vulnérabilités aux jailbreaks selon le rapport.
- Le coût pour jailbreaker Grok est de 58$, 278$ pour Gemini.
- Claude, Fable et GPT se sont montrés imperméables aux attaques testées.
Pourquoi cette nouvelle compte-t-elle ?
Ces vulnérabilités exposent les risques concrets d'utilisation malveillante des IA génératives, malgré les protections annoncées par les géants tech. La facilité et le faible coût des jailbreaks remettent en cause l'autorégulation du secteur, nécessitant des standards de sécurité plus stricts. Les professionnels doivent intégrer ces risques dans leurs stratégies de déploiement d'IA.
58$ pour jailbreaker Grok, 278$ pour Gemini
💬 Adam Gleave, CEO de FAR.AI
Public concerné : entreprises, développeurs