Anthropic veut imposer un standard commun pour mesurer la gravité des jailbreaks
Pendant qu'Amazon, Microsoft et Google planchent sur un langage commun de la sécurité IA avec Anthropic, une petite affaire de retour commercial…
Tous nos articles et analyses sur sécurité IA — 17 publications.
Pendant qu'Amazon, Microsoft et Google planchent sur un langage commun de la sécurité IA avec Anthropic, une petite affaire de retour commercial…
Anthropic a lancé Claude Fable 5 le 9 juin 2026, premier modèle de classe Mythos accessible au grand public. Sa particularité : une couche de…
Rohin Shah et Four Flynn, chercheurs chez Google DeepMind, ont rendu publique une méthodologie interne inédite pour sécuriser les systèmes de Google…
Quand des millions d'agents IA autonomes, issus d'organisations différentes, commenceront à interagir dans les mêmes environnements numériques,…
Avec le lancement en preview de Sol, son modèle flagship, OpenAI a publié un document de sécurité sans précédent détaillant risques cyber et…
Le 12 juin 2026, Anthropic a rendu public son premier « Anthropic Public Record », un document de transparence volontaire sur les capacités et…
Lors de son premier événement dédié aux développeurs, Meta a présenté plusieurs outils de protection pour les applications basées sur Llama, tout en…
Alors que les agents IA gagnent en autonomie et en puissance, Google DeepMind a publié un cadre inédit de sécurité systémique — l'AI Control Roadmap…