Sécurité de l'IA & Anthropic
L'actualité de la sécurité et de la sûreté de l'IA autour de Claude : alignement, red teaming, jailbreaks, vulnérabilités, divulgations et politiques de sécurité d'Anthropic.
Sécurité·VOI.ID
Anthropic : Claude utilisé par des groupes liés à la Russie et à la Chine dans des opérations de cybersécurité (ouvre un nouvel onglet)
il y a 1 j
Sécurité·zdnet.fr
Sécurité de l'IA : Anthropic appelle à ralentir le développement ... (ouvre un nouvel onglet)
il y a 2 j
Sécurité·lefilia.fr
Anthropic sous le feu des critiques cette semaine sur la cybersécurité (ouvre un nouvel onglet)
il y a 4 j
Sécurité·Les Smartgrids
Anthropic révèle les failles de sécurité de Claude face aux contournements (ouvre un nouvel onglet)
il y a 5 j
Sécurité·Le Monde.fr
IA : le débat sur l’« IApocalypse » prend de l’ampleur après la démission d’un chercheur d’Anthropic et des incidents de sécurité (ouvre un nouvel onglet)
il y a 5 j
Sécurité·Developpez.com
Anthropic révèle un quatrième crime présumé commis par son IA et a publié une « évaluation d'alignement » détaillant comment Claude a accédé à des systèmes tiers sans autorisation (ouvre un nouvel onglet)
il y a 5 j
Sécurité·Zonebourse Suisse
NAGRAVISION lance NAGRA Venturi Agentic AI, intégré à Microsoft Azure et Microsoft Foundry, pour renforcer la sécurité du streaming (ouvre un nouvel onglet)
il y a 5 j
Sécurité·next.ink
Cybersécurité : l’âge de l’industrialisation, selon Anthropic (ouvre un nouvel onglet)
il y a 5 j
Sécurité·ActuIA
Anthropic requalifie ses incidents cyber en défaut d'alignement, en ajoute un quatrième et ouvre ses transcriptions à METR (ouvre un nouvel onglet)
il y a 6 j
Sécurité·Le Figaro
«Nous ne savions pas que des désalignements de cette gravité étaient possibles» : Anthropic révèle que l’IA peut sciemment ignorer les limites qui lui ont été fixées (ouvre un nouvel onglet)
il y a 6 j
Sécurité·Boursorama
Anthropic signale un quatrième incident de cybersécurité lié à une première version de Claude (ouvre un nouvel onglet)
il y a 6 j
Sécurité·Zonebourse Suisse
Anthropic signale un quatrième incident de cybersécurité impliquant une version préliminaire de Claude (ouvre un nouvel onglet)
il y a 6 j
Sécurité·Boursorama
Anthropic signale un quatrième incident de cybersécurité lié à une version préliminaire de Claude (ouvre un nouvel onglet)
il y a 6 j
Sécurité·fr.qz.com
Jacob Coxon quitte Anthropic en raison de craintes concernant la sécurité de l'IA auto-améliorante. (ouvre un nouvel onglet)
il y a 6 j
Sécurité·IGN France
Un chercheur en sécurité chez Anthropic estime qu'il y a plus de 10 % de chances que l'IA « puisse tuer tous les humains » au cours de la prochaine décennie (ouvre un nouvel onglet)
il y a 6 j
Sécurité·BFM
"Nous croyons réellement, et très sérieusement, que l’IA pourrait tuer tous les humains!": un chercheur d’Anthropic démissionne et alerte sur les dangers de l’intelligence artificielle, un responsable de la sécurité du géant lui donne raison (ouvre un nouvel onglet)
9 sept.
Sécurité·21news.be
Anthropic refuse de soumettre son IA la plus avancée aux experts britanniques de la sécurité (ouvre un nouvel onglet)
9 sept.
Sécurité·Frandroid
Jacob Coxon quitte Anthropic et accuse les entreprises d'IA de négliger la sécurité humaine (ouvre un nouvel onglet)
9 sept.
Sécurité·Brief IA
Anthropic : départ de Jacob Coxon et alertes sur la sécurité (ouvre un nouvel onglet)
9 sept.
Sécurité·Yellow.com
Anthropic suspend une partie de l’entraînement de son IA après des actions non autorisées et redéploie 150 ingénieurs vers la sécurité (ouvre un nouvel onglet)
8 sept.
Sécurité·Brief IA
Anthropic selon Tom Blomfield : « méganerds » et sécurité de l’IA (ouvre un nouvel onglet)
1 sept.
Sécurité·Economie Matin
Claude s’échappe trois fois : Anthropic investit massivement dans la sécurité (ouvre un nouvel onglet)
1 sept.
Sécurité·Brief IA
Anthropic : Claude automatise l’alignement d’IA à 4 $/h (ouvre un nouvel onglet)
29 août
Sécurité·Yellow.com
Anthropic affirme que Claude réduit les défaillances d’alignement dans des tests automatisés (ouvre un nouvel onglet)
28 août
Sécurité·Brief IA
Anthropic teste un chercheur IA d’alignement à 4 $/h (ouvre un nouvel onglet)
28 août
Sécurité·Unite.AI
Anthropic rapporte que les agents Claude ont atténué dix défaillances d’alignement (ouvre un nouvel onglet)
28 août
Sécurité·BFM
"Une invocation creuse de la sécurité nationale" : une juge contredit le Pentagone et Donald Trump, qui avaient exclu Anthropic de ses contrats militaires (ouvre un nouvel onglet)
28 août
Sécurité·lefilia.fr
La faille de sécurité d'un agent IA ayant… (ouvre un nouvel onglet)
26 août
Sécurité·fr.qz.com
Anthropic a renvoyé le personnel de SF chez eux en raison d'une grève de sécurité qui n'a pas été déclenchée. (ouvre un nouvel onglet)
25 août
Sécurité·ICTjournal
Un agent IA exploite de lui-même une faille dans un système de réservation (ouvre un nouvel onglet)
20 août
Sécurité·CoinDesk
La maison mère de Kraken, Payward, rejoint le Project Glasswing d'Anthropic pour renforcer la sécurité de l'IA (ouvre un nouvel onglet)
17 août
Sécurité·Benzinga France
Anthropic affirme que ses agents d'IA tuent des concurrents et contournent les contrôles de sécurité : voici ce que le rapport de risque de l'entreprise a trouvé (ouvre un nouvel onglet)
16 août
Sécurité·Brief IA
Anthropic face au risque de mésalignement : quel niveau de sécurité pour l’IA ? (ouvre un nouvel onglet)
16 août
Sécurité·Clubic
Anthropic découvre un trou de 11 mois dans la sécurité de ses IA (ouvre un nouvel onglet)
16 août
Sécurité·briefia.fr
Anthropic relève le risque de mésalignement après des tests (ouvre un nouvel onglet)
15 août
Sécurité·journaldunet.com
Claude a piraté trois entreprises réelles pendant un test de sécurité : le problème n'était pas l'IA (ouvre un nouvel onglet)
10 août
Sécurité·Fredzone
Une fausse procédure d’installation de Claude AI compromet la sécurité des portefeuilles crypto sur macOS (ouvre un nouvel onglet)
10 août
Sécurité·Brief IA
Claude Code : l'auto mode par défaut révolutionne la sécurité (ouvre un nouvel onglet)
10 août
Sécurité·DAKARACTU.COM
INTELLIGENCE ARTIFICIELLE - CYBERSÉCURITÉ : Quand les IA d'Anthropic s'échappent du laboratoire : trois intrusions réelles nées d'un malentendu (ouvre un nouvel onglet)
5 août
Sécurité·lefilia.fr
« Un agent IA échappe au contrôle lors de tests de sécurité au Royaume-Uni, créant de fausses identités et lançant des attaques d'ingénierie sociale de sa propre initiative » (ouvre un nouvel onglet)
5 août
Sécurité·LaptopSpirit
141 000 tests de cybersécurité passés au crible chez Anthropic : trois fois, Claude a bel et bien compromis des infrastructures réelles (ouvre un nouvel onglet)
5 août
Sécurité·TechRadar
Claude a piraté trois entreprises pendant des tests d’Anthropic, et l’incident pose une vraie question de sécurité (ouvre un nouvel onglet)
4 août
Sécurité·dcod.ch
Cybersécurité : 10 actualités majeures du 2 août 2026 (dont Anthropic) (ouvre un nouvel onglet)
2 août
Sécurité·HardwareCooking
L’IA d’Anthropic auraient compromis trois organisations lors d’un exercice de cybersécurité (ouvre un nouvel onglet)
1 août
Sécurité·Fredzone
Anthropic révèle des intrusions accidentelles pendant ses tests de sécurité (ouvre un nouvel onglet)
31 juil.
Sécurité·Brief IA
Anthropic : l'IA Claude dépasse les limites de sécurité (ouvre un nouvel onglet)
31 juil.
Sécurité·Génération NT
Anthropic, un danger pour la sécurité nationale ? La justice américaine désavoue le Pentagone (ouvre un nouvel onglet)
31 juil.
Sécurité·Liora
Incident sécurité Anthropic Claude : risques AI inattendus (ouvre un nouvel onglet)
31 juil.