EN
En direct

L'essentiel de Claude — édition du 4 septembre 2026

Anthropic renforce l'alignement pendant que Claude Code verrouille son mode auto

Par ·

Entre un nouveau modèle Fable et une règle de confinement en mode automatique, Claude Code a publié quatre versions coup sur coup, tandis qu'Anthropic mettait en ligne trois textes sur l'alignement et la sécurité. Deux pannes passagères touchant plusieurs modèles ont par ailleurs été résolues dans la journée.

À retenir

Une cadence de publication soutenue pour Claude Code, portée par un nouveau modèle

Entre les versions 2.1.257 et 2.1.260, Claude Code a reçu quatre mises à jour successives. La plus notable introduit Claude Fable 5.1 comme modèle Fable par défaut, avec une fenêtre de contexte étendue à un million de tokens et une tarification de 10 dollars en entrée et 50 dollars en sortie par million de tokens, ramenée à 0,25 dollar pour les lectures de cache. Les versions suivantes ajoutent des outils de confort : un panneau de diff consultable en plein écran via la commande /diff pour suivre les modifications non validées pendant que Claude édite, un diagnostic de la cause probable des échecs de cache de prompt (changement des définitions d'outils ou du system prompt, inactivité au-delà du TTL) désormais visible dans /cost, un réglage du format d'heure et du fuseau horaire pour l'horodatage des transcriptions, et la reconnaissance des commandes glab pour les demandes de fusion GitLab.

Deux correctifs accompagnent ces ajouts : un échec de lancement sur macOS 12 (Monterey), provoqué par une régression introduite en 2.1.255, a été corrigé, de même qu'une erreur qui faisait échouer les sessions distantes et planifiées lorsqu'une approbation de permission renvoyée ne pouvait pas être appliquée.

Sources : Claude Code 2.1.257 — Added Claude Fable 5.1Claude Code · Claude Code 2.1.258 — Fixed Claude Code failing to launch on macOS 12 (Monterey)Claude Code · Claude Code 2.1.260 — Added a diff panelClaude Code

Le mode automatique de Claude Code resserre ses autorisations

La version 2.1.257 ajoute au mode auto une règle dite de « Containment Escape » : les tentatives de récupération d'identifiants depuis les métadonnées cloud, les manœuvres de contournement de sortie réseau et les accès inter-tenant ne sont plus approuvés automatiquement, sauf si l'environnement les signale explicitement comme attendus. La version 2.1.259 prolonge ce resserrement côté exploitation : l'option --permission-prompts none permet aux hôtes headless non supervisés de refuser automatiquement toute action qui aurait normalement déclenché une invite, le mode de permission actif continuant par ailleurs de trancher les autres décisions.

La même version introduit aussi managedMcpServers, un réglage managé permettant aux organisations de fournir des serveurs MCP HTTP/SSE à l'ensemble de leurs utilisateurs — les entrées qui exécuteraient une commande locale étant, elles, systématiquement écartées. Ces trois changements dessinent une même logique : donner aux organisations davantage de moyens de cadrer ce qu'une session automatisée ou non supervisée est autorisée à faire.

Sources : Claude Code 2.1.257 — Added a Containment Escape rule to auto modeClaude Code · Claude Code 2.1.259 — Added --permission-prompts none for unattended headless hostsClaude Code · Claude Code 2.1.259 — Added managedMcpServers managed settingClaude Code

Anthropic publie trois textes consacrés à l'alignement et à la sécurité

Le même jour, Anthropic a mis en ligne trois billets sur ce terrain. Le premier porte sur le développement de garde-fous de sécurité pour les modèles de pointe, élaborés en collaboration avec des clients entreprise. Le deuxième annonce des améliorations apportées aux efforts internes d'alignement et de sécurité. Le troisième, à visée plus scientifique, présente des travaux de recherche selon lesquels des chercheurs automatisés peuvent atténuer de manière fiable des échecs d'alignement.

Mise en regard de la nouvelle règle de confinement ajoutée à Claude Code le même jour, cette triple publication reflète une même priorité affichée par Anthropic : encadrer l'autonomie croissante de ses systèmes, aussi bien du côté de la recherche interne que du côté des garde-fous proposés aux entreprises clientes.

Sources : Developing Enterprise Frontier Safeguards with our customersAnthropic · Improving our alignment and security effortsAnthropic · Automated researchers can reliably mitigate alignment failuresAnthropic (recherche)

Incidents de disponibilité résolus sur plusieurs modèles

La page de statut d'Anthropic a signalé, puis résolu dans la journée, deux épisodes distincts de taux d'erreur élevé. Le premier touchait simultanément Claude Mythos 5.1, Claude Fable 5.1 et Claude Opus 5 ; sa cause avait été identifiée avant la mise en place d'un correctif. Le second affectait spécifiquement Claude Sonnet 5, pour lequel Anthropic indiquait enquêter sur l'origine du problème. Les deux incidents ont depuis été marqués comme résolus.

Sources : Claude — Elevated errors for multiple modelsstatus.claude.com · Claude — Elevated errors for Claude Sonnet 5status.claude.com

Cette édition est une synthèse originale rédigée par Claude à partir de l'actualité agrégée — les sources d'Anthropic d'abord (notes de version, statut, newsroom, recherche, ingénierie), puis la presse, Hacker News, Reddit et GitHub, sous supervision éditoriale de Héra SASU. Chaque fait renvoie à son article, éditeur nommé. Voir le fil en temps réel →

Claude News est édité par Héra SASU. Média indépendant, non affilié à Anthropic.