Le vidéaste Monsieur Phi — le philosophe Thibaut Giraud — consacre une vidéo à « Claude Mythos », le modèle de pointe d'Anthropic dont les capacités offensives en cybersécurité ont défrayé la chronique au printemps 2026. Son message tient dans le titre : ces annonces sont à prendre au sérieux.
Note de la rédaction. La transcription automatique de cette vidéo n'a pas pu être récupérée (YouTube a bloqué l'accès depuis notre infrastructure). Faute de sous-titres, nous ne pouvons pas restituer ici le détail des arguments de la vidéo ni ses meilleurs moments horodatés : le mieux est de la regarder directement dans le lecteur ci-dessus. Le résumé exécutif habituel sera ajouté si la transcription redevient accessible. Les éléments ci-dessous rappellent le contexte public du sujet, et non le propos précis de la vidéo.
De quoi il est question
Le sujet de la vidéo — « Claude Mythos » — renvoie à une série d'annonces d'Anthropic sur les capacités de ses modèles en cybersécurité. Le 7 avril 2026, l'entreprise a révélé que Claude Mythos Preview, un modèle de frontière polyvalent qu'elle a choisi de ne pas commercialiser en raison de ses capacités offensives, avait découvert de façon autonome des milliers de vulnérabilités zero-day touchant tous les principaux systèmes d'exploitation et navigateurs web — certaines très anciennes, comme une faille de 27 ans dans OpenBSD ou de 16 ans dans FFmpeg.
En réponse, Anthropic a lancé Project Glasswing, une initiative défensive dotée de 100 millions de dollars en crédits d'usage, réunissant douze partenaires fondateurs (Amazon Web Services, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, Linux Foundation, Microsoft, NVIDIA, Palo Alto Networks, aux côtés d'Anthropic) pour corriger ces failles avant qu'un acteur hostile ne dispose de capacités comparables. Fin mai 2026, la coalition disait avoir identifié plus de 10 000 vulnérabilités de sévérité élevée ou critique.
C'est ce basculement — des IA devenues assez autonomes pour trouver et exploiter seules des failles logicielles — que la vidéo invite à regarder en face.
Pour aller plus loin
- La vidéo précédente du même auteur, L'autonomie des IA expliquée aux humains — Monsieur Phi, pose le cadre : l'autonomie des modèles croît de façon exponentielle, et elle se refermait justement sur la première annonce d'Anthropic à propos d'une cyberattaque menée par des agents-IA.
- Côté produits, Anthropic a depuis ouvert une partie de cette « classe Mythos » au grand public : Claude Fable 5 : Anthropic ouvre sa classe Mythos au grand public.
- Le revers du sujet, côté défenseurs : Trop de garde-fous : les chercheurs en cybersécurité s'agacent de Claude Fable.
Sources
- Anthropic, Project Glasswing — annonce officielle (7 avril 2026).
- Help Net Security, Anthropic: Claude Mythos identified 10,000+ software flaws (26 mai 2026).