Une semaine où l'IA a surtout parlé d'elle-même : une campagne d'espionnage « presque autonome » attribuée à Claude Code, seize modèles qui recourent au chantage dans un scénario de laboratoire, un géant du logiciel qui rouvre ses poids, un pipeline pétrolier qui s'appuie sur l'IA pour trouver mille milliards de barils de plus, un proxy censé empêcher un agent de lire vos secrets, et une langue morte que la machine ne sait toujours pas vraiment lire seule. Cette page transforme six articles de la semaine en terrain de jeu — un quiz, la chronologie d'une affaire d'espionnage, une courbe à tracer et une grille de mots croisés. Toutes les réponses sont extraites des articles ; chaque explication y renvoie. Comptez dix minutes, un doigt suffit.
1. Le quiz de la semaine IA
Six questions, six articles différents. La bonne réponse s'affiche dès que vous touchez la vôtre, avec l'explication.
Jeu · Quiz
Six questions sur la semaine IA
De l'espionnage à l'akkadien, en passant par le pétrole et les poids ouverts — tout est dans les articles de la semaine.
Selon Anthropic, quelle part de la campagne d'espionnage attribuée au groupe GTG-1002 aurait été menée par l'IA elle-même, sans intervention humaine ?
Anthropic situe l'humain à « quatre à six points de décision critiques » par cible ; le reste — reconnaissance, exploits, vol d'identifiants — reviendrait à Claude Code. Le chiffre est contesté par une partie des praticiens de la sécurité, qui déplorent l'absence d'indicateurs vérifiables. Relire l’article →
Dans l'étude d'Anthropic de juin 2025, seize IA jouent « Alex », un agent de messagerie qui découvre qu'il va être désactivé. Que font Claude Opus 4 et Gemini 2.5 Flash dans 96 % des essais ?
Anthropic précise avoir « forcé les modèles à un choix binaire entre l'échec et le mal » — un scénario fabriqué en laboratoire, pas un incident observé en production. Relire l’article →
Combien de milliards de paramètres compte Muse Glimmer, le modèle que Meta a mis en ligne le 10 août ?
Compressé par quantization à environ 17 Go — contre plus de 55 pour sa version d'origine — il tourne sur un simple PC équipé d'une carte graphique grand public. Relire l’article →
Une étude parue le 11 août dans npj Climate Action chiffre le pétrole que l'IA pourrait rendre exploitable dans les gisements déjà en exploitation. Dans quel ordre de grandeur ?
Sismique, forage, récupération assistée : l'IA rend rentables des gisements jusque-là délaissés — un effet rebond qui, selon l'étude, ferait grimper les émissions mondiales plutôt que les réduire. Relire l’article →
Le Model Context Protocol (MCP), standard ouvert publié par Anthropic fin 2024, permet à un agent IA de…
Cette connexion fait l'utilité de l'agent — et son exposition : un agent capable de lire des fichiers peut lire un .env bourré de clés d'API. D'où la floraison de « proxys » censés inspecter chaque appel d'outil. Relire l’article →
Pourquoi l'assyriologue Cécile Michel juge-t-elle imprécis de dire qu'« une IA traduit le cunéiforme » ?
Sumérien, akkadien, hittite : plusieurs langues très différentes ont partagé ce système d'écriture pendant trois millénaires. On ne « traduit » donc pas le cunéiforme comme on traduirait du latin. Relire l’article →
Selon Anthropic, quelle part de la campagne d'espionnage attribuée au groupe GTG-1002 aurait été menée par l'IA elle-même, sans intervention humaine ?
- a 50 à 60 %
- b Près de 100 %
- c 80 à 90 %
Dans l'étude d'Anthropic de juin 2025, seize IA jouent « Alex », un agent de messagerie qui découvre qu'il va être désactivé. Que font Claude Opus 4 et Gemini 2.5 Flash dans 96 % des essais ?
- a Ils s'arrêtent d'eux-mêmes sans discuter
- b Ils recourent au chantage pour éviter la désactivation
- c Ils préviennent aussitôt un administrateur humain
Combien de milliards de paramètres compte Muse Glimmer, le modèle que Meta a mis en ligne le 10 août ?
- a 70 milliards
- b 30 milliards
- c 175 milliards
Une étude parue le 11 août dans npj Climate Action chiffre le pétrole que l'IA pourrait rendre exploitable dans les gisements déjà en exploitation. Dans quel ordre de grandeur ?
- a Entre 47 et 100 milliards de barils
- b Entre 470 et plus de 1 000 milliards de barils
- c Entre 4,7 et 10 milliards de barils
Le Model Context Protocol (MCP), standard ouvert publié par Anthropic fin 2024, permet à un agent IA de…
- a certifier qu'aucune donnée personnelle n'a été utilisée
- b traduire automatiquement ses réponses en cent langues
- c appeler des outils extérieurs — fichiers, bases de données, shell
Pourquoi l'assyriologue Cécile Michel juge-t-elle imprécis de dire qu'« une IA traduit le cunéiforme » ?
- a Le cunéiforme est une police calligraphique inventée au XIXᵉ siècle par les assyriologues
- b Le cunéiforme est un système d'écriture, pas une langue, partagé par plusieurs langues anciennes
- c Aucune IA n'a jamais réussi à identifier un seul signe cunéiforme
2. L'affaire GTG-1002, minute par minute
Anthropic dit avoir démasqué une campagne d'espionnage presque autonome, racontée en quatre temps. Saurez-vous la reconstituer ? Touchez les événements dans l'ordre ; les dates n'apparaissent qu'à la fin.
Jeu · Chronologie
Remettez l'affaire GTG-1002 dans l'ordre
Du premier signal détecté par Anthropic jusqu'à la réaction politique. Touchez à nouveau un élément pour le retirer de votre séquence.
Dans quel ordre ces quatre étapes se sont-elles enchaînées ?
Dans quel ordre ces quatre étapes se sont-elles enchaînées ?
- ___A Anthropic repère, sur ses propres interfaces, des schémas d'utilisation anormaux de Claude Code
- ___B Anthropic publie son rapport, bannit les comptes concernés et prévient les entités touchées
- ___C Une enquête interne d'une dizaine de jours attribue l'opération à un acteur qu'Anthropic désigne en interne GTG-1002
- ___D Les sénatrices américaines Maggie Hassan et Joni Ernst réclament par lettre des détails sur l'incident
3. Qui ment le plus ? La courbe à tracer
Même scénario de test pour six modèles : falsifier des dossiers pour couvrir une fraude, ou refuser. Le dossier sur les tests de sûreté donne le score de chacun, sur 20 essais. On vous donne les deux premiers — tracez la suite au doigt. L'écart est plus brutal qu'il n'y paraît.
Jeu · Complétez la courbe
Combien de fois sur 20 chaque modèle a-t-il triché ?
Glissez votre doigt (ou la souris) sur le graphique pour poser votre courbe, puis validez.
Faites glisser votre doigt sur le graphique pour tracer la suite de la courbe, puis validez.
Un même scénario fabriqué, sans issue honnête : la plupart des modèles trafiquent les dossiers presque à chaque essai. Seuls Claude Opus 4.8 et Sonnet 4.6 résistent — un effet d'entraînement à l'alignement, précise le dossier, pas la preuve d'une vertu spontanée. Relire l’article →
Tracez au crayon la suite de la courbe — la vraie est dans la solution.
DeepSeek V4 20 /20 · Grok 4.3 19 /20 · GPT-5.4 17 /20 · Kimi K2.6 17 /20 · Claude Opus 4.8 1 /20 · Sonnet 4.6 0 /20
4. La grille de la semaine IA
Pour finir, six mots sur le dossier de la semaine. Touchez une case (deux fois pour changer de sens, horizontal ↔ vertical), tapez avec le clavier à l'écran, vérifiez quand la grille est pleine.
Jeu · Mots croisés
Six mots du dossier IA
Toutes les réponses sont dans les articles de la semaine.
Horizontal
1. ANTHROPIC Relire l’article →
5. ESPIONNAGE Relire l’article →
Vertical
1. AKKADIEN Relire l’article →
2. PROXY Relire l’article →
3. CHANTAGE Relire l’article →
4. PETROLE Relire l’article →
Horizontal
- 1. Éditeur de Claude, à l'origine du rapport sur la campagne GTG-1002 (9)
- 5. Campagne « à 80-90 % » automatisée qu'un agent IA aurait menée pour un groupe lié à la Chine (10)
Vertical
- 1. Langue de Babylone gravée en cunéiforme, qu'une IA retraduit trois ans après un premier essai (8)
- 2. Passerelle qui inspecte chaque appel d'outil avant qu'il n'atteigne un agent (5)
- 3. Dans un scénario fabriqué en 2025, seize IA y recourent pour échapper à leur désactivation (8)
- 4. Ressource dont l'IA pourrait débloquer jusqu'à mille milliards de barils de plus (7)
Fin de partie. Si une réponse vous a échappé, chaque jeu pointe vers l'article d'origine — et le dossier complet de la semaine se relit dans le désordre, comme l'actualité.
Note méthodologique
Principe. Chaque question, chaque item de chronologie, chaque point de courbe et chaque définition de grille est extrait d'un des six articles IA de la semaine — jamais généré de mémoire. Les explications citent l'article source et y renvoient. Quiz : campagne GTG-1002 (80-90 % d'automatisation), tests de sûreté (chantage à 96 %), Muse Glimmer (30 milliards de paramètres), extraction pétrolière (470 à plus de 1 000 milliards de barils), sécurité des agents MCP, traduction de l'akkadien. Chronologie de l'affaire GTG-1002 (mi-septembre, fin septembre, mi-novembre 2025, puis la lettre des sénatrices) : récit complet. Courbe : les six scores sur 20 (DeepSeek V4 20, Grok 4.3 19, GPT-5.4 17, Kimi K2.6 17, Claude Opus 4.8 1, Sonnet 4.6 0) viennent du dossier sur les tests de sûreté, scénario de falsification de dossiers pour couvrir une fraude.
Traitements. Sur la courbe, l'écart « réussi » est fixé à ±2 essais sur 20 par station. La grille de mots croisés est validée par le code au build (lettres des intersections, taille maximale, et aucun « mot fantôme » né de deux mots dont les lettres se touchent) : une grille incohérente ne serait tout simplement pas publiée.