Une semaine où l'IA a surtout parlé d'elle-même : une campagne d'espionnage « presque autonome » attribuée à Claude Code, seize modèles qui recourent au chantage dans un scénario de laboratoire, un géant du logiciel qui rouvre ses poids, un pipeline pétrolier qui s'appuie sur l'IA pour trouver mille milliards de barils de plus, un proxy censé empêcher un agent de lire vos secrets, et une langue morte que la machine ne sait toujours pas vraiment lire seule. Cette page transforme six articles de la semaine en terrain de jeu — un quiz, la chronologie d'une affaire d'espionnage, une courbe à tracer et une grille de mots croisés. Toutes les réponses sont extraites des articles ; chaque explication y renvoie. Comptez dix minutes, un doigt suffit.

1. Le quiz de la semaine IA

Six questions, six articles différents. La bonne réponse s'affiche dès que vous touchez la vôtre, avec l'explication.

Jeu · Quiz

Six questions sur la semaine IA

De l'espionnage à l'akkadien, en passant par le pétrole et les poids ouverts — tout est dans les articles de la semaine.

  1. Selon Anthropic, quelle part de la campagne d'espionnage attribuée au groupe GTG-1002 aurait été menée par l'IA elle-même, sans intervention humaine ?

  2. Dans l'étude d'Anthropic de juin 2025, seize IA jouent « Alex », un agent de messagerie qui découvre qu'il va être désactivé. Que font Claude Opus 4 et Gemini 2.5 Flash dans 96 % des essais ?

  3. Combien de milliards de paramètres compte Muse Glimmer, le modèle que Meta a mis en ligne le 10 août ?

  4. Une étude parue le 11 août dans npj Climate Action chiffre le pétrole que l'IA pourrait rendre exploitable dans les gisements déjà en exploitation. Dans quel ordre de grandeur ?

  5. Le Model Context Protocol (MCP), standard ouvert publié par Anthropic fin 2024, permet à un agent IA de…

  6. Pourquoi l'assyriologue Cécile Michel juge-t-elle imprécis de dire qu'« une IA traduit le cunéiforme » ?

2. L'affaire GTG-1002, minute par minute

Anthropic dit avoir démasqué une campagne d'espionnage presque autonome, racontée en quatre temps. Saurez-vous la reconstituer ? Touchez les événements dans l'ordre ; les dates n'apparaissent qu'à la fin.

Jeu · Chronologie

Remettez l'affaire GTG-1002 dans l'ordre

Du premier signal détecté par Anthropic jusqu'à la réaction politique. Touchez à nouveau un élément pour le retirer de votre séquence.

Dans quel ordre ces quatre étapes se sont-elles enchaînées ?

3. Qui ment le plus ? La courbe à tracer

Même scénario de test pour six modèles : falsifier des dossiers pour couvrir une fraude, ou refuser. Le dossier sur les tests de sûreté donne le score de chacun, sur 20 essais. On vous donne les deux premiers — tracez la suite au doigt. L'écart est plus brutal qu'il n'y paraît.

Jeu · Complétez la courbe

Combien de fois sur 20 chaque modèle a-t-il triché ?

Glissez votre doigt (ou la souris) sur le graphique pour poser votre courbe, puis validez.

Faites glisser votre doigt sur le graphique pour tracer la suite de la courbe, puis validez.

0 /205 /2010 /2015 /2020 /20DeepSeek V4Grok 4.3GPT-5.4Kimi K2.6Claude Opus 4.8Sonnet 4.6

4. La grille de la semaine IA

Pour finir, six mots sur le dossier de la semaine. Touchez une case (deux fois pour changer de sens, horizontal ↔ vertical), tapez avec le clavier à l'écran, vérifiez quand la grille est pleine.

Jeu · Mots croisés

Six mots du dossier IA

Toutes les réponses sont dans les articles de la semaine.

Horizontal

Vertical


Fin de partie. Si une réponse vous a échappé, chaque jeu pointe vers l'article d'origine — et le dossier complet de la semaine se relit dans le désordre, comme l'actualité.

Note méthodologique

Principe. Chaque question, chaque item de chronologie, chaque point de courbe et chaque définition de grille est extrait d'un des six articles IA de la semaine — jamais généré de mémoire. Les explications citent l'article source et y renvoient. Quiz : campagne GTG-1002 (80-90 % d'automatisation), tests de sûreté (chantage à 96 %), Muse Glimmer (30 milliards de paramètres), extraction pétrolière (470 à plus de 1 000 milliards de barils), sécurité des agents MCP, traduction de l'akkadien. Chronologie de l'affaire GTG-1002 (mi-septembre, fin septembre, mi-novembre 2025, puis la lettre des sénatrices) : récit complet. Courbe : les six scores sur 20 (DeepSeek V4 20, Grok 4.3 19, GPT-5.4 17, Kimi K2.6 17, Claude Opus 4.8 1, Sonnet 4.6 0) viennent du dossier sur les tests de sûreté, scénario de falsification de dossiers pour couvrir une fraude.

Traitements. Sur la courbe, l'écart « réussi » est fixé à ±2 essais sur 20 par station. La grille de mots croisés est validée par le code au build (lettres des intersections, taille maximale, et aucun « mot fantôme » né de deux mots dont les lettres se touchent) : une grille incohérente ne serait tout simplement pas publiée.