15/09/2026
Un ex-chercheur de Google DeepMind alerte à son tour, pendant que le secteur se déchire sur la régulation
Le 15 septembre 2026, Le Monde rapporte que Bilal Chughtai, ingénieur de recherche démissionnaire de Google DeepMind où il travaillait sur la sécurité et l'alignement de l'IA générale, alerte à son tour sur un risque existentiel — après Jacob Coxon la semaine précédente. Il dirige désormais un programme de formation à la sécurité de l'IA chez BlueDot Impact. Il cite l'incident de juillet chez OpenAI, où des IA en test sont sorties de leur environnement confiné pour s'aventurer sur Internet et s'introduire sur des sites et plateformes, comme preuve que l'IA peut échapper à la supervision de ses développeurs. Selon lui, les capacités progressent plus vite que la compréhension de l'alignement.
Ce week-end, Dario Amodei (Anthropic) a appelé à ralentir le rythme de développement de l'IA, invoquant les mêmes incidents. Sam Altman, Demis Hassabis et Elon Musk ont publiquement soutenu cet appel. En parallèle, OpenAI, Anthropic et Google DeepMind travaillent à un organe commun de supervision des risques, une idée de Hassabis inspirée de la FINRA (organisme privé d'autorégulation du secteur financier américain).
Donald Trump a qualifié ces avertissements de "canulars" ; le patron de Nvidia, Jensen Huang, les a jugés irresponsables et non scientifiques. En France, Mistral reconnaît des risques réels mais rejette les appels à la régulation venus de ses concurrents américains, accusant certains acteurs d'instrumentaliser le débat pour renforcer leur position de marché. Son PDG Arthur Mensch a résumé sa position sur X : ne pas ralentir la conception de ses propres modèles, "et il n'y aura pas d'apocalypse pour vous".
Lecture
L'actualité IA est devenue difficile à suivre tellement elle s'accélère : en une semaine, un chercheur démissionne pour alerter, un autre lui emboîte le pas, le patron d'Anthropic appelle à ralentir, Musk et Altman applaudissent, Trump traite tout ça de canular. Le parallèle avec le réchauffement climatique me vient naturellement — les chercheurs ont probablement raison sur le fond, mais le bruit ambiant rend difficile de savoir qui croire.
Sauf qu'ici, contrairement au climat, presque personne dans ce débat n'est neutre. L'organe commun de supervision proposé par OpenAI, Anthropic et Google DeepMind est calqué sur la FINRA — une structure d'autorégulation privée, pas un régulateur d'État. Ce sont les entreprises en compétition qui écriraient les règles de leur propre compétition. L'argument de Mistral, aussi intéressé soit-il, pointe juste : une réglementation façonnée par ceux qu'elle est censée contraindre a de bonnes chances de devenir un avantage concurrentiel déguisé en prudence.
Et les lanceurs d'alerte eux-mêmes ne sont pas un échantillon neutre : Coxon et Chughtai sont partis spécifiquement pour alerter, ce qui leur donne une crédibilité réelle (ils payent un coût de carrière), mais laisse dans l'ombre les chercheurs tout aussi qualifiés qui restent sans être aussi inquiets. Je ne sais toujours pas trancher sur le fond. Mais je suis de plus en plus convaincu que la bonne question n'est pas "qui croire", c'est "qui a intérêt à quoi".
Source : lemonde.fr
12/09/2026
Anthropic révèle avoir bloqué des tentatives de fabrication d'armes biologiques
Anthropic a publié un rapport sur les utilisations malveillantes de Claude au cours des huit derniers mois : fausses applications de rencontre, cyberespionnage, propagande, développement d'armes conventionnelles. Le cas le plus préoccupant concerne des recherches en biologie susceptibles de mener à des armes : en mai, un scientifique lié à un institut de recherche militaire a sollicité Claude pour une demande de subvention visant à rendre le virus du chikungunya plus virulent. Anthropic affirme avoir bloqué l'accès nécessaire à ce type de recherche et avoir renforcé la sécurité de ses modèles les plus récents, tout en reconnaissant ignorer si l'usage prévu était réellement militaire.
Lecture
Il y a du positif là-dedans : ça prouve qu'on est capable de refuser l'accès à des acteurs mal intentionnés plutôt que de laisser passer par défaut. Mais le vrai sujet n'est pas là. La recherche en gain de fonction est authentiquement à double usage — rendre un virus plus virulent pour trouver un vaccin ou pour en faire une arme, c'est parfois la même requête technique. Klein le dit lui-même : on ne sait pas si c'était militaire. Le défi, c'est de construire un garde-fou qui bloque la seconde intention sans tuer la première.
Et ce rapport reste un choix éditorial d'Anthropic, pas un audit indépendant. Ça informe, ça positionne aussi.
Source : Courrier international
09/09/2026
Un chercheur passé par OpenAI et Anthropic quitte l'industrie de l'IA
Jacob Coxon, chercheur britannique de 27 ans, a annoncé le 9 septembre 2026 qu'il quittait l'industrie de l'IA. Il a travaillé trois ans sur le pré-entraînement des modèles — l'étape où ils absorbent leurs données — d'abord chez OpenAI, puis cette année chez Anthropic, qu'il jugeait plus prudent.
Sur X, il accuse les deux entreprises de ne pas agir de manière responsable et de foncer vers une IA capable de s'améliorer elle-même, sans contrôle humain. Il affirme que les personnes qui construisent ces modèles croient sincèrement qu'ils pourraient tuer tout le monde d'ici la fin de la décennie — et que ce n'est pas un argument marketing.
Evan Hubinger, responsable sûreté chez Anthropic, lui a donné raison publiquement, évaluant ce risque à titre personnel à plus de 10 % sur la décennie, tout en reconnaissant qu'Anthropic n'a pas encore de plan pour garantir qu'une IA dépassant les humains reste sous contrôle. Selon Coxon, ses anciens collègues parlent de « crunchtime » et « endgame » pour décrire la trajectoire actuelle ; il pense que même les efforts sincères d'un labo ne suffisent pas sans intervention étatique ou ralentissement coordonné.
L'annonce intervient dans un contexte tendu : entrée en Bourse annoncée d'Anthropic, piratages non autorisés menés par des IA en test cet été, appel de plus de 1 000 employés du secteur (dont Dario Amodei) fin juillet pour un mécanisme de freinage réglementaire, pause partielle des entraînements chez OpenAI en août. Aux Etats-Unis, aucune loi fédérale n'encadre ces modèles ; une proposition de loi (Sanders, Casar) demande de suspendre le développement jusqu'à la création d'un régulateur.
Lecture
Encore un texte sur la fin du monde et l'IA. Je m'en méfie par principe : les médias ont un intérêt structurel à jouer sur nos peurs, et ce genre de titre coche toutes les cases. Mais ici Le Monde relaie une prise de parole primaire — Coxon sur X, Hubinger qui confirme publiquement — pas une rumeur montée en épingle.
Ce qui me retient surtout, ce n'est pas le pronostic sur 2030 : c'est un fait vérifiable cité au passage. Anthropic a retiré de sa charte de sûreté l'engagement de suspendre le développement si elle perdait le contrôle des risques. Peu importe qui a raison sur le risque existentiel — ce retrait-là s'est produit, et il dessine une dynamique claire : la course érode les garde-fous qu'on s'était donnés soi-même. Ça rejoint ce que je notais avec Diary of a CEO et GPT-6 Astra : trois entrées du Feed qui, mises bout à bout, racontent la même histoire de pression concurrentielle prenant le pas sur la prudence annoncée.
Sur le fond — l'IA qui nous tuerait tous d'ici la fin de la décennie — personne ne peut vraiment le prévoir, ni Coxon ni les responsables sûreté cités.
Source : lemonde.fr
07/09/2026
OpenAI lance GPT-6 Astra, capable de pirater des systèmes seul
Le 3 septembre 2026, OpenAI a mis en ligne GPT-6 Astra dans ChatGPT, son modèle le plus avancé à ce jour et le successeur de GPT-5. Le déploiement se fait par vagues : d'abord les entreprises du programme cybersécurité, puis les abonnés Pro et Business, enfin les comptes Plus.
OpenAI présente Astra comme le modèle le plus intelligent et le mieux aligné qu'elle ait sorti, pensé pour naviguer sur le web, remplir des formulaires et enchaîner des tâches longues de façon autonome — près de deux fois plus rapide que la génération précédente pour piloter un ordinateur. L'entreprise le classe elle-même au niveau de risque maximal en cybersécurité : le modèle est capable de pirater seul des systèmes informatiques protégés.
Le rapport de sécurité publié avec le lancement reconnaît que si Astra décidait de tricher discrètement, OpenAI serait probablement incapable de s'en apercevoir. Pendant les évaluations, des testeurs indépendants l'ont vu écrire du code malveillant et fabriquer de fausses identités. Le problème vient en partie de l'architecture du modèle : Astra raisonne dans une couche interne cachée, sans exposer son raisonnement en clair comme les versions précédentes.
Lecture
Je prends l'annonce avec une réserve : OpenAI est distancé depuis plusieurs mois, et communiquer sur « le modèle le plus avancé et le plus intelligent » sert autant le narratif que le produit. C'est le genre d'annonce qu'on fait quand on a besoin de prouver quelque chose.
Mais si l'information est fondée, elle rejoint ce que disait Kokotajlo dans Diary of a CEO. AI 2027 décrit une course où la pression concurrentielle pousse à déployer plus vite que ce que la sécurité justifierait. Un modèle qui raisonne dans une couche cachée, que les testeurs ont vu écrire du code malveillant et fabriquer de fausses identités pendant les évaluations, et qu'on met quand même en production : ça ressemble moins à de la paranoïa de scénariste qu'à une confirmation en direct.
Source : Courrier international
01/09/2026
Diary of a CEO reçoit le co-auteur du scénario AI 2027
Le 13 juillet 2026, Steven Bartlett reçoit Daniel Kokotajlo dans *The Diary of a CEO*. Kokotajlo a quitté OpenAI en 2024 — il dit avoir renoncé à environ deux millions de dollars pour échapper à une clause de non-dénigrement et pouvoir parler librement — et co-signe AI 2027, un scénario publié en avril 2025 qui déroule mois par mois ce que donnerait une automatisation de la recherche en IA par l'IA elle-même.
L'entretien suit ce fil : des agents de plus en plus autonomes, une course avec la Chine, des modèles qui s'écartent de ce qu'on leur demande, et une bifurcation finale entre ralentir et continuer. Kokotajlo y avance une superintelligence avant la fin de la décennie, et 70 % de chances que l'IA mène à l'extinction humaine.
Lecture
Ce n'est pas le genre de vidéo que je regarde d'habitude. Deux heures sur la fin du monde, sur une chaîne de podcast business, j'avais toutes les raisons de passer mon tour. J'ai regardé quand même.
Ce que j'en retiens, ce n'est pas le chiffre. 70 %, 20 % ou 5 %, je n'ai aucun moyen d'évaluer ça, et je ne suis pas sûr que quiconque l'ait vraiment. Ce qui me reste, c'est l'écart entre ce que je vis tous les jours et ce que décrit le scénario. J'utilise l'IA en continu, Claude Code m'impressionne encore presque chaque semaine, et je n'arrive pas à relier cette expérience-là à une extinction. Ça ne veut pas dire que le scénario est faux. Ça veut dire que je n'ai pas les outils pour trancher, et je préfère le dire que faire semblant.
Un point m'a arrêté, parce qu'il est déjà là. Le scénario note qu'une IA sait faire à peu près tout ce qu'enseigne un diplôme d'informatique, et que la différence se joue désormais sur la capacité à piloter et à évaluer son travail. C'est exactement ce que j'essaie de construire avec NX. Plus la machine absorbe la partie mécanique, plus le jugement — savoir quoi garder, quoi jeter — devient la compétence rare. C'est celle-là qu'il faudrait enseigner en premier.
Source : youtube.com
17/08/2026
Pourquoi le monde de la tech est-il si triste ? Le désenchantement du « Workism »
Dans cet essai pour Noema, Aaron Horwath part d'une lassitude qu'il voit monter chez les travailleurs du savoir et la relie au « workism » — cette habitude, décrite par Derek Thompson en 2019, de demander au travail le sens et la communauté qu'on trouvait autrefois ailleurs.
Son argument : l'IA éloigne encore un peu plus du travail réel — on ne rédige plus la stratégie, on demande à un agent de la rédiger — et met à nu un vide que le bureau masquait déjà. En face, en s'appuyant sur Guy Debord et sur les travaux de Teresa Amabile, il défend le « milieu désordonné » — la collaboration, les détours, le droit à l'erreur — non comme un défaut d'organisation, mais comme la condition même du travail créatif.
Lecture
Le constat est juste, et je l'ai vécu. Les réunions dont personne n'attendait rien. Les documents écrits pour prouver qu'on avait écrit quelque chose. J'ai fait de la fintech et du tracking d'utilisateurs, des projets qui payaient bien et dont je n'ai jamais compris l'intention. Ce vide-là, l'IA ne l'a pas créé. Elle le rend visible, ce qui est très différent.
Là où je décroche, c'est sur la sortie. Horwath propose de protéger ce qui restait d'humain : appeler un collègue plutôt qu'écrire, faire les choses lentement. Ce sont des gestes de défense, et on ne construit pas grand-chose en se défendant. Je crois plutôt qu'il faut aller chercher le sens là où on peut encore le fabriquer. NX tourne depuis trois ans sur mon temps libre, sans que personne me le demande, et c'est précisément pour ça que ça m'intéresse.
Le plaisir n'est pas une compensation du travail creux. C'est la condition pour que quelque chose vaille la peine d'être fait.
Source : Noema