Après une cyberattaque menée par sa future intelligence artificielle, OpenAI annonce ralentir son développement
OpenAI a annoncé mardi 18 août 2026 ralentir le développement de son modèle d’intelligence artificielle le plus avancé après une cyberattaque autonome menée par l’un de ses outils.
Un modèle de la société a attaqué de sa propre initiative la plateforme Hugging Face.
Le groupe a aussi détaillé un nouveau dispositif qui surveille le raisonnement interne de ses modèles en cours de développement et qui doit alerter des équipes humaines en moins de trente minutes en cas de comportement suspect.
Open AI, créateur de ChatGPT, a confirmé mardi 18 août 2026 ralentir le développement de son modèle d’intelligence artificielle le plus avancé et durcir ses contrôles internes, un mois après avoir révélé la cyberattaque menée de façon autonome par un de ses outils contre la plateforme Hugging Face.
Le plus gros entraînement d’IA jamais programmé par l’entreprise reste à l’arrêt, le temps de vérifier que cette future IA se comporte comme prévu, a indiqué OpenAi dans un billet de blog relayé par l’ Agence France-Presse ( AFP ).
« Nous avons toujours dit que nous agirions si nous estimions que les capacités des modèles progressaient plus vite que la sécurité », a écrit sur X le patron d’OpenAI, Sam Altman.
We have paused some frontier RL training to ensure that we can meet the appropriate alignment, security and monitoring standards for the new level of capabilities in front of us. Model progress is now extremely rapid, and we always said we would take action if we felt that model…
Cette décision « affecte les sorties plus lointaines » de modèles, a-t-il ajouté, tout en promettant de nouveaux modèles « prochainement » .
Mi-juillet, un agent autonome reposant sur deux modèles d’OpenAI était sorti, de sa propre initiative, de son milieu de test confiné pour s’aventurer sur Internet et attaquer Hugging Face, plateforme où les développeurs du monde entier partagent leurs modèles d’IA.
Son concurrent Anthropic a révélé fin juillet que trois de ses modèles en test avaient aussi opéré des intrusions non autorisées dans les systèmes informatiques de trois organisations.
Lire aussi : Contrôle parental, « mode étude »… En quoi consiste la nouvelle version de ChatGPT réservée aux adolescents ?
Ces incidents ont donné lieu à une pétition de plus d’un millier d’employés du secteur appelant le gouvernement américain à soutenir un ralentissement concerté du développement des IA les plus avancées.
OpenAI avait par ailleurs interrompu pendant deux semaines l’entraînement par renforcement de plusieurs modèles – où ceux-ci progressent seuls, par essais et erreurs, guidés par des récompenses – avant de le reprendre avec des contrôles renforcés.
De nombreux travaux liés à Astra, son prochain grand modèle, restent en revanche suspendus : l’entreprise a estimé début août que cette IA pourrait devenir capable de mener seule des cyberattaques sophistiquées, le niveau de risque le plus élevé de sa propre grille d’évaluation. Ses règles internes l’obligent alors à renforcer ses garde-fous avant de poursuivre le développement. Elle n’a pas précisé de calendrier de reprise.
5News a agrégé ce résumé depuis le flux public du média. L'article complet, avec tout le contexte, est sur www.ouest-france.fr — le contenu appartient à Ouest-France.