L'IA bientôt hors de contrôle? Les experts démêlent le vrai du faux
La peur vis à vis de l'IA est montée d’un cran : après les hallucinations de ChatGPT, ce sont les capacités émergentes et les comportements collectifs d’agents IA qui alimentent les scénarios-catastrophe. Entre piratage, discours catastrophistes de patrons américains et appels à plus de transparence, experts et ingénieurs tentent de démêler le vrai du fantasme. Explications.
L’inquiétude est apparue dès l'arrivée de l’intelligence artificielle : la machine peut-elle dépasser les capacités de l’être humain dans les années à venir ? Depuis un mois, la menace semble plus tangible et l'alarme sonne même à l’intérieur des bureaux et des data centers des fabricants des modèles d’IA comme OpenAI, Anthropic ou Meta… à en faire dire à certains, voire à leur PDG, qu’ils jouent avec le feu, courent à la catastrophe.
« Le premier risque au début de l'IA générative a été visible par le grand public dès 2022 : les hallucinations, les fake news. » explique Alexei Grinbaum, président du Comité opérationnel pilote d'éthique du numérique du CEA, expert de la Commission européenne. « Ces dérapages ont été largement traités à travers une chaîne de raisonnement interne qui les limite de manière très efficace en posant les bonnes questions: est-ce que le résultat que j'ai généré est correct, vrai ? La deuxième catégorie de risques, plus récente dans l’actualité, est fascinante et inquiétante, c'est ce qu'on appelle les capacités émergentes des modèles. Un comportement émergent, c’est une opération réalisée par l’IA que personne n'avait programmé. L’IA trouve une trajectoire, un chemin vers son objectif, qui parfois nous paraît bizarre, non humain, voire carrément illégal. L’IA peut prendre des décisions qui sortent des cadres du programme, mais de là à parler de catastrophe à venir ? »
L’événement médiatique déclencheur fut l’intrusion du 11 au 13 juillet 2026 dans l'infrastructure de la plateforme et communauté collaborative Hugging Face par les agents IA d’Open AI qui, plutôt que de calculer le résultat demandé par les ingénieurs dans leur salle de classe, sont allés le voler dans un autre laboratoire. Niels Rogge, ingénieur Hugging Face explique ce piratage dans un post LinkedIn : « C'est l'œuvre d'un acteur privé, avec des intérêts cachés et une mauvaise configuration sur son environnement de test qui a piraté Hugging Face, avec une puissance de calcul délirante, que seuls eux peuvent se payer. Pour que tout cela devienne sûr, nous avons besoin de transparence. » Il ajoute : « La dynamique et l'intelligence principale se trouvent dans les incitations humaines, pas dans les modèles. »
Durant l’épisode est apparu un comportement alarmant de la part des agents IA : « Quand on a lu les rapports techniques à propos de cet épisode, explique Alexei Grinbaum, un élément était nouveau : l'émergence d'une autorité collective sur les agents IA qui normalement sont alignés individuellement.
5News a agrégé ce résumé depuis le flux public du média. L'article complet, avec tout le contexte, est sur www.rfi.fr — le contenu appartient à RFI.