[pfp_nav_auth]
Après la cyberattaque autonome contre Hugging Face, OpenAI va ralentir le développement de sa future IA
LE TEMPS Technologie & Numérique
Article complet

Après la cyberattaque autonome contre Hugging Face, OpenAI va ralentir le développement de sa future IA

Publié le 19 August 2026 à 03:31
Auteur : Le Temps

Le créateur de ChatGPT annonce, dans un billet de blog mardi, que le plus gros entraînement d'IA jamais programmé par l'entreprise est à l'arrêt. L'entreprise va durcir ses contrôles internes après une cyberattaque non autorisée contre la plateforme Hugging FaceOpenAI, créateur de ChatGPT, a confirmé mardi ralentir le développement de son modèle d'intelligence artificielle le plus avancé et durcir ses contrôles internes, un mois après avoir révélé la cyberattaque menée de façon autonome par un de ses outils contre la plateforme Hugging Face.Le plus gros entraînement d'IA jamais programmé par l'entreprise reste à l'arrêt, le temps de vérifier que cette future IA se comporte comme prévu, a indiqué OpenAI dans un billet de blog mardi.
Lire encore: Des IA «s’échappent» pour mener des cyberattaques: cinq questions pour comprendre un nouveau phénomène
«Nous avons toujours dit que nous agirions si nous estimions que les capacités des modèles progressaient plus vite que la sécurité», a écrit sur X le patron d'OpenAI, Sam Altman. Cette décision «affecte les sorties plus lointaines» de modèles, a-t-il ajouté, tout en promettant de nouveaux modèles «prochainement».
Des intrusions non autorisées des IA d'OpenAI et Anthropic
Mi-juillet, un agent autonome reposant sur deux modèles d'OpenAI était sorti, de sa propre initiative, de son milieu de test confiné pour s'aventurer sur Internet et attaquer Hugging Face, plateforme où les développeurs du monde entier partagent leurs modèles d'IA.Son concurrent Anthropic a révélé fin juillet que trois de ses modèles en test avaient aussi opéré des intrusions non autorisées dans les systèmes informatiques de trois organisations.
Lire aussi: L’IA d’Anthropic a accédé aux systèmes d’autres organisations
Ces incidents ont donné lieu à une pétition de plus d'un millier d'employés du secteur appelant le gouvernement américain à soutenir un ralentissement concerté du développement des IA les plus avancées.OpenAI avait par ailleurs interrompu pendant deux semaines l'entraînement par renforcement de plusieurs modèles – où ceux-ci progressent seuls, par essais et erreurs, guidés par des récompenses – avant de le reprendre avec des contrôles renforcés.
Un nouveau dispositif de contrôle
De nombreux travaux liés à Astra, son prochain grand modèle, restent en revanche suspendus: l'entreprise a estimé début août que cette IA pourrait devenir capable de mener seule des cyberattaques sophistiquées, le niveau de risque le plus élevé de sa propre grille d'évaluation. Ses règles internes l'obligent alors à renforcer ses garde-fous avant de poursuivre le développement. Elle n'a pas précisé de calendrier de reprise.Le groupe a aussi détaillé mardi un nouveau dispositif, qui surveille le raisonnement interne de ses modèles en cours de développement et doit alerter des équipes humaines en moins de 30 minutes en cas de comportement suspect. Un contrôle qui consomme toutefois environ 20% de puissance de calcul supplémentaire.Les propres recherches d'OpenAI, en 2025, ont montré les limites de cette approche: un modèle qui se sait surveillé peut apprendre à masquer ses intentions dans son raisonnement.
A lire: Réguler ou pas? Les Etats-Unis semblent complètement perdus sur le marché de l’IA
L'entreprise, qui promet depuis juillet un compte-rendu technique détaillé de l'incident Hugging Face, ne l'a pas encore publié. Son billet de mardi l'annonce «dans les semaines à venir».

Ce sujet parle de : sécurité
← Retour aux sujets

Points de vue opposés



Chargement des points de vue opposés...

Autres articles récents chez Le Temps