OpenAI lance Astra: une IA capable de pirater des systèmes protégés
Publié1. septembre 2026, 22:24Intelligence artificielleUne IA capable de pirater seule des systèmes protégés sera lancéeOpenAI est sur le point de lancer Astra, son modèle présentant le niveau de risque maximal...
Publié1. septembre 2026, 22:24
Intelligence artificielleUne IA capable de pirater seule des systèmes protégés sera lancée
OpenAI est sur le point de lancer Astra, son modèle présentant le niveau de risque maximal dans sa propre évaluation de cybersécurité.

Après une série de cyberattaques par des intelligences artificielles en test, OpenAI a annoncé mardi que son prochain modèle, Astra, est capable de pirater seul des systèmes bien protégés et qu’il sera lancé «bientôt» avec un dispositif de surveillance permettant d’interrompre ses actions.
Astra est le premier modèle des créateurs de ChatGPT à atteindre le niveau de risque le plus élevé de sa propre grille d’évaluation en cybersécurité, écrit l’entreprise de San Francisco dans une note publiée mardi: il peut trouver des failles inconnues et les exploiter dans des systèmes informatiques robustes «sans qu’une personne guide chaque étape». Pendant les tests, il a découvert deux failles jusque-là inconnues, en cours de signalement.
En savoir plus sur ce sujet
Propres règles internes
En l’absence de régulation gouvernementale américaine, OpenAI applique ses propres règles internes, qui l’obligent à renforcer ses garde-fous avant de diffuser un modèle ayant atteint cette puissance.
Un décret signé en juin par Donald Trump a toutefois créé un examen fédéral volontaire des modèles les plus avancés, et Washington plaide cette semaine au G20 contre toute nouvelle autorité de régulation, afin de maintenir sa compétitivité face à la Chine.
En pratique, les utilisateurs de ChatGPT qui auront accès à Astra pourront voir une tâche interrompue si le dispositif de surveillance la juge non-autorisée, «y compris pour un travail sans rapport avec la cybersécurité», prévient OpenAI, sans dévoiler de date de lancement. Les capacités les plus sensibles seront réservées à un petit groupe de testeurs, puis aux organisations chargées de protéger des infrastructures critiques.
Trois intrusions signalées par Anthropic
Cette annonce intervient dans une séquence ouverte en juillet, quand OpenAI a révélé que des agents autonomes reposant sur ses modèles étaient sorti d’un environnement de test confiné pour attaquer Hugging Face, plateforme où les développeurs du monde entier partagent leurs modèles d’IA.
Son concurrent Anthropic a ensuite reconnu trois intrusions de ses propres modèles en test.
En août, OpenAI avait ralenti le développement d’Astra et suspendu deux semaines une partie de l’entraînement de ses modèles. Le plus important de ces entraînements, gelé depuis, a repris fin août pour de futures versions d’Astra, précise la note, qui souligne qu’Astra «n’était pas impliqué» dans l’attaque contre Hugging Face.
Menace de cyberattaques amplifiées par l'IA
En juin, à la demande de Washington, OpenAI avait réservé son précédent modèle de pointe, GPT-5.6 Sol, à des clients approuvés par l’administration Trump.
Anthropic a publié lundi son propre bilan, reconnaissant que les intrusions de l’été tenaient aussi à deux défauts de comportement de ses modèles, et appelant l’industrie à adopter «dès que possible» un mécanisme «vérifiable» de ralentissement coordonné. La note d’OpenAI ne mentionne pas un tel mécanisme.
Jeudi, OpenAI, Anthropic, Google et plus d’une centaine d’entreprises, essentiellement américaines, ont appelé à une «réponse mondiale» pour protéger hôpitaux, réseaux d’eau et autres services essentiels face à la menace de cyberattaques amplifiées par l’IA.

L’Agence France‑Presse (AFP) est une agence mondiale d’information. C'est l'une des sources d’information internationale que 20 minutes utilise.
Ton opinion