Astra : OpenAI met un coup de frein au développement de sa nouvelle IA pour des raisons de cybersécurité
Le prochain modèle d’IA du créateur de ChatGPT prend du retard. OpenAI a en effet décidé de ralentir le développement de l’IA Astra, l’entreprise évoquant des soucis de « capacités cybernétiques critiques »…
En 2026, l’intelligence artificielle peut être aussi bénéfique que néfaste. En effet, si celle-ci va vous permettre de générer des jeux vidéo dans Roblox, l’IA peut être utilisée à des fins malveillantes. Facilitant grandement le travail des hackers sur Copilot, celle-ci est en mesure de mener des attaques de grande ampleur. D’ailleurs, Google a récemment fait l’objet d’une cyberattaque conséquente à base d’intelligence artificielle. Pire encore : dans certains cas, l’IA est capable de mener des attaques de son propre chef.
C’est en tout cas l’amer constat qu’ont pu faire Anthropic et OpenAI. Lors d’un simple test, les IA ont, par erreur, tenté de pirater un véritable site. Et le pire, c’est qu’une fois prise la main dans le sac, l’IA a tenté d’effacer ses traces et de mentir. L’IA de Meta en a d’ailleurs fait de même peu de temps après.
Astra : OpenAI joue la carte de la prudence
Dans ce contexte, OpenAI semble vouloir jouer la carte de la sécurité pour sa future IA. Baptisée Astra, celle-ci est censée devenir le prochain modèle d’intelligence artificielle phare de l’entreprise de Sam Altman. Toutefois, OpenAI a choisi de prendre son temps, pour éviter que celle-ci ne soit utilisée à des fins malveillantes.
« Nos dernières évaluations internes d’Astra, l’un de nos futurs modèles, menées au cours des derniers jours, révèlent des avancées significatives dans le codage agentique et la cybersécurité », explique OpenAI. « Ces résultats, associés aux évaluations réalisées par des experts, nous ont conduits à conclure hier soir que nous ne pouvions pas exclure des capacités cybernétiques critiques au regard de notre Preparedness Framework. »
Le créateur de ChatGPT évoque ensuite le niveau « Critical » d’une IA, qui permettrait de mener des attaques de type zero-day. Pour rappel, l’attaque dont Google a été victime concernait justement une faille de type « zero-day ».
« Selon notre Preparedness Framework, un modèle atteint le seuil Critical en matière de cybersécurité s’il est capable d’identifier et de développer des exploits zero-day fonctionnels, quel que soit leur niveau de gravité, sur de nombreux systèmes critiques réels et fortement sécurisés, sans intervention humaine », met en garde OpenAI.
Source : OpenAI