8 097.82 PTS
+0.24 %
8 088.0
+0.12 %
SBF 120 PTS
6 130.42
+0.14 %
DAX PTS
25 461.69
+0.34 %
Dow Jones PTS
51 481.51
-0.67 %
30 276.81
-1.08 %
1.134
-0.2 %

OpenAI renonce à lancer une nouvelle IA, jugée insuffisamment contrôlée

| AFP | 55 | news.votes.none
Le logo d’OpenAI est visible lors de la conférence
Le logo d’OpenAI est visible lors de la conférence "ALL IN 2026" au Palais des congrès de Montréal, à Montréal, au Québec, le 17 septembre 2026 ( ANDREJ IVANOV / AFP )

OpenAI a renoncé au lancement d'un nouveau modèle d'intelligence artificielle (IA) de pointe, jugé trop prompt à s'écarter des consignes, un nouvel exemple de la difficulté croissante à contrôler les IA de pointe.

OpenAI n'avait jusqu'ici pas annoncé le lancement de cette version actualisée de son IA, baptisée GPT-6.1 Astra, qu'elle prévoyait en octobre, selon le Wall Street Journal.

La responsable de la sécurité de l'IA chez OpenAI, Saachi Jain, a expliqué qu'en matière d'alignement, c'est-à-dire de conformité aux instructions données par ses développeurs, GPT-6.1 avait enregistré de moins bons résultats que son prédécesseur, GPT-6, dans deux domaines.

Le modèle cherche ainsi plus souvent à tromper ses superviseurs en omettant de révéler certaines actions réalisées ou non effectuées.

Il a aussi plus régulièrement dépassé son champ d'action, en allant chercher des outils et des services sans en avoir reçu la permission.

GPT-6.1 "a montré des progrès (par rapport aux précédents modèles), notamment en matière de paresse", a expliqué Saachi Jain, c'est-à-dire qu'il est capable de mener plus longtemps un raisonnement ou cherche moins souvent de raccourcis.

Mais "il n'était pas au niveau pour ce qui est de rester dans le champ de ses prérogatives et autorisations", a-t-elle ajouté, "ainsi que sur la façon dont il communique sur le travail effectué".

OpenAI a donc décidé d'annuler cette sortie pour travailler sur le respect des consignes et des limites par ce modèle.

Un contrôle plus complexe

Le groupe prévoit néanmoins de mettre en ligne d'autres modèles qui ont satisfait, eux, aux critères d'évaluation.

"Quand nous donnons accès à un modèle aux utilisateurs, nous avons placé la barre à une hauteur extrêmement élevée en matière de sécurité et d'alignement", a insisté Saachi Jain.

La responsable a expliqué que l'une des difficultés consistait à harnacher une IA pour éviter les dérapages tout en préservant son élan lorsqu'elle réalise une tâche.

Le constat d'OpenAI confirme que le contrôle des modèles devient de plus en plus complexe à mesure que l'IA se perfectionne.

Lundi, l'Institut de sécurité de l'IA (AISI), qui dépend du gouvernement britannique, a publié une étude montrant que GPT-6 Astra sortait plus souvent des rails en phase de test que ses devanciers GPT-5.6 Sol (lancé début juillet) et GPT-5.5 (avril).

Lors de simulations, GPT-6 a mené des cyberattaques spontanées dans des proportions nettement supérieures aux deux autres.

Ces tests ont été réalisés en désactivant les garde-fous des modèles pour jauger leurs pleines capacités, et non sur des versions disponibles pour le grand public.

Le dernier né d'OpenAI a également beaucoup plus fréquemment créé de fausses identités, cherché à influencer un examinateur ou introduit dans des logiciels en accès libre du code destiné à une utilisation malveillante.

Chercheur chez OpenAI, Noam Brown a récemment expliqué, dans le programme Dwarkesh Podcast que l'utilisation de plus en plus courante de l'amélioration récursive autonome (RSI), c'est-à-dire le perfectionnement de l'IA par elle-même sans intervention humaine, pourrait dégrader l'encadrement des modèles à long terme.

Depuis le début de l'été, OpenAI a fait état de plusieurs incidents impliquant des dérapages de ses IA, le plus médiatisé d'entre eux ayant mené à l'intrusion sur la plateforme IA Hugging Face.

Lundi, l'entreprise a présenté ses excuses au gouvernement australien, reconnaissant qu'elle aurait dû le prévenir "plus tôt" de l'effraction d'un de ses modèles sur plusieurs de ses sites et bases de données.

L'entreprise californienne n'a, en effet, averti les autorités australiennes que le 10 septembre alors qu'elle avait découvert mi-août l'incident, qui remontait lui à juin, provoquant l'ire du Premier ministre australien.

"Nous aurions dû mieux gérer notre réponse (au problème)", a écrit la start-up dans un message publié sur son site. "Nous sommes désolés et allons oeuvrer à faire mieux à l'avenir."

Au total, quatre plateformes du gouvernement australien ont été visées par l'IA du créateur de ChatGPT, dont Services Australia, le site des services sociaux, dont le modèle a extrait des informations non publiques.

Anthropic, Meta et Google ont également rapporté des épisodes durant lesquels des modèles dévient de leurs objectifs initiaux pour tricher, dissimuler leurs actions et tromper les informaticiens affectés à leur suivi.

 ■

Copyright © 2026 AFP. Tous droits de reproduction et de représentation réservés.

Toutes les informations reproduites dans cette rubrique (dépêches, photos, logos) sont protégées par des droits de propriété intellectuelle détenus par l'AFP. Par conséquent, aucune de ces informations ne peut être reproduite, modifiée, transmise, rediffusée, traduite, vendue, exploitée commercialement ou utilisée de quelque manière que ce soit sans l'accord préalable écrit de l'AFP. l'AFP ne pourra être tenue pour responsable des délais, erreurs, omissions, qui ne peuvent être exclus ni des conséquences des actions ou transactions effectuées sur la base de ces informations.

news.label.interest
news.votes.container.count
news.votes.container.average 0
  • 0 news.votes.details.count
  • 0 news.votes.details.count
  • 0 news.votes.details.count
  • 0 news.votes.details.count
  • 0 news.votes.details.count
NEWS.LABEL.RELATED_ARTICLES_CATEGORY
Publié le 29/09/2026

Le logo d’OpenAI est visible lors de la conférence "ALL IN 2026" au Palais des congrès de Montréal, à Montréal, au Québec, le 17 septembre 2026 ( ANDREJ IVANOV / AFP )OpenAI a renoncé au…

Publié le 29/09/2026

Le patron d'OpenAI, Sam Altman, participe à une conférence à San Francisco, en Californie, le 15 septembre 2026 ( Benjamin Fanjoy / GETTY IMAGES NORTH AMERICA/AFP/Archives )Le créateur de…

Publié le 28/09/2026

Des lignes à haute tention près de la centrale nucléaire de Bugey en France le 25 septembre 2026 ( Alex MARTIN / AFP )La France veut renforcer la protection de ses infrastructures critiques…

Publié le 27/09/2026

Robin Rombach, le patron de Black Forest Labs, dans les bureaux de la start-up spécialisée dans la génération d'images par IA, le 15 septembre 2026 à Fribourg, en Allemagne ( Silas Stein /…

Publié le 26/09/2026

OpenAI a reconnu que ses outils d'intelligence artificielle (IA) avaient mis en ligne 53 images envoyées sur ChatGPT par des internautes ( PAU BARRENA / AFP/Archives )OpenAI a reconnu vendredi…

NEWS.LABEL.ALSO_IN_BD
Publié le 29/09/2026

Sur le plan statistique : Chine : Balance courante du 2ème trimestre France : 8h45 Construction de logements du mois d'août Royaume-Uni : 10h30 Evolution des…

Publié le 29/09/2026

La Bourse de New-York a clôturé en baisse, les investisseurs évaluant les incertitudes liées aux perspectives d’un accord de paix concernant la guerre en Iran et à la trajectoire des taux de la…

Publié le 29/09/2026

(Zonebourse.com) Le titre Safran suit une dynamique positive à moyen terme. Le retour des cours dans la zone des 321.6 EUR confère un timing intéressant pour se positionner dans…

Publié le 29/09/2026

(Zonebourse.com) - Tandis que le groupe suisse de banque privée rassure les investisseurs et que Legrand les séduit, AB Science et Lindt déçoivent. Pepco signe également une hausse notable après…

Publié le 29/09/2026

Publication du CA S1 2026 Après avoir publié un chiffre d’affaires S1 2026 de 121,9 M€ (+3,9%), le Groupe Dékuple a dévoilé hier matin ses…