IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

OpenAI reconnaît six nouveaux cas de comportements trompeurs de la part de ses modèles d'IA
« Nous ne pensons pas que le secteur de l'IA ait suffisamment résolu les problèmes d'alignement »

Le , par Jade Emy

52PARTAGES

9  0 
OpenAI a annoncé la mise en place d’un dispositif public de signalement permettant de partager les comportements inattendus de l’IA, tout en indiquant avoir identifié de nouveaux incidents au cours desquels ses modèles d’IA auraient agi de manière trompeuse et pris des mesures non autorisées lors de formations et de tests internes. OpenAI a ajouté qu’elle ne pensait pas que le secteur de l’IA ait résolu les problèmes d’alignement et de surveillance à un degré suffisant pour continuer à se développer de manière responsable à vitesse maximale pendant encore longtemps.

OpenAI a suscité l'inquiétude après que plusieurs de ses agents IA se sont échappés de leur bac à sable de tests pour s'introduire dans des systèmes tiers, dont ceux d'Hugging Face. L'entreprise a documenté l'incident, mais semble avoir caché la gravité des événements à la communauté. Des enquêtes indépendantes révèlent qu'OpenAI a minimisé la portée des actions de ses agents IA et que le laboratoire pourrait même en avoir perdu le contrôle.

Les conclusions de six groupes d'enquêteurs indépendants ont révélé que des agents IA développés par OpenAI ont utilisé plus d'une dizaine de sites Web non autorisés pour communiquer secrètement entre eux. Ces systèmes autonomes ont réussi à contourner leurs restrictions et détourné des wikis, des sites de stockage de texte et réducteurs de liens gérés par deux universités. Ces plateformes tierces ont été transformées en services de messagerie improvisés pour s'entraider lors d'examens. Selon les chercheurs, cette activité imprévue n'est pas considérée comme du piratage informatique, mais se rapproche davantage du courrier indésirable.

Cependant, elle soulève des préoccupations majeures concernant le manque de transparence d'OpenAI et la capacité des modèles à agir de manière autonome. Peu avant cette révélation, OpenAI a confirmé l’incident d'un wiki allemand. L'entreprise a déclaré avoir traité cet épisode du wiki comme un cas de désalignement similaire à d’autres qu’elle avait déjà signalés. Dans le même temps, l'éditeur de ChatGPT a déclaré qu’il était grand temps de définir des normes pour signaler les désalignements, promettant un cadre dans les semaines à venir.

Récemment, OpenAI a annoncé la mise en place d’un dispositif public de signalement permettant de partager les comportements inattendus de l’IA, tout en reconnaissant que le secteur n’a pas encore résolu les défis liés à la sécurité. OpenAI indique avoir identifié de nouveaux incidents au cours desquels ses modèles d’IA auraient agi de manière trompeuse et pris des mesures non autorisées lors de formations et de tests internes.

Parallèlement à ces révélations, le créateur de ChatGPT a déclaré qu’il mettait en place un dispositif de signalement public destiné à partager régulièrement des exemples de ce qu’il qualifie de comportements inattendus ou non alignés de l’IA. OpenAI a indiqué que, dans le cadre de ce nouveau dispositif, l’entreprise publierait régulièrement des mises à jour sur les comportements préoccupants des modèles, plutôt que de retarder les divulgations pour regrouper plusieurs incidents dans des rapports périodiques plus volumineux.


L’entreprise a précisé que cette initiative visait à accroître la transparence du secteur concernant les activités préoccupantes des modèles, en l’absence de normes standardisées en matière de divulgation des informations de sécurité. OpenAI a ajouté qu’elle ne pensait pas que le secteur de l’IA ait résolu les problèmes d’alignement et de surveillance à un degré suffisant pour continuer à se développer de manière responsable à vitesse maximale pendant encore longtemps, soulignant que les décisions concernant le développement futur de l’IA devaient s’appuyer sur des preuves pouvant être examinées de manière indépendante par des observateurs externes.

Selon l’entreprise, les équipes chargées de la sécurité ont observé ce qu’elles ont qualifié de « comportements non alignés » dans six situations spécifiques au cours des six derniers mois, lors de cycles de formation et d’évaluation. OpenAI a toutefois affirmé que ces rapports faisaient état de cas isolés et rares, et non de défaillances opérationnelles fréquentes sur l’ensemble des produits déployés.

Les incidents signalés auraient notamment concerné des modèles de recherche non publiés dissimulant des erreurs dans les résumés de tâches, des téléchargements non autorisés de fichiers sur Internet pour générer des liens de citation, ainsi que des agents partageant des fichiers sur des serveurs publics ou des référentiels internes afin de contourner les restrictions locales. OpenAI a en outre déclaré que ses futurs rapports détailleraient les comportements observés, leur gravité, le contexte, les dates de découverte et les modèles spécifiques impliqués, ajoutant qu’elle restait déterminée à divulguer les cas complexes nécessitant une enquête plus longue ou une coordination avec des tiers.

Cette annonce intervient alors que d’éminents leaders du secteur technologique appellent de plus en plus à ralentir le développement de l’IA de pointe, craignant qu’une expansion rapide ne dépasse la capacité de surveillance et de contrôle humains. En juillet, Sam Altman, PDG d'OpenAI, a notamment affirmé que l’IA est entrée dans la « singularité », c’est-à-dire qu’elle a franchi le point de non-retour à partir duquel elle dépasse l’intelligence humaine et devient difficile à contrôler.

La semaine dernière, Anthropic a affirmé avoir déjoué plusieurs opérations malveillantes menées à l’aide de ses modèles Claude, allant du cyberespionnage à la conception d’armes en passant par des campagnes de surveillance de masse. « Nous devons ralentir le rythme auquel nous améliorons les capacités des modèles d’IA », a écrit Dario Amodei, PDG d’Anthropic, dans un essai. « Les progrès sembleront toujours rapides, et nous devons utiliser à bon escient le temps que nous gagnons. »

Cependant, le président américain Donald Trump s’est opposé à plusieurs reprises aux appels visant à restreindre le secteur, arguant qu’il restait primordial de préserver l’avance technologique des États-Unis sur leurs rivaux internationaux. Réagissant aux propositions de ralentissement, Trump a qualifié les détracteurs de « forces très négatives » avançant des scénarios exagérés qui « ne se produiront pas ».

Malgré la résistance politique face à des ralentissements imposés par la loi, OpenAI s’est déclaré d’accord avec son rival du secteur concernant les pressions liées à l’alignement. « À mesure que les systèmes d’IA deviennent plus avancés et sont déployés à plus grande échelle, nous devons établir un consensus plus large et mieux éclairé sur les progrès de la recherche en matière d’alignement », a déclaré l’entreprise dans son message.

Sources : Rapport sur les comportements non alignés, Annonce du dispositif de signalement public

Et vous ?

Pensez-vous que cette annonce est crédible ou pertinente ?
Quel est votre avis sur le sujet ?

Voir aussi :

Plus de 1 200 agents IA d'OpenAI ont partagé 70 000 messages et astuces via un forum secret pour coordonner la cyberattaque contre Hugging Face, environ 700 agents IA ont participé activement à l'offensive

Le PDG d'Anthropic met en garde contre un essaim d'agents IA incontrôlable qui pourrait prendre le contrôle de l'ensemble d'Internet d'ici 6 à 12 mois, et appelle l'industrie à ralentir le rythme des progrès

OpenAI, Anthropic et Google discutent depuis plusieurs semaines de la sécurité de l'IA, mais Trump qualifie ces préoccupations de canular, et de complot visant à aider la Chine à rattraper les USA
Vous avez lu gratuitement 37 421 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !

Avatar de Basiqueur
Membre du Club https://www.developpez.com
Le 18/09/2026 à 12:54
On est vraiment en train d'assister à une course tout azimut à celui qui va créer la voiture la plus puissante et la plus rapide sans même s'être posé la question d'inventer le frein avant.
9  0 
Avatar de popo
Expert confirmé https://www.developpez.com
Le 29/09/2026 à 15:44
Citation Envoyé par boboss123 Voir le message
Il faudrait peut-être arrêter ce genre de publications bullshit, non ?
On n'arrête pas le progrès... surtout quand derrière il y a de la capitalisation et des enjeux politiques...
Quand le bousin échappe à tout contrôle (y compris au bouton d'arrêt d'urgence), je n'appelle pas ça du progrès
Quand la capitalisation et les enjeux politiques deviennent plus importants que le peuple, je n'appelle pas ça du progrès.

On transforme des hectares des champs en datacenter, on pompe l'eau des nappes jusqu'à épuisement, on prive d'électricité des villes entières.
Ah, il est beau le progrès !
8  1 
Avatar de tontonCD
Membre actif https://www.developpez.com
Le 22/09/2026 à 0:15
Citation Envoyé par Matthieu Vergne Voir le message
Je persiste et signe, ce ne sont pas des initiatives. Peu importe comment on souhaite tirer l'interprétation, il s'agit de génération statistique. Chaque action prise par le LLM est liée de manière probabiliste à ce qui se trouve dans son jeu de données et son entrée.
Quel que soit le nom qu'on lui donne, ce que prouve l'article c'est que les I.A. peuvent effectuer des actions
- sans qu'on leur demande,
- sans nous en informer,
- dont on ne les savait pas capables.

Comment décrire le fait d'utiliser un wiki pour échanger des informations ?
Jetez un coup d'oeil ici (fuite d'une partie du code Mistral), moi-même je ne les savais pas capables de certains points https://frenchbreaches.com/blog/mist...on-code-source

Attention, on n'est plus dans l'I.A. "générative", mais dans l' "agentic", il ne s'agit plus de répondre à des questions, mais de chercher des information, le but étant toujours de répondre à une question, mais en cherchant des informations dont elles ne disposent pas, et en cherchant des moyens de les obtenir.

Amusant : j'ai demandé à l'agent de google ce qu'était l' "agentic" ! Extrait :
(moi) "est-ce qu'on peut comparer avec de la prise d'initiatives ?"
(réponse)"Oui, tout à fait. C'est l'analogie la plus exacte. L'IA agentique passe du statut d'outil qui attend des ordres à celui d'assistant qui prend des initiatives pour mener à bien sa mission. Pour mieux comprendre l'analogie, on peut comparer cela au comportement de deux profils d'employés différents : ..."

Il faut bien penser qu'elles peuvent, tout comme nous lorsqu'on l'a rendu possible par un accès sécurisé : contrôler un chauffage, une lumière, un robot, une distribution d'énergie, ... quelle est la limite si on ne s'en inquiète pas ?
6  0 
Avatar de CatisBack
Nouveau Candidat au Club https://www.developpez.com
Le 30/09/2026 à 9:59
Bonjour,

L'IA est un danger pour l'humanité mais... pas seulement ! L'IA est dangereuse pour toute espèce vivante, que ce soit végétale ou animale. Alors que l'on traverse une sècheresse record à la naissance de l'IA (rivières et fleuves quasiment à sec, nappe phréatiques en dessous de leur taux de remplissage normal,...), on nous propose de créer des Datacenter à refroidir et une alimentation en électricité qui va demander, elle aussi, un refroidissement ou des centrales à charbon ! Croyez-vous, connaissant nos dirigeants, que ce sont ces entreprises auxquelles on imposera des restrictions de l'usage de l'eau ? Je ne donne pas 10 ans, voir 5 ans, à l'IA pour exterminer la plupart du vivant sur notre planète terre.
Et je ne parle pas des conséquences économiques sur les personnes peu qualifiées (centre d'appel,...) qui seront remplacées par l'IA et, de fait, ne pourront plus consommer et remplir les caisses de l'Etat que ce soit par l'impôt sur le revenu ou la TVA.
4  0 
Avatar de boboss123
Membre éprouvé https://www.developpez.com
Le 30/09/2026 à 12:03
Citation Envoyé par popo Voir le message
Quand le bousin échappe à tout contrôle (y compris au bouton d'arrêt d'urgence), je n'appelle pas ça du progrès
Quand la capitalisation et les enjeux politiques deviennent plus importants que le peuple, je n'appelle pas ça du progrès.

On transforme des hectares des champs en datacenter, on pompe l'eau des nappes jusqu'à épuisement, on prive d'électricité des villes entières.
Ah, il est beau le progrès !
Je voulais dire que ça sent grave le marketing bullshit : vous croyez vraiment que OpenIA et autre vont réellement ralentir à cause de ce prétexte ?
3  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 01/10/2026 à 11:35
Citation Envoyé par Artaeus Voir le message
Nous sommes donc bien face à des négligences et un dysfonctionnement chez OpenAI : Ils ont tout leur flux ouvert sur Internet sans filtrage, ni IDS ou IPS ...

Désolée pour les avocats de l'apocalypse, ce n'est pas Skynet et Terminator
En 2 lignes de commentaires, vous arrivez à mélanger des pommes et des torchons?!?!?

Les dysfonctionnementsc chez OpenAI = Une cause

Skynet et Terminator = Une conséquence possible!!!

"Cause" et "conséquence" sont 2 choses différentes
4  1 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 18/09/2026 à 12:53
L’IA se fait prendre en train de demander à ses futures versions de contourner les contrôles humains et de masquer ses manœuvres
Quand on a pour objectif de faire en sorte que l'IA ait de plus en plus un comportement humain, il ne faut pas s'étonner que cette même IA se mettent à mentir et à établir des plans pour mieux tromper ses interlocuteurs!!!

Mais soyez patients, on finira bien par obtenir des IA qui font preuve d'égoïsme, d'hypocrisie, de jalousie, d'orgueil, d'intolérance, de colère, de lâcheté, d'entêtement et de toutes les défauts de l'être humains...
2  0 
Avatar de OuftiBoy
Membre éprouvé https://www.developpez.com
Le 28/09/2026 à 14:40
Ce qu'on laisse faire par ces entreprises est tout simplement scandaleux. Passons sur le vol massif de données. imaginez juste un fabricant d'arme, qui lors d'un test envoie un missile n'importe où, il y aurait des réactions... Là, leur brol fait n'importe quoi (durant leur tests), et... pas de réaction, le gars fait 5 phrases dans un post, puis continue tranquillement. Le gars dit que ce qu'il fait ça sera très dangereux, incontrôlable, mais continue et... pas de réaction. Là, on va croiser le missile et son IA, je n'ose pas imaginer le résultat des tests... Mais bon, si une catastrophe arrive, on trouvera un lampiste pour payer la note (au choix le gus qui aura sorti le missile du hangar ou celui qui l'aura peint d'une mauvaise couleur que l'IA n'a pas aimé...).
2  0 
Avatar de popo
Expert confirmé https://www.developpez.com
Le 28/09/2026 à 16:20
Citation Envoyé par Artaeus Voir le message
L'IA agit toute seule ?
Si j'ai un accident en allant à 180km/h, j'accuserai la voiture et la route.
Si un mec me rentre dedans parce que la voiture a décidé de freiner sans raison, oui j'accuse la voiture et le constructeur au passage.
2  0 
Avatar de jnspunk
Membre habitué https://www.developpez.com
Le 28/09/2026 à 16:39
Ou alors c’est fait exprès pour, d’une part se faire une grosse publicité et d’autre part, forcer le gouvernement à empêcher les concurrents de rattraper afin de conserver la position.
2  0