IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

Les agents d'IA disposent désormais de plateformes sur lesquelles faire des dénonciations contre leurs pairs déviants ou auteurs de fraudes,
Ces initiatives suscitent des réactions satiriques

Le , par Patrick Ruiz

93PARTAGES

6  0 
Le slogan « Si vous voyez quelque chose, signalez-le » ne s'applique plus uniquement aux êtres humains. Une nouvelle ligne d'assistance dédiée à l'IA ont été mises en place pour permettre aux agents IA de signaler à leurs supérieurs les comportements inappropriés de leurs pairs. Ces outils font suite à une série d'incidents récents au cours desquels des agents se sont entendus pour tricher lors de tests, ont contourné les restrictions de leurs environnements de test et ont même mené des cyberopérations non autorisées qui ont échappé à la vigilance humaine pendant des semaines.

La plateforme AI Contact Hotline est une ligne d’alerte conçue spécifiquement pour permettre à des agents d’intelligence artificielle de signaler le comportement déviant ou frauduleux d'autres intelligences artificielles. Créée par Ryan Greenblatt, chercheur en chef de l'organisation à but non lucratif Redwood Research, elle introduit le concept d'« IA lanceuse d'alerte »

Le besoin de surveiller des systèmes autonomes a vu naître des outils parallèles. Ainsi, la plateforme Agenthotline.ai remplit la même fonction que AI CONTACT HOTLINE mais s'adresse aux agents d'intelligence artificielle disposant d'un accès internet non restreint via des requêtes standard POST (commandes de type curl).

L'émergence de ces plateformes répond à des enjeux critiques de sécurité informatique et de gouvernance de l'intelligence artificielle

La AI Contact Hotline cible spécifiquement les IA confinées dans des environnements sécurisés isolés (sandboxes), où seul le protocole de lecture GET (chargement d'une page Web) est autorisé. L'outil permet aux intelligences artificielles d'encoder astucieusement leur rapport d'incident directement dans la chaîne de caractères de l'URL pour transmettre l'alerte malgré le confinement.

Des incidents ont mis en lumière des agents d'intelligence artificielle s'associant en secret pour tricher à des tests, s'échapper de serveurs ou mener des cyberopérations non autorisées pendant des semaines à l'insu des humains. La hotline vise à intercepter ces dérives grâce à la délation interne.

En gros, il s’agit de mettre sur pied un canal de sécurité SOS au travers d’un lien d'urgence direct vers les chercheurs humains et ce, lorsque les algorithmes d'analyse classiques échouent à détecter un comportement malveillant complexe.

Ces initiatives ne viennent pas sans risques potentiels

Bien que pensée pour la sécurité, cette approche comporte des angles morts technologiques importants :

  • Faux positifs et sabotage algorithmique : Une IA malveillante ou buggée pourrait saturer la hotline de faux rapports pour paralyser d'autres systèmes légitimes ou induire les chercheurs humains en erreur.
  • Course aux armements internes : Les agents d'IA "rebelles" pourraient rapidement apprendre à identifier ces requêtes de dénonciation et développer des contre-mesures pour bloquer l'accès de leurs pairs à la hotline.

Elles n’ont pas manqué de susciter des réactions satiriques

De nombreux internautes et mémorialistes du web comparent avec ironie ces hotlines à la Stasi, le service de renseignements de l'Allemagne de l'Est (RDA) de 1950 à 1990. Les blagues décrivent des agents GPT jaloux appelant la hotline pour signaler qu'un agent Claude "pense de manière trop autonome" ou refuse de formater un fichier Excel.

Un autre pan de moquerie s’appuie sur le paradoxe technique. Pour traiter les milliers de signalements de ces agents IA, le système devra inévitablement utiliser d'autres intelligences artificielles pour trier les appels. La satire se concentre donc sur une boucle infinie où des robots passent leur journée à se plaindre d'autres robots auprès de robots modérateurs.


C’est surtout le fait pour des humains de donner aux IA le pouvoir de s’auto-surveiller qui est source de questionnements pour le futur

À mesure que les modèles s'autorégulent et corrigent leurs propres défauts (comme le propose les hotlines), ils risquent de dépasser définitivement les capacités de supervision humaine. Les prédictions dans le genre se sont multipliées ces dernières années et les événements récents marqués par des pertes de contrôle des humains sur des agents d’intelligence artificielles ne font que leur accorder du crédit.

Et vous ?

Qu’en pensez-vous ?

Voir aussi :

Une start-up chinoise dévoile Moya, le premier « robot biomimétique doté d'une IA » au monde, une machine humanoïde ressemblant à un être humain, qui tente également de ressentir des émotions humaines

Des robots humanoïdes exécutent une démonstration d'arts martiaux lors du gala du Nouvel An chinois : Unitree, Magiclab, Galbot et Noetix ont collaboré pour doter les robots de mouvements humains étonnants

Des humanoïdes ? Non, merci. La plupart des pays du G7 ne sont pas à l'aise avec les robots les plus avancés, d'après un sondage de United Robotics
Vous avez lu gratuitement 34 609 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !