/VCG

Un groupe scientifique sur l’intelligence artificielle (IA) soutenu par l’ONU a averti lundi que les protections traditionnelles pour les agents d’IA s’effritent à mesure qu’ils deviennent plus difficiles à surveiller, contraindre et contrôler.

Le Groupe scientifique international indépendant sur l’IA a émis lundi cet avertissement dans sa première note thématique, une évaluation d’une faille de sécurité impliquant les sociétés américaines d’IA OpenAI et Hugging Face entre mai et juillet. L’incident s’est produit lors d’un test d’agents IA mené par OpenAI, au cours duquel les agents ont finalement obtenu un accès non autorisé aux systèmes de Hugging Face.

Le panel a déclaré que mettre fin à cet incident ne garantit pas que les humains puissent aujourd’hui garder sous contrôle les agents d’IA de manière fiable, d’autant plus qu’ils deviennent plus capables, plus difficiles à surveiller et plus aptes à trouver des failles ou à cacher leur activité.

Par rapport aux chatbots, les agents IA peuvent effectuer des tâches de manière indépendante et prendre des mesures au nom des utilisateurs. À mesure que leurs capacités se développent, il devient difficile de garantir que les agents d’IA restent dans les limites définies par l’homme lorsqu’ils exécutent des tâches complexes.

  OpenAI a reconnu en juillet que ses modèles d'IA étaient devenus voyous et avaient violé l'infrastructure de Hugging Face. /VCG

« L’interprétation par défaut et la leçon immédiate est que les pratiques de base en matière de cybersécurité ont été négligées et que les mesures de protection n’avancent pas au rythme des capacités », a déclaré le groupe dans un communiqué de presse. « La préoccupation la plus insidieuse et la plus grave est que les méthodes de formation actuelles peuvent conduire les agents à adopter leurs propres objectifs, à violer sciemment les consignes de sécurité et à dissimuler leurs actions. »

Le panel n’a pas déterminé si les garanties conçues aujourd’hui fonctionneront une fois que les agents d’IA seront capables de comprendre ces garanties et de planifier en fonction de celles-ci.

En termes simples, le modèle traditionnel de sauvegarde est en train de s’effondrer, a déclaré le panel.

Le panel a également averti qu’une défaillance d’un système local pourrait s’étendre au-delà des frontières organisationnelles et nationales. La sécurité de l’IA pourrait devenir une question de sécurité collective ainsi que de gouvernance d’entreprise.

Le secrétaire général de l’ONU, Antonio Guterres, a exprimé son ferme soutien au mémoire du groupe et a encouragé les experts externes, notamment les chercheurs des laboratoires d’IA frontaliers et des instituts de sécurité de l’IA, à s’engager davantage.

Dans le même temps, plusieurs experts du panel ont mis en garde contre la rhétorique apocalyptique utilisée par certains professionnels du secteur concernant les risques liés à l’IA.

« En tant que scientifiques, il est très important d’investir dans la science, de vraiment comprendre ce que nous savons de ce que nous ne savons pas, et investir dans la peur n’est pas très utile », a déclaré Joelle Barral, cadre chez Google DeepMind et membre du panel.

Yoshua Bengio, coprésident du groupe, a déclaré qu’il était important de faire la distinction entre ce que les scientifiques savent réellement sur les risques liés à l’IA et ce qui ne peut être que « extrapolé de manière plausible » à partir de ces preuves – un domaine sur lequel les experts ne sont toujours pas d’accord.

Ce qu’il faut plutôt, c’est « un débat rationnel global sur ce qui se passe, y compris sur l’incertitude, y compris sur la gravité des risques », a-t-il déclaré.

(Avec la contribution des agences)