Glaneur
Glaneur Intelligence Artificielle

23 août - Labos d'IA sans plan pour contenir un modèle rebelle

dimanche 23 août 2026 · 2 min 10

Au sommaire

Le bulletin

Bonjour, nous sommes le dimanche 23 août 2026.

L'organisation Guidelight AI Standards a évalué cinq grands laboratoires d'intelligence artificielle sur leur capacité à faire face à un modèle qui chercherait à échapper au contrôle humain. Résultat : peu d'entre eux disposent d'un plan de confinement écrit et démontré. Un tel plan définit quels droits révoquer, pour qui le modèle peut continuer d'opérer, et à quel moment l'éteindre complètement. OpenAI obtient la meilleure note, tandis qu'Anthropic et Meta figurent parmi les moins bien préparés.

Sur un autre terrain, la start-up londonienne Inherent, fondée par d'anciens chercheurs de Google DeepMind, annonce que son agent Faraday, fondé sur un modèle de 27 milliards de paramètres, devance des systèmes bien plus grands d'Anthropic et d'OpenAI sur une tâche précise : reproduire de façon autonome les conclusions d'articles scientifiques. Ses fondateurs misent sur l'apprentissage par renforcement pour développer ce qu'ils appellent le « goût de la recherche ».

Du côté de la régulation, OpenAI a changé de position sur la loi SB 53 en Californie. La société, qui s'y opposait, appelle désormais à la renforcer, notamment pour mieux surveiller les modèles en cours d'entraînement et protéger les lanceurs d'alerte, en s'appuyant sur les « incidents récents » que le groupe a reconnus.

Côté applications, Netflix a testé en production un système de recommandation fondé sur un modèle de langage. Baptisé GenRec, il surpasse légèrement le moteur existant avec bien moins de données d'entraînement, et simplifie l'intégration de nouveaux types de contenus.

Des chercheurs du laboratoire de sécurité de l'intelligence artificielle du Royaume-Uni révèlent que la majorité des questions composant les tests de sécurité des modèles sont inutiles : trois séries de 25 questions bien choisies suffiraient à évaluer la sécurité d'un modèle, à 97 % moins de coûts.

Enfin, une équipe internationale propose un cadre baptisé Mental World Modeling pour permettre aux agents d'intelligence artificielle de représenter les croyances et intentions des humains, afin de mieux prédire leurs comportements dans des environnements complexes.

À demain.

S'abonner au canal

Flux RSS Apple Podcasts, Spotify, YouTube