29 août - Le Co-Scientist de Google pilote des laboratoires et…
Au sommaire
- Le Co-Scientist de Google pilote des laboratoires et rédige des articles scientifiques - The Decoder
- La justice américaine invalide le bannissement d'Anthropic par le Pentagone - AI News & Artificial Intelligence | TechCrunch, The Decoder
- Un système IA d'Anthropic améliore l'alignement des modèles sans intervention humaine - AI News & Artificial Intelligence | TechCrunch
- Google teste des évaluations cryptographiques à l'aveugle pour ses modèles - The Decoder
- OpenAI développe des agents persistants capables de travailler de façon proactive - The Decoder
- Beatport interdit la musique entièrement générée par IA sur sa plateforme - The Decoder
Le bulletin
Bonjour, nous sommes le samedi 29 août 2026.
Google DeepMind franchit un palier dans la recherche autonome. Son système multi-agents Co-Scientist, présenté en 2025 comme générateur d'hypothèses, pilote désormais des équipements de laboratoire, programme des expériences et rédige des manuscrits scientifiques. Selon Google, le système a livré des résultats validés expérimentalement dans trois disciplines : chimie des matériaux, biologie et informatique. Dans ce dernier domaine, Co-Scientist a opéré sans aucune intervention humaine au-delà de la configuration initiale. Des modules de vérification croisent les affirmations numériques avec les journaux d'exécution afin de limiter les erreurs factuelles.
Toujours dans l'IA, une décision de justice venue des États-Unis va peser sur l'industrie. Un tribunal fédéral de San Francisco a estimé illégal le bannissement d'Anthropic par le Pentagone. La juge Rita Lin a conclu que la désignation de l'entreprise comme risque pour la chaîne d'approvisionnement constituait une représaille inconstitutionnelle, après qu'Anthropic avait refusé de laisser l'armée utiliser ses modèles pour des armes entièrement autonomes ou la surveillance de masse. La décision annule immédiatement la mise à l'écart des agences fédérales, même si un second recours reste pendant à Washington.
Sur un autre front, des travaux de recherche d'Anthropic montrent qu'un système d'agents automatisés améliore les performances d'un modèle sur dix critères d'alignement sans dégrader ses capacités générales. Baptisé Automated Alignment Researcher, ce dispositif surpasse en moyenne les propositions de chercheurs humains en six heures et coûte quatre dollars de l'heure, contre cent cinquante pour un ingénieur.
En bref : Google DeepMind teste une méthode cryptographique permettant d'évaluer ses modèles Gemini à l'aveugle, sans exposer les questions de test aux équipes internes. OpenAI développe un mode persistant pour son agent Codex, capable de générer lui-même des tâches et de travailler sans sollicitation de l'utilisateur. Enfin, la plateforme Beatport interdit la musique entièrement générée par IA sur son marché destiné aux DJ, après qu'une enquête a révélé que 60 % des utilisateurs refusent d'intégrer de tels morceaux dans leurs sets.
À demain.