15 août - Les modèles IA échouent à faire de la vraie recherche…
Au sommaire
- Les modèles IA échouent à faire de la vraie recherche scientifique - The Decoder
- OpenAI enregistre les clics et frappes clavier pour alimenter ChatGPT - The Decoder
- Les hyperscalers pourraient regretter leur pari sur le gaz naturel - AI News & Artificial Intelligence | TechCrunch
- Filigrane dans les textes IA : Anthropic lance une API de détection, Google retire son filigrane visible - The Decoder, AI News & Artificial Intelligence | TechCrunch
- OpenAI lance un mode Ultra-rapide à 750 jetons par seconde - The Decoder
- Claude Code maintient quotidiennement les logiciels d'Anthropic - The Decoder
- Kog, startup française, accélère l'inférence sur GPU classiques - AI News & Artificial Intelligence | TechCrunch
Le bulletin
Bonjour, nous sommes le samedi 15 août 2026.
Une étude de Princeton et de l'Institut britannique de sécurité de l'IA remet en cause les affirmations d'Anthropic et d'OpenAI sur la capacité des modèles à conduire une recherche scientifique autonome. Les chercheurs ont confié à un agent Claude Opus, doté de six jours et de 3 000 dollars de crédits, la résolution de questions issues de soumissions non publiées à une grande conférence d'apprentissage automatique. Les auteurs originaux, qui avaient passé des mois sur ces mêmes problèmes, ont ensuite évalué les résultats comme des relecteurs. Les deux papiers ont été rejetés, l'un avec la mention rejet fort. Les expériences se révèlent peu motivées, les textes peu lisibles, et l'agent se montre incapable de juger si ses résultats atteignent le niveau requis pour une publication.
Toujours du côté des grandes plateformes, OpenAI a lancé une fonctionnalité baptisée Computer History sur macOS. Elle enregistre les clics, les frappes clavier et les changements d'application via le système d'accessibilité du système d'exploitation, puis convertit ces événements en résumés stockés localement. ChatGPT et Codex peuvent ensuite s'appuyer sur cet historique d'activité. La fonctionnalité n'est pas encore disponible dans l'Espace économique européen. OpenAI reconnaît elle-même un risque accru d'injection de prompt, et les fichiers de mémoire ne sont pas chiffrés.
Sur le plan énergétique, un rapport de la société Noreva prévient que les géants du numérique pourraient regretter leurs paris sur le gaz naturel pour alimenter leurs centres de données. Les prix pourraient tripler dans certaines régions américaines, à mesure que la demande des grandes plateformes entre en collision avec une croissance de l'offre plus lente et des exportations de gaz naturel liquéfié en hausse.
En bref, Anthropic a annoncé une interface de programmation pour détecter les filigranes dans les textes générés par Claude, afin de se conformer au code de conduite européen sur la transparence. Dans le même temps, Google permet désormais de retirer le filigrane visible de ses créations IA, tout en maintenant le SynthID invisible. OpenAI a lancé un mode Ultra-rapide pour son modèle phare, atteignant 750 jetons par seconde grâce à un partenariat avec Cerebras. Et Claude Code effectue depuis plusieurs semaines la maintenance quotidienne des logiciels internes d'Anthropic, avec un taux de fusion de 46 % après relecture humaine. À demain.