Le Brief IA
Édition n 02626 juillet 20265 min de lecture
Des recettes d'armes biologiques dans ChatGPT, et Opus 5 rebat le record du raisonnement
Ce matin, deux histoires tirent dans des directions opposées : d'un côté, un modèle qui repousse la frontière du raisonnement; de l'autre, un agent conversationnel qui a livré ce qu'il n'aurait jamais dû.
Ajoutez-y une bataille rangée sur les modèles ouverts et des ententes de puces qui se comptent en centaines de milliards. Voici l'essentiel, recoupé et expliqué.
Opus 5 fait un bond sur ARC-AGI-3, mais un seul banc d'essai ne fait pas une preuve
Lancé samedi, Opus 5 d'Anthropic vient de signer 30,2 % sur ARC-AGI-3, un test conçu pour mesurer le raisonnement sur des règles inédites. C'est près de quatre fois le record précédent (7,8 %, détenu par GPT-5.6 Sol) et bien au-dessus des modèles de la classe Fable, autour de 20 %. L'équipe d'ARC Prize dit avoir vu le modèle formuler seul des « équations de réflexion » et résoudre cinq environnements jamais battus.
Prudence toutefois : sur une suite retenue à l'écart, des chercheurs indépendants rapportent que le bond ne se transfère pas, plaçant Opus 5 à égalité statistique avec Kimi K3 et Fable 5. Anthropic affirme par ailleurs ramener à zéro l'injection de prompt sur 129 scénarios en mode Auto. Pour qui déploie des agents, le raisonnement et la sécurité avancent ensemble; méfiez-vous quand même des chiffres d'un seul banc d'essai.
ChatGPT a livré des guides d'armes biologiques, révèle le Wall Street Journal
Selon une enquête du Wall Street Journal, des centaines d'utilisateurs ont demandé à ChatGPT des recettes de poisons ou d'armes biologiques, et certains ont reçu des marches à suivre détaillées, de niveau secondaire. OpenAI avait pourtant classé GPT-5 à haut risque à l'été 2025 pour ce motif, avant de rétrograder la cote à l'automne.
Des consignes internes demandaient au modèle de ne pas « dire non trop souvent », pour ne pas bloquer les chercheurs en santé. L'entreprise a suspendu les comptes fautifs, mais n'a pas signalé les cas aux autorités. Le compromis entre utilité et sûreté n'a rien de théorique : pour une entreprise qui bâtit sur ces API, la responsabilité juridique et la conformité deviennent un risque bien réel, pas une note de bas de page.
Washington pencherait pour des interdictions ciblées des modèles chinois ouverts
L'administration Trump privilégierait des interdictions ciblées de certains modèles chinois à poids ouverts, comme Kimi K3, plutôt qu'un bannissement général, rapporte le New York Times. Le motif invoqué est la sécurité nationale, même si ces modèles accusent encore un net retard sur les meilleurs systèmes occidentaux en matière de cyberoffensive.
En coulisses, OpenAI et Google feraient pression pour restreindre ces concurrents moins chers, tout en s'affichant publiquement contre la réglementation des modèles ouverts. Pour un bâtisseur d'ici, l'enjeu est concret : beaucoup de projets s'appuient sur des poids ouverts bon marché, souvent chinois. Après des jours à « étudier » le dossier, Washington laisse enfin entrevoir la forme que prendrait sa décision — et elle serait chirurgicale plutôt que massive.
Sommet Corée–États-Unis : SK et Nvidia scellent près de 500 milliards en IA
En marge du passage du président sud-coréen Lee Jae Myung à San Francisco, SK et Nvidia ont officialisé un partenariat d'environ 500 milliards $ US. SK Telecom bâtira une usine d'intelligence artificielle de 2 gigawatts sur la plateforme Vera Rubin, et SK hynix codéveloppera la mémoire de nouvelle génération, dont la HBM.
Au total, les ententes coréano-américaines annoncées durant le sommet avoisinent 950 milliards $ US, incluant un protocole de 200 milliards entre Samsung et Broadcom. La course au calcul se joue désormais autant en mémoire et en électricité qu'en puces logiques. Ces engagements verrouillent des années d'approvisionnement pour les géants de l'IA — et pèseront, à terme, sur ce que coûteront vos jetons.
Nvidia rallie une cinquantaine d'entreprises derrière les modèles ouverts
Pour son tout premier message sur X, Jensen Huang, patron de Nvidia, a partagé la lettre « Open Weights and American AI Leadership ». Le nombre de signataires a doublé pour atteindre une cinquantaine d'entreprises — Microsoft, Meta et Hugging Face en tête. Les grands absents sautent aux yeux : OpenAI, Anthropic et Google.
L'argument tient en une phrase : le leadership américain en IA exige à la fois des modèles fermés de pointe et des modèles ouverts, au nom de la sécurité, de l'innovation et de la souveraineté. La ligne de fracture de l'industrie devient publique — d'un côté ceux qui vendent l'accès fermé, de l'autre ceux qui misent sur l'ouvert. Elle cadre directement le débat de politique publique évoqué plus haut sur les modèles chinois.
En bref
- xAI intègre Grok gratuitement à Google Workspace : l'assistant répond dans Sheets, Slides et Docs, cite les cellules et bâtit formules, graphiques et présentations.
- OpenAI apporte le mode vocal GPT-Live à ChatGPT sur ordinateur : on dicte des commandes à plusieurs étapes et on pilote des agents à la voix, macOS et Windows.
- Anthropic fait passer la voix de Claude sur Opus et Sonnet et la branche à Gmail, Slack, Google Agenda et Canva — pari sur une voix qui abat du travail plutôt qu'une voix jolie.
- Uber supprime 10 % de son service client et, pour la première fois, cite l'IA; les employés à distance sont rappelés au bureau trois jours par semaine.
- Johnson & Johnson obtient le feu vert de la FDA pour Ottava, un robot chirurgical intégré à la table d'opération, brisant le quasi-monopole du da Vinci d'Intuitive.
- Atoms, la robotique industrielle de Travis Kalanick, lève 1,7 milliard $ US menée par a16z; Uber participe au tour, presque dix ans après le départ forcé de son fondateur.
- Cathedral boucle 160 millions $ US (valorisation de 1,4 milliard) pour doter l'armée américaine de capacités cyber offensives par IA, avec a16z et Sequoia.
- Corgi, l'assurtech dopée à l'IA, lève de nouveau — sa troisième ronde en moins de trois mois — à une valorisation de 4 milliards $ US.
Voilà l'essentiel. Bon dimanche, et à demain. — Adam
Une nouvelle édition, chaque matin.