Le Brief IA
Édition n 02020 juillet 20265 min de lecture
Un colosse ouvert chinois, un robot qui plie le linge
Ce matin, la course aux modèles ouverts change d'échelle : après Kimi K3, Alibaba pousse un modèle de 2 400 milliards de paramètres, et la demande fait déjà craquer les serveurs de ses rivaux.
Ailleurs, un robot apprend à plier le linge chez des inconnus, DeepMind soutient que nos générateurs vidéo cachaient déjà le modèle du monde qu'on cherchait, et un organisme tente de bâtir une IA publique. Voici l'essentiel, recoupé et expliqué.
Alibaba dévoile Qwen 3.8, un modèle ouvert de 2 400 milliards de paramètres
Alibaba a présenté Qwen3.8-Max, un modèle multimodal de 2 400 milliards de paramètres que son équipe dit juste derrière Claude Fable 5. C'est le premier Qwen au-dessus du billion de paramètres à traiter image, vidéo et documents, et l'entreprise promet d'en ouvrir les poids « bientôt » — un aperçu payant tourne déjà via son Token Plan.
Deux réserves : aucun banc d'essai indépendant ne confirme le classement, et Alibaba ne dit pas combien de ces 2 400 milliards de paramètres sont actifs à l'inférence, un détail qui décide du coût réel.
Pour une entreprise d'ici, l'enjeu n'est pas le palmarès. Un modèle quasi frontière qu'on peut télécharger et faire tourner soi-même, c'est un modèle qu'aucun embargo ni compteur ne peut fermer. Reste la vraie question : pouvez-vous payer le matériel pour l'exécuter ?
Kimi K3 sature : Moonshot ferme les nouvelles inscriptions en 48 heures
Trois jours après avoir lancé Kimi K3, Moonshot a suspendu la vente de nouveaux abonnements : en 48 heures, la demande a frôlé la limite de sa capacité de calcul. Les abonnés actuels gardent l'accès; l'entreprise scinde son offre en deux forfaits pour mieux répartir les GPU et rouvrira les inscriptions par vagues.
Le modèle n'est pourtant pas un généraliste parfait — il trône en tête du classement de code frontal Code Arena, devant Fable 5, mais plafonne autour de 39 % sur les maths avancées de FrontierMath.
Le signal compte plus que l'incident. On répétait qu'un modèle ouvert allège la facture de calcul; Kimi montre l'inverse quand tout le monde s'y rue en même temps. Ouvrir un modèle ne suffit pas : il faut encore des puces pour le servir. Les poids doivent d'ailleurs sortir le 27 juillet.
DeepMind : les générateurs de vidéo cachaient déjà un modèle du monde
Google DeepMind avance une idée à contre-courant : les gros générateurs de vidéo contiennent déjà le « modèle du monde » que la vision par ordinateur cherchait depuis des années. Leur système, GenCeption, détourne un générateur vidéo pour faire de l'estimation de profondeur, de la segmentation et de la reconnaissance de pose — en une seule passe.
Le résultat égale des modèles spécialisés tout en utilisant de 7 à 500 fois moins de données, et il généralise à des images réelles et à des animaux alors qu'il a été entraîné presque uniquement sur des vidéos humaines de synthèse.
Si la thèse tient, la vision suit le chemin du langage : un seul grand modèle généraliste, adaptable à chaque tâche, plutôt qu'un outil ajusté par problème. Reste la lenteur — six à dix secondes par extrait — avant tout usage sérieux.
Un robot plie le linge à 99 % dans des maisons qu'il n'a jamais vues
Sunday Robotics a dévoilé ACT-2, le modèle qui pilote son robot domestique Memo, avec un chiffre qui attire l'œil : 99,1 % de réussite pour plier du linge dans des maisons qu'il n'avait jamais vues — 778 pliages réussis sur 785, en autonomie.
La bascule n'est pas la dextérité, c'est la généralisation. ACT-2 absorbe un nouveau geste à partir d'une seule démonstration et le reproduit dans des environnements inédits, sans réglage maison par maison. C'est exactement ce qui manquait pour sortir la robotique du laboratoire.
Prudence quand même : « aperçu », une seule tâche, et des chiffres maison. Mais pour qui bâtit dans le physique — logistique, entretien, soins —, un taux de réussite pareil hors du labo change ce qu'on peut promettre à un client.
Current AI veut bâtir une intelligence artificielle publique et ouverte
L'internet est né public; l'IA, elle, ressemble à une rangée de parcs privés où quelques entreprises fixent les règles et le prix des billets. Current AI, un organisme sans but lucratif, veut bâtir l'alternative : une infrastructure d'IA ouverte que des communautés peuvent utiliser, modifier et contrôler gratuitement.
Avec 400 millions de dollars US déjà engagés — dont 100 millions de la France —, il finance des outils hors ligne pour des communautés autochtones, des jeux de données couvrant plus de 50 langues africaines et un appareil de poche qui fonctionne dans 22 langues indiennes sans connexion.
L'ambition — un « web de l'IA » au service de tous — reste immense face aux milliards des grands labos. Mais elle pose la vraie question de fond : à qui appartient l'intelligence sur laquelle reposera bientôt tout le reste ?
En bref
- Anthropic tranche : Fable 5 reste en permanence dans Max et Team Premium, mais à 50 % des plafonds. Les forfaits Pro reçoivent 100 $ US de crédit unique, puis paient au jeton. En vigueur aujourd'hui.
- SpaceX négocie avec le Pentagone un contrat de plusieurs milliards $ US pour fournir de la capacité de calcul à la Défense américaine, selon le Wall Street Journal.
- La chef des finances d'OpenAI, Sarah Friar, propose de juger les budgets IA à « l'intelligence utile par dollar » — coût par tâche réussie et fiabilité — plutôt qu'au seul prix du jeton.
- San Francisco somme Apple et Google de retirer 13 applis de « nudification » par IA. Apple affirme en avoir déjà supprimé trois et fermer les comptes des développeurs visés.
- Zoox rappelle le logiciel de 105 robotaxis après qu'un véhicule sans passager a foncé dans une épaisse fumée sur les lieux d'un incendie, à Las Vegas.
- Databricks lève de nouveaux fonds à une valorisation de 188 milliards $ US, menée par Coatue — cinq mois seulement après un tour bouclé à 134 milliards.
- TikTok teste un outil qui laisse les créateurs vérifiés repérer les vidéos IA imitant leur visage et signaler les usages non autorisés de leur image.
- NVIDIA présente sa plateforme Vera Rubin comme taillée pour le post-entraînement des agents, promettant jusqu'à dix fois moins cher par jeton que la génération Blackwell.
Bon début de semaine — c'est l'heure de bâtir. À demain. — Adam
Une nouvelle édition, chaque matin.