Dernier briefing
19 juillet 2026 · 5 actus (site) · 5 actus (base)
Le 19 juillet 2026, l'écosystème des agents IA consolide une semaine post-WAIC Shanghai : Moonshot AI publie Kimi K3, le plus gros modèle ouvert jamais distribué, déjà compatible avec les outils de programmation agentique ; Thinking Machines (Mira Murati, John Schulman, Barret Zoph) sort Inkling sous licence Apache 2.0, premier modèle multimodal ouvert d'un labo US construit dès le départ pour piloter des agents ; OpenAI lance ChatGPT Work, un agent bureau qui consolide Operator, Deep Research et Workspace Agents en une offre unique ; Prime Intellect boucle une série A à un milliard de dollars pour sa plateforme d'entraînement agentique en entreprise ; et Anthropic répond avec Sonnet 5 et Claude Cowork désormais disponible sur le web et le mobile.
🔥 À la une
01
La Chine publie le plus gros modèle ouvert du monde — déjà compatible avec les outils de programmation agentique
Derrière chaque assistant IA, il y a un « modèle », un immense fichier de chiffres entraîné à reconnaître et produire du langage. Moonshot AI, start-up chinoise soutenue par Alibaba, vient de mettre en ligne Kimi K3 : 2 800 milliards de paramètres, une fenêtre de contexte d'un million de tokens (de quoi avaler un gros projet logiciel d'un seul coup), et une compatibilité affichée dès le départ avec les principaux outils de programmation agentique du marché — Codex, Claude Code, Cline, RooCode — via une API au format OpenAI sur api.moonshot.ai/v1. Les poids complets seront publiés le 27 juillet. Le modèle comprend aussi les images, ce qui permet d'envoyer des captures d'écran à un agent sans traitement préalable. Pour un bâtisseur d'agents, c'est un candidat solide pour une pile open-weight à coût maîtrisé (la concurrence chinoise pousse cette frontière d'un million de tokens, là où les modèles américains restent souvent en-dessous). Revers pratique : à 2 800 milliards de paramètres, la facture d'électricité n'est pas la même qu'un petit modèle de bureau. À tester sur des tâches longues réelles avant de basculer la production, mais le signal est net : la Chine distribue du capable en open-weight à un moment où les modèles fermés américains deviennent plus chers.
02
Un modèle ouvert et gratuit capable de comprendre texte, images et audio — signé par d'anciens d'OpenAI
Thinking Machines Lab — jeune start-up fondée par Mira Murati, John Schulman et Barret Zoph, tous passés par OpenAI — vient de publier Inkling sous licence Apache 2.0, une vraie licence open source sans restriction commerciale. Le modèle pèse 975 milliards de paramètres au total, mais n'en active que 41 milliards à chaque passage (architecture « mixture of experts », une famille de modèles qui n'utilise qu'une petite partie de ses neurones pour chaque question). Sa fenêtre de contexte monte à un million de tokens, et il comprend nativement le texte, les images et l'audio. Le pari est explicite : Inkling n'est pas forcément le meilleur sur tous les critères, mais il est ouvert, modifiable, et livré avec une documentation qui dit comment l'adapter à un métier précis. C'est la base qu'une entreprise peut reprendre pour construire son propre agent sur mesure, sans payer de licence au modèle sous-jacent. Revers de la médaille : la version compacte exige encore environ 600 Go de mémoire vidéo — soit l'équivalent d'une demi-douzaine de cartes graphiques haut de gamme. Concrètement, ce modèle ne tournera pas sur les serveurs classiques d'une PME ; il faudra soit passer par un fournisseur de cloud, soit tabler sur une version plus légère. La leçon est claire : l'ouverture redevient un argument de vente, mais l'hébergement reste un poste de coût à comparer.
03
OpenAI lance un agent bureau qui rassemble tout — pour pousser le curseur face à Claude et Copilot
Aujourd'hui, un employé qui prépare une présentation ou un dossier de synthèse passe une bonne partie de son temps à jongler entre sa boîte mail, son tableur, ses documents internes et son navigateur. OpenAI a annoncé le 9 juillet ChatGPT Work, un agent qui rassemble ce contexte multi-applications et produit à la demande des documents, des tableurs, des présentations, voire des sites web. Concrètement, on décrit ce qu'on veut, l'agent va chercher les bonnes données dans les outils autorisés, et livre un résultat prêt à relire. L'agent est propulsé par GPT-5.6, disponible sur le web et sur mobile pour les abonnements Pro, Enterprise et Edu. La nouveauté consolide trois produits distincts lancés ces derniers mois — Operator, Deep Research et Workspace Agents — dans une seule offre intégrée. Pour un chef de projet, l'intérêt est double : moins d'outils à apprendre, et un agent qui connaît les permissions de chaque utilisateur (le commercial ne voit que ce à quoi il a droit). Pour le marché, c'est une réponse directe à Claude Cowork d'Anthropic et aux Copilot Agents de Microsoft — la bataille des agents bureau est lancée. Pré-IPO : Bank of America a déjà consenti 520 millions de dollars de prêt à OpenAI pour soutenir l'effort.
04
130 millions de dollars pour entraîner des agents IA sur les tâches métier d'une entreprise
Prime Intellect, start-up basée à San Francisco, a annoncé le 16 juillet une série A de 130 millions de dollars, menée par Radical Ventures avec la participation de Nvidia Ventures, Intel Capital, Dell Technologies Capital et Iconiq. La valorisation atteint le milliard de dollars. La plateforme propose une pile complète : la puissance de calcul nécessaire pour entraîner un modèle, un outil d'apprentissage par renforcement (la méthode qui apprend à un agent par essais-erreurs sur des cas concrets), et des outils d'évaluation pour mesurer si l'agent fait vraiment le métier qu'on lui confie. Le pari est simple : permettre à une entreprise de devenir « son propre labo d'IA » sur ses tâches métier, sans dépendre d'un fournisseur généraliste. Des anges investisseurs de marque sont au tour — Srinivas (Perplexity), Levie (Box), Weinberg (Harvey), Wang (Cognition), Foody (Mercor) — ce qui donne une idée du réseau dans lequel s'inscrit ce pari. À surveiller de près, c'est typiquement le genre de plateforme qu'on pourrait tester pour customiser un agent sur un workflow de veille ou d'analyse, avant d'écrire la spec complète.
05
Anthropic riposte : Sonnet 5 lancé, Cowork désormais sur le web et le mobile — pour tous les workflows agentiques du quotidien
Anthropic a publié le 30 juin Sonnet 5, présenté comme « le Sonnet le plus agentique à ce jour » — comprenez : un modèle taillé pour piloter des enchaînements d'actions sur des outils externes. Depuis le 7 juillet, Claude Cowork, le produit qui sert d'interface pour ces workflows agentiques, passe du desktop au web et au mobile, avec un déploiement progressif à partir du plan Max. Un « récapitulatif mensuel » est aussi en bêta depuis le 9 juillet. Le positionnement est clair : Anthropic vise le coût maîtrisé pour des workflows agentiques récurrents, en concurrence directe avec ChatGPT Work d'OpenAI et Copilot Agents de Microsoft. Pour un utilisateur, la différence concrète se voit sur la durée : Sonnet 5 accepte des tâches plus longues sans décrocher, Cowork s'ouvre sur les appareils du quotidien. C'est un signal à intégrer dans le choix de pile agentique — Claude reste l'une des options sérieuses pour des workflows qui doivent tenir dans la durée sans exploser le budget API. La limite reste le plan d'abonnement pour débloquer la version web et mobile.
📡 À surveiller
La Chine pose les fondations d'une gouvernance IA alternative — 29 pays autour de Shanghai
L'ouverture de la WAIC 2026 à Shanghai le 18 juillet a été accompagnée d'un geste géopolitique marquant : la création du WAICO, une organisation internationale de gouvernance de l'IA qui regroupe 29 pays. Lecture : la Chine n'attend plus que les États-Unis définissent les règles — elle pose les siennes, avec ses alliés. À observer : qui signe dans les 30-60 prochains jours, et ce que ce bloc devient.
DeepSeek V4 officialise sa nouvelle tarification — et débranche les anciens modèles le 24 juillet
DeepSeek a annoncé pour mi-juillet V4-Pro (1 600 milliards de paramètres, 49 actifs) et V4-Flash (284 milliards, 13 actifs), avec une fenêtre d'un million de tokens chacun et une grille tarifaire peak/off-peak qui double le prix aux heures de pointe. Le cache (mémoire qui évite de retraiter les mêmes questions) ramène le coût à -80 % sur Flash et -92 % sur Pro. Les anciens identifiants deepseek-chat et deepseek-reasoner seront dépréciés le 24 juillet à 15 h 59 UTC — migration obligatoire pour les agents qui les utilisent encore.
NVIDIA propose une nouvelle unité de mesure — non plus le token, mais le succès par dollar dépensé
Dans un manifeste publié mi-juillet, NVIDIA défend l'idée que la métrique centrale pour les systèmes agentiques n'est plus le coût par token mais le succès par dollar de calcul dépensé, en intégrant les gains du post-entraînement par apprentissage par renforcement. La nouvelle génération de GPU Vera Rubin, combinée à NeMo Gym et NeMo RL, est positionnée comme l'infrastructure de cette boucle. À intégrer dans la réflexion FinOps sur le rapport qualité-prix du compute.
Bunkerhill Health lève pour des agents IA en santé — 55 millions de dollars cumulés selon les sources
Bunkerhill Health, start-up qui propose des outils agentiques pour hôpitaux et systèmes de santé américains, a annoncé mi-juillet un tour de table mené par Sequoia Capital avec Felicis, Optum Ventures et Y Combinator. Valorisation : 367 millions de dollars. Caveat : le montant de 55 millions communiqué pourrait inclure un financement cumulé (Seed + série A + série B), le tour exact reste à confirmer. Un bon exemple de vertical agentique (santé) à fort potentiel de marché, à comparer avec ce qui se fait en France sur le même créneau.
📊 Tendance
Le 19 juillet 2026, l'écosystème des agents IA consolide une semaine de basculements structurants, marquée par la sortie de Kimi K3 par Moonshot AI (le plus gros modèle ouvert jamais publié, déjà compatible avec les outils de programmation agentique), l'arrivée d'Inkling chez Thinking Machines (premier modèle multimodal Apache 2.0 d'un labo US, construit dès le départ pour piloter des agents), le lancement de ChatGPT Work par OpenAI (agent bureau qui consolide Operator, Deep Research et Workspace Agents), la série A à un milliard de dollars de Prime Intellect (plateforme complète d'entraînement agentique pour les entreprises), et la riposte d'Anthropic avec Sonnet 5 et Cowork sur le web et le mobile. Quatre leçons émergent pour qui bâtit des agents avec l'intention d'en tirer un chiffre d'affaires. (1) La bataille des agents bureau est lancée — OpenAI (ChatGPT Work), Anthropic (Cowork) et Microsoft (Copilot Agents) se positionnent sur le même terrain, et la consolidation des produits existants en une offre unique devient la norme. (2) Le modèle ouvert redevient un argument commercial — Kimi K3 côté chinois, Inkling côté américain sous Apache 2.0 : deux visions de l'ouverture, mais un signal clair que le verrouillage n'est plus la position dominante. (3) La fenêtre de contexte d'un million de tokens devient la nouvelle norme — Moonshot et Thinking Machines la poussent ensemble, ce qui change la donne pour les agents qui travaillent sur de longs projets. (4) Le financement des plateformes agentiques d'entreprise explose — Prime Intellect à un milliard, Bunkerhill en santé : les verticaux à fort potentiel de marché attirent des tickets de plus en plus gros.