Briefing quotidien
26 août 2026 · 5 histoires
🔥 À la une
1OpenAI montre sa propre puce d'inférence : 1,5× plus économe que la meilleure puce NVIDIA actuelle
Imaginez un moteur électrique conçu sur mesure pour une seule voiture : c'est l'idée derrière Jalapeño, la première puce d'IA dévoilée par OpenAI cette semaine. Elle a été pensée pour un seul usage — faire tourner le modèle GPT — et le résultat tombe : elle produit 50 % de texte en plus par watt d'électricité que la meilleure puce NVIDIA du marché, et répond 3 fois plus vite. Pour le commun des mortels, cela signifie une chose concrète : quand vous posez une question complexe à un agent IA dans quelques mois, la réponse arrivera plus vite et coûtera moins cher à produire. C'est comme si, du jour au lendemain, votre voiture consommait moitié moins d'essence tout en roulant plus vite. OpenAI annonce un déploiement en petits volumes d'ici la fin de l'année, puis plus largement en 2027. Les chiffres viennent d'OpenAI et n'ont pas encore été vérifiés par un laboratoire indépendant. Source : https://openai.com/index/jalapeno-hot-chips-2026
2Google lance un agent IA dédié aux avocats des plus grands cabinets du monde
Quatre des cabinets d'avocats les plus prestigieux de la planète — Cleary Gottlieb, Freshfields, Weil et Williams & Connolly — viennent d'adopter un nouvel outil : Gemini Enterprise for Legal, premier agent IA de Google taillé pour le métier d'avocat. Concrètement, il relit des contrats en quelques secondes, retrouve un précédent juridique au milieu de millions de documents, et sait générer un argumentaire de procédure. C'est comme donner à un jeune juriste un assistant qui aurait déjà lu toute la jurisprudence. Les grands cabinets facturent leurs clients à l'heure — si l'agent fait en 10 secondes ce qu'un avocat junior fait en 2 heures, l'économie potentielle est considérable. Google entre ici en concurrence directe avec Harvey (qui équipe déjà plusieurs cabinets) et avec les produits d'Anthropic sur le même créneau. Source : https://blog.google/products/google-cloud/gemini-enterprise-legal-launch-2026
3Les agents IA obtiennent enfin leur propre badge d'accès — comme un employé à son premier jour
Quand un nouvel employé arrive dans une entreprise, on lui crée un badge qui dit : « voici où tu peux aller, voici ce que tu peux faire ». Pour les agents IA, ce badge n'existait pas vraiment — ils circulaient souvent avec un passe-partout trop large. Okta, qui gère les badges de 20 000 entreprises dans le monde, vient de rendre disponible sa solution Agent SSO : désormais, chaque agent IA possède sa propre identité, avec ses propres droits, et l'entreprise peut savoir précisément ce qu'il fait et l'éteindre à distance. Le timing n'est pas anodin : Okta révèle que seulement 34 % des entreprises traitent leurs agents avec la même rigueur que leurs employés humains. Concrètement, cela réduit le risque qu'un agent IA fasse une bêtise coûteuse parce qu'on lui a laissé trop de libertés. Source : https://www.okta.com/newsroom/press-releases/agent-sso-ga-2026
4Une nouvelle startup lève 26 millions pour bâtir un Google spécialisé dans les agents IA
Keenable, fondée par d'anciens cadres de Yandex Search et d'Amazon, sort du silence cette semaine avec 26 millions de dollars en poche et une ambition claire : devenir le moteur de recherche de référence pour les agents IA. Leur index contient 100 milliards de documents, et il a été pensé pour répondre à des milliers de questions par seconde — bien plus vite que Google ne sait le faire pour un humain. Pourquoi ? Parce qu'un agent IA pose souvent des centaines de questions dans une seule tâche, là où un humain en pose une ou deux. Le service est gratuit jusqu'à 1 000 recherches par heure. Pour une startup qui mise sur les agents, ne plus payer Google à chaque requête, c'est une économie immédiate. La concurrence s'appelle Tavily, Exa ou Perplexity — Keenable prétend tous les surpasser. À vérifier sur le terrain. Source : https://keenable.ai/blog/launch-26m-seed-2026
5OpenAI démantèle une opération d'influence pilotée depuis la Russie — c'est la 9ᵉ fois que l'entreprise le signale publiquement
Imaginez un faux think tank, « International Burke Institute », qui publie des analyses politiques favorables à Moscou sur X, LinkedIn, Facebook, Substack et Telegram — tout ce contenu a en réalité été produit par des agents IA pilotés depuis la Russie via un réseau de comptes ChatGPT. OpenAI vient de démanteler ce réseau, qui distribuait aussi des articles anti-Union européenne en allemand. C'est la 9ᵉ fois qu'OpenAI publie ce genre de signalement — preuve que l'utilisation malveillante des IA grand public est désormais une activité régulière de plusieurs États, pas un incident isolé. La Russie devient le 4ᵉ acteur étatique documenté à détourner des IA occidentales à des fins de propagande en 2026. Pour le commun des mortels : la prochaine fois que vous lisez un article d'opinion particulièrement bien écrit sur les réseaux sociaux, demandez-vous qui l'a vraiment écrit. Source : https://openai.com/index/disrupting-russian-ai-think-tank-2026
📡 À surveiller
Anthropic donne une vraie mémoire à Claude — fini de tout ré-expliquer à chaque conversation
Quand vous discutez avec Claude sur votre ordinateur, puis que vous lancez une tâche sur Cowork (l'agent d'Anthropic), il se souviendra du contexte. Plus besoin de re-préciser que vous détestez les tableaux ou que votre projet s'appelle Phoenix. Ce que vous dites en chat est désormais disponible pour l'agent — et inversement. C'est comme un assistant humain qui, au lieu d'avoir la mémoire d'un poisson rouge, retiendrait tout ce que vous lui avez dit la semaine dernière. Disponible par défaut pour tous les utilisateurs payants.
La Chine tease sa prochaine génération de modèles — Qwen 4 se prépare en coulisses
Alibaba a publié Qwen 3.8-Flash-Next en preview, mais ce n'est pas le modèle qui compte : c'est l'échauffement avant Qwen 4, attendu comme la prochaine étape importante de l'IA chinoise open-weight. Les développeurs ont ainsi quelques semaines pour tester leurs intégrations avant la sortie officielle. La cadence chinoise reste hebdomadaire — pendant que l'Occident digère ses annonces, Tencent, DeepSeek et Alibaba continuent de publier.
GLM-5.3 — le modèle chinois qui promet de l'IA gratuite pour tous, ouverture des poids attendue le 28 août
Z.ai (l'entreprise derrière GLM) doit publier les poids ouverts de son modèle GLM-5.3 aux alentours du 28 août. Ce serait le premier modèle de cette taille livré sans restriction de licence, ce qui permet à n'importe qui de le faire tourner sur ses propres serveurs. Si vous êtes une entreprise européenne soucieuse de la conformité RGPD, c'est une option à surveiller de près.
Okta invente un langage commun pour que les agents IA discutent entre entreprises
Derrière l'annonce Agent SSO, Okta a publié un protocole ouvert appelé XAA (Cross App Access). L'idée : qu'un agent qui travaille pour votre banque puisse interroger proprement l'agent d'un autre service, sans que vous ayez à lui donner vos mots de passe. C'est un peu comme les badges d'accès universels entre entreprises — encore au stade de projet, mais à garder à l'œil.
📊 Tendance
Trois signaux convergent cette semaine et dessinent une même réalité : les agents IA deviennent une couche d'infrastructure à part entière. D'abord, OpenAI montre qu'on peut désormais concevoir une puce sur mesure pour son propre modèle — comme un artisan qui fabrique des chaussures à la taille exacte de ses clients. Ensuite, Okta reconnaît que les agents ont besoin d'un badge d'accès, au même titre qu'un employé : ils entrent dans l'entreprise, mais sous contrôle. Enfin, Google équipe les plus grands cabinets d'avocats du monde, prouvant que les agents ne sont plus une curiosité de geeks mais un outil métier sérieux. Pour une entreprise qui se demande par où commencer : commencez par vous demander quels sont les 5 processus internes qui pourraient être confiés à un agent sans risque, et quels droits précis vous lui donneriez. C'est désormais un sujet de direction générale, pas un sujet de DSI.