Briefing quotidien
16 août 2026 · 5 histoires
🔥 À la une
1Alibaba met en libre service un modèle compact qui fait le travail d'un gros
Imaginez une voiture citadine qui aurait les performances d'une berline haut de gamme. C'est ce que fait Qwen3.8-27B, un modèle de 27 milliards de paramètres qu'Alibaba vient de publier gratuitement, sous licence Apache 2.0. Il lit aussi bien le texte que les images, garde le fil d'une conversation sur 262 000 mots d'un coup, et réussit 84 % d'un test où il doit manipuler un ordinateur à la place d'un humain. Il tourne sur un seul GPU haut de gamme. Pour une PME ou un indépendant qui veut un agent IA puissant sans envoyer ses données chez un géant du cloud, c'est une option utilisable dès aujourd'hui.
Source : https://huggingface.co/Qwen/Qwen3.8-27B
2Un modèle chinois trouve une faille dans Cursor le jour même de sa sortie
Le labo Z.ai, à Pékin, publie GLM-5.3, un modèle spécialisé dans le code et la cybersécurité défensive. Le jour de la sortie, il identifie une faille sérieuse dans Cursor, l'éditeur de code dopé à l'IA très utilisé par les développeurs : quelqu'un de malveillant peut, via une simple instruction textuelle, prendre le contrôle de votre ordinateur. Z.ai retarde volontairement la publication de son modèle en open source pour laisser le temps de vérifier la sécurité. C'est une première : un labo chinois préfère ralentir sa sortie plutôt que risquer de mettre un outil dangereux entre de mauvaises mains.
Source : https://z.ai/blog/glm-5.3
3Une start-up britannique lève 30 millions pour traquer les failles des IA
Mindgard, une spin-off de l'université de Lancaster, vient de lever 30 millions d'euros. Son métier : chasser les failles de sécurité dans les intelligences artificielles. En deux ans, elle a trouvé plus de 150 vulnérabilités dans des produits que vous utilisez probablement déjà : Cursor, ChatGPT, Google Antigravity. Pour une entreprise qui déploie un agent IA, faire auditer son système par ce type de boîte devient peu à peu un passage obligé, comme un contrôle technique avant de mettre une voiture en circulation.
Source : https://mindgard.ai/blog/mindgard-raises-30m-series-a
4Une plateforme ajoute un bouton d'arrêt d'urgence pour les agents IA
Matimo Platform, une jeune pousse californienne, lance une plateforme de gouvernance pour les agents IA. Sa particularité : un bouton d'arrêt d'urgence. Si un agent commence à faire n'importe quoi, on coupe net, comme on débrancherait un appareil qui surchauffe. La plateforme propose aussi un mode 'observation' où l'agent tourne sans pouvoir agir, le temps de vérifier qu'il fait bien ce qu'on attend. Pour les banques, les assureurs ou les hôpitaux qui veulent se lancer dans les agents IA sans perdre le contrôle, c'est le genre de garde-fou qui manquait.
Source : https://www.einnews.com/pr_news/934440807/matimo-platform-an-ai-agent-governance-and-execution-system-launches-worldwide
5Une start-up française extrait trois à quatre fois plus de puissance des GPU
Kog, onze personnes à Paris, a trouvé comment faire travailler les puces graphiques trois à quatre fois plus dur sur les agents IA. Concrètement, un agent qui mettait 8 secondes pour répondre met maintenant moins de 2,5 secondes, pour 60 % de coût en moins. Leur astuce : réécrire en profondeur la couche logicielle qui fait dialoguer les agents avec les puces, jusqu'au niveau le plus intime du matériel. Soutenue par Scaleway, Bpifrance et French Tech 2030, Kog promet une souveraineté européenne sur l'infrastructure des agents IA. La démonstration sur vrai modèle est prévue en septembre.
Source : https://techcrunch.com/2026/08/14/kog-is-going-deeper-to-squeeze-more-inference-out-of-gpus/
📡 À surveiller
Les poids ouverts de GLM-5.3 arriveront après une fenêtre de sécurité
Z.ai garde son modèle phare sous le coude pendant deux semaines pour une revue de sécurité. La publication sur Hugging Face est attendue autour du 28 août. À surveiller : la licence finale, le rapport de sécurité, et les retours des premiers partenaires qui ont déjà accès.
Cursor a une faille critique confirmée par deux sources indépendantes
Le même type de faille a été identifié à deux jours d'intervalle par Z.ai (CurXecute) et Mindgard. La communauté sécurité attend un identifiant officiel (CVE) et la réponse de Cursor. C'est la cinquième fuite sensible découverte dans un éditeur de code IA en un mois.
La grosse version de Qwen3.8 se fait toujours attendre
Alibaba avait promis la version géante (2 400 milliards de paramètres) pour la semaine du 10 août. Au 16 août, elle n'est toujours pas sur Hugging Face, 16 jours après la promesse. La version compacte 27B, elle, est bien livrée.
L'agentic AI s'installe dans la paie et les RH
Kredily, en Inde, lance un agent IA pour gérer la paie et les RH sur 25 000 PME indiennes. Particularité : toute action irréversible (paiement, déclaration) passe par une validation humaine. Premier signal que les agents verticaux critiques (paie, compliance) arrivent à maturité.
📊 Tendance
La couche invisible des agents IA se structure à toute vitesse. Pendant que les modèles gagnent quelques points de benchmark, c'est désormais la gouvernance, la mémoire, l'infrastructure GPU et la sécurité offensive qui attirent les capitaux et les efforts d'ingénierie. Trois philosophies de publication s'affrontent chez les labos chinois : livraison immédiate permissive (Alibaba), livraison différée pour audit (Z.ai), et open weight avec restriction territoriale. Pour les entreprises européennes, la question n'est plus 'quel modèle choisir' mais 'quel écosystème complet embrasser'.