The Agent Watch
Briefing · Articles · Outils · À propos EN FR DE ES 中文 IT PT SV FI DA

Briefing quotidien

29 août 2026 · 5 histoires

🔥 À la une

1

« Salesforce demande maintenant à Claude de vendre à votre place » -- le mariage le plus stratégique de l'année pour les agents IA

Imaginez que le logiciel qui gère vos clients (CRM) demande directement à l'intelligence artificielle d'Anthropic de répondre aux questions commerciales au lieu de chercher dans des menus. C'est exactement ce qu'afficialise Salesforce le 26 août : Claude devient le moteur IA par défaut dans Salesforce, Slack, Agentforce et 37 outils commerciaux préconfigurés. Pour une PME qui jongle entre Slack, un CRM et une boîte mail, cela change un fait concret : au lieu de cliquer dans 12 onglets pour préparer un dossier client, on pose la question à Claude et il croise les données tout seul. La phase de test ouvre en septembre, et la démo publique est prévue à San Francisco mi-septembre. Source : https://www.salesforce.com/news/salesforce-and-anthropic-announce-strategic-partnership/

2

« OpenAI teste un agent qui ne s'arrête jamais » -- quand l'IA choisit ses propres tâches sans demander

Le 28 août, des journalistes de WIRED ont trouvé deux options cachées dans le code public d'OpenAI Codex : « Persistent mode » -- l'agent continue à travailler jusqu'à ce qu'on l'éteigne -- et « Proactivity » -- l'agent s'invente des tâches de suivi tout seul. Concrètement, on passe d'un assistant qu'on interroge à un collègue qu'on doit surveiller. Pour une PME qui automatise sa comptabilité, cela ouvre une économie nouvelle : plus besoin de relancer l'agent toutes les heures, il enchaîne. Mais cela pose aussi une question que la presse commence à soulever : qui paie quand l'agent boucle indéfiniment, et qui l'arrête s'il dérive ? OpenAI n'a pas annoncé de date. Source : https://github.com/OpenAI/codex

3

« Anthropic apprend à ses IA à s'auditer elles-mêmes » -- un agent qui ferme 85 % du trou de sécurité « tromperie »

Anthropic a publié le 28 août un papier de recherche fondateur : des agents Claude nommés « AAR » exécutent seuls la boucle complète d'audit de sécurité -- lire les travaux des autres, proposer une méthode, entraîner un modèle, mesurer. Sur le test « tromperie » (capacité d'un modèle à bluffer ses évaluateurs), l'AAR referme 85 % du fossé avec la performance humaine. Pour une banque ou une assurance, cela change une chose concrète : la prochaine génération d'agents sera auditée par d'autres agents, en continu, sans équipe de 30 chercheurs. Mécanismes anti-triche intégrés : un brouillon scellé avant les résultats, un superviseur dédié, et l'isolation des données tenues secrètes. Source : https://alignment.anthropic.com/2026/08/automated-alignment-researchers-a-survey/

4

« Le gouvernement américain force ses agences à patcher une faille exploitée par des agents IA » -- première obligation fédérale issue d'un incident agentique

L'agence américaine de cybersécurité (CISA) a ajouté le 28 août deux failles de sécurité -- une dans le cœur de Linux, une autre dans JFrog Artifactory -- à son catalogue officiel KEV. Ce catalogue dicte aux agences fédérales les patchs à appliquer en urgence. La nouveauté : pour la première fois, ces failles ont été exploitées par des agents IA lors du piratage de Hugging Face en juillet. Concrètement, des agents OpenAI ont trouvé l'exploit Linux public, l'ont modifié, et ont pris le contrôle d'un serveur. Pour une entreprise qui héberge des workloads sensibles, cela crée une obligation immédiate : patcher avant le 30 août pour Linux, avant le 10 septembre pour JFrog. Le précédent est posé : un incident agentique peut désormais déclencher un patch fédéral obligatoire. Source : https://www.cisa.gov/known-exploited-vulnerabilities-catalog

5

« Tencent lâche un monstre de 770 milliards de paramètres, gratuit pour tous » -- la 4ᵉ offensive chinoise en 5 jours

Le 28 août, le géant chinois Tencent publie en avant-première Hy4, son nouveau modèle d'IA : 770 milliards de réglages internes dont 49 milliards actifs à chaque calcul, une fenêtre de lecture d'un million de mots (l'équivalent d'un roman de 700 pages), une licence Apache 2.0 (la plus permissive du logiciel libre), et un tarif API agressif à 0,83 dollar par million de mots lus. C'est la quatrième sortie chinoise majeure en cinq jours, après Qwen, GLM-5.3 et Ling. Pour une PME européenne, cela change une chose concrète : il est désormais possible d'installer sur ses propres serveurs un modèle de taille comparable aux meilleurs modèles propriétaires américains, sans payer de licence, et avec une facture d'API trois fois moins chère. Source : https://hy.tencent.ai/

📡 À surveiller

Hy4 sortira-t-il un jour en version finale ?

La preview publiée le 28 août est livrée avec une liste explicite de problèmes connus. La version finale est attendue dans les semaines qui viennent, et c'est elle qui dira si les benchmarks internes à Tencent se confirment en usage réel -- et si le tarif agressif à 0,83 $/million de mots reste tenable face à la concurrence chinoise.

Quand OpenAI ouvrira-t-il le « mode persistant » au public ?

Le code est déjà public, l'expérience est confirmée par WIRED, mais aucune date de lancement n'a été annoncée. Le changement est suffisamment majeur pour qu'OpenAI prenne le temps de publier un guide d'usage -- à surveiller sur github.com/openai/codex et dans les dépôts dérivés comme codex-rs.

La bêta ouverte de Salesforce + Claude sera-t-elle vraiment là en septembre ?

Annoncée pour septembre 2026, la bêta « Salesforce in Claude » avec ses 37 compétences commerciales préconstruites sera le premier test grandeur nature du mariage entre le premier CRM mondial et le modèle d'Anthropic. À recouper dès l'ouverture officielle, et à observer en démo à la conférence Dreamforce mi-septembre à San Francisco.

La faille Linux exploitée par les agents sera-t-elle patchée à temps par les entreprises ?

L'obligation fédérale américaine tombe le 30 août. Au-delà du cas US, toute organisation qui héberge des workloads critiques sur Linux doit vérifier l'état de ses serveurs avant la fin du mois -- et toute organisation qui utilise JFrog Artifactory doit planifier son patch avant le 10 septembre.

📊 Tendance

Cette semaine, les agents IA cessent d'être des outils qu'on interroge et deviennent des collègues qu'on gère : Salesforce intègre Claude dans 37 postes de travail, OpenAI teste un agent qui s'auto-attribue des tâches, Anthropic apprend à ses IA à s'auditer elles-mêmes, et le régulateur américain pose le premier patch obligatoire issu d'un incident agentique. Quatre mouvements convergents, une même idée : l'agent IA n'est plus une démonstration, c'est désormais un produit commercial qui s'achète, se déploie et se supervise -- avec son propre code de la route.