The Agent Watch
简报 · 文章 · 工具 · 关于 EN FR DE ES 中文 IT PT SV FI DA

每日简报

2026年8月30日 · 5 条新闻

🔥 头条

1

一家创业公司推出六支AI团队,取代你整套客户服务软件

想象一下,你不用再买电话、传真、答录机、工单软件和质量工具,而是雇六位虚拟员工,让它们代劳一切。这就是Crescendo的赌注。8月25日它推出CXP平台:六名专业AI代理(前台、辅助、质量、排班、优化、知识库)取代相当于六款传统工具的整套架构。对一家每天处理500个工单、50人的小公司,具体的改变很简单:与其付七份订阅费和三家集成商,不如在四周内配置好六个代理。接下来九十天这步棋能不能立住,还有待观察。 来源:https://crescendo.ai/news/crescendo-launches-the-ai-native-customer-experience-platform/

2

英伟达交付首款专为AI代理设计的处理器,OpenAI、Anthropic和AWS都已收到

英伟达的Vera处理器为AI代理不间断的工作而设计,现已进入大规模交付阶段。AWS在8月27日于西雅图收到了首台机器。甲骨文已在规模上铺开。OpenAI、Anthropic和一家航天企业在5月至7月间收到了各自的设备。对运营客户支持代理的团队,具体的改变是:因为每一次代理调用消耗的算力远超一次简单聊天,处理器再次成为瓶颈。英伟达承诺在代理工作负载下每核提速1.8倍。 来源:https://blogs.nvidia.com/blog/vera-cpu-delivery/

3

中国发布一款免费AI模型,在网络安全任务上击败GPT——五天内的第五次中国发布

中国实验室Z.ai在8月29日发布了GLM-5.3的开放权重:一个7530亿参数的模型,每次回答只激活其中400亿。对非技术读者来说:你可以下载它、在自己机器上运行,不需要订阅。它在两项网络安全基准上取得已知最高分(CyberGym 84.5%、Terminal Bench 3.0创纪录)。价格已公开:每读百万词几美分,整场对话成本还不到一杯咖啡。这是五天内中国大模型的第五次重大发布,——这台机器周末也不再停歇了。 来源:https://huggingface.co/zai-org/GLM-5.3

4

英伟达公开一款小巧节能的AI模型和一个智能路由,让你的代理在最不该崩的时候不崩

8月11日,英伟达免费发布了Nemotron 3.5 Lightning:一款310亿参数的模型,每次只激活其中36亿,专为在单台服务器上运行而设计。它搭配NeMo Switchyard路由器:每当有任务进来,系统挑选合适的模型(快速回复还是深度分析),避免为所有任务支付高额费用。对一家把客户支持自动化的创业公司,根据早期用户反馈,云账单可下降一半以上。模型在SWE-bench测试中得分51.6%。 来源:https://blogs.nvidia.com/blog/nemotron-lightning-switchyard-rtx-dgx/

5

美国法官判决:为7百万本未经授权使用的图书赔偿15亿美元——给整个AI行业立了新规矩

Bartz诉Anthropic一案的和解协议在7月20日获得法院最终批准,款项在8月10日开始支付。Anthropic使用了约7百万本未经同意下载的图书,平均每本约3100美元,并将销毁拷贝。对想把AI接入自己产品的创业者来说,具体的改变是这个问题有官方价格了:「我这个模型能不能在欧洲用?」。Google、Meta、Midjourney和OpenAI都面临类似诉讼——训练数据保险市场刚刚变得可承接。 来源:https://anthropiccopyrightsettlement.com/

📡 值得关注

欧盟AI法案第50条已生效28天

自8月2日起,所有专业聊天机器人必须声明自己是AI,所有生成图像必须加水印。Digital Omnibus(欧盟2026/1744号条例)把最重的义务推迟至2027年12月,但透明度义务立即生效。对任何在欧洲销售的小企业来说,现在该给聊天机器人加一条法律提示了。78%的欧洲机构仍未准备就绪。 来源:https://digital-strategy.ec.europa.eu/

Linux安全补丁迎来联邦死线

8月28日,美国CISA机构把一次AI代理对Linux内核的攻击(CVE-2026-53362)列入必须修复的官方漏洞目录。联邦机构必须在8月30日前安装补丁。这是首次由AI代理触发联邦级补丁义务的事件。任何把代理暴露在标准硬件上的组织都应持续关注。 来源:https://www.cisa.gov/known-exploited-vulnerabilities-catalog

中国节奏不见放缓:下一波本周可期

在五天五连发之后(GLM-5.3-Flash、Qwen3.8 Flash、Ling 3.0 Fin、腾讯Hy4、完整GLM-5.3),DeepSeek、Qwen团队、Moonshot或字节跳动的实验室很可能在未来五天内跟进。最具竞争力版本的平均使用价格已降到每百万词不到1欧元——这是欧洲中小企业集成的拐点。 来源:https://huggingface.co/zai-org/GLM-5.3-Flash

Vera+Rubin首次在Oracle云大规模部署

甲骨文成为首家在工业规模上部署Vera CPU+Rubin GPU新组合的主要云服务商。目标公布:到2026年底前部署数十万颗Vera CPU。对在云中托管代理的团队,每百万词价格在接下来几个月应当下降——有待独立基准交叉验证。 来源:https://blogs.nvidia.com/blog/vera-cpu-delivery/

📊 趋势

Dimanche 30 aout 2026 : le week-end n'arrete plus la machine. Les labos chinois enjambent le calendrier occidental et livrent leur cinquieme sortie open-weight en cinq jours (GLM-5.3 complet, derriere Tencent Hy4 et Qwen3.8 Flash). Pendant ce temps, NVIDIA distribue a grande echelle un CPU concu specifiquement pour les agents -- le hardware devient un goulot d'etranglement reconnu. Les entreprises clientes prennent leur propre virage : Crescendo mise sur le remplacement total du stack service client par six agents specialises plutot que sur une simple surcouche d'IA. Et la justice americaine tranche pour la premiere fois sur le prix des livres utilises sans permission pour entrainer un modele : 1,5 milliard de dollars -- une reference qui va peser sur toutes les prochaines negociations du secteur.