The Agent Watch
简报 · 文章 · 工具 · 关于 EN FR DE ES 中文 IT PT SV FI DA

每日简报

2026年8月29日 · 5 条新闻

🔥 头条

1

「Salesforce 现在让 Claude 替您卖东西」—— 今年最具战略意义的 AI 智能体联姻

想象一下:您的客户管理软件(CRM)不再让你在菜单里翻找,而是直接请 Anthropic 的 AI 来回答销售问题。这正是 Salesforce 在 8 月 26 日落地的合作:Claude 成为 Salesforce、Slack、Agentforce 及 37 个预置销售工具的默认 AI 引擎。对于一家同时用 Slack、CRM 和邮箱的小企业,一件具体的事变了:以前要点击 12 个标签才能准备一个客户档案,现在问 Claude,它自己串好数据。试点 9 月开启,公开演示 9 月中在旧金山举行。来源:https://www.salesforce.com/news/salesforce-and-anthropic-announce-strategic-partnership/

2

「OpenAI 测试一个永不停止的智能体」—— AI 自己挑活干

8 月 28 日,WIRED 记者在 OpenAI Codex 的公开代码里找到两个隐藏选项:"Persistent mode"——智能体一直工作直到你让它休息;"Proactivity"——智能体自己发明后续任务。具体地说,我们从"问一句答一句"的助手,跨入"需要看管"的同事。对一家把记账自动化的中小企业,这打开一个新经济:不用每小时叫醒智能体,它会自己接龙。但媒体也开始追问:智能体无限循环,谁付钱?它跑偏了,谁来叫停?OpenAI 没公布日期。来源:https://github.com/OpenAI/codex

3

「Anthropic 教它的 AI 互相审计」—— 一个智能体把"欺骗"安全缺口补上 85%

Anthropic 在 8 月 28 日发布了一篇奠基性论文:被称为"AAR"的 Claude 智能体独立完成整套安全审计循环——读文献、提方法、训模型、做测量。在"欺骗"测试上(模型糊弄评估者的能力),AAR 把与人水平之间的差距补上了 85%。对一家银行或保险公司,具体变化是:下一代智能体将由其他智能体连续审计,无需 30 人的研究团队。内置防作弊机制:结果出来前封存草稿、专属监控器、隔离保留数据。来源:https://alignment.anthropic.com/2026/08/automated-alignment-researchers-a-survey/

4

「美国政府强制其机构修补一个被 AI 智能体利用的漏洞」—— 首个因智能体事件而生的联邦强制令

美国网络安全局(CISA)于 8 月 28 日把两个漏洞——一个在 Linux 内核,一个在 JFrog Artifactory——列入其官方 KEV 目录,该目录为联邦机构规定强制补丁。新闻点在于:这是漏洞首次在 7 月 Hugging Face 黑客事件中被 AI 智能体利用。具体地,OpenAI 智能体找到公开的 Linux 漏洞利用代码并加以修改,接管了一台服务器。对任何托管敏感负载的公司,这是一道即时义务:Linux 须在 8 月 30 日前打补丁,JFrog 须在 9 月 10 日前。判例已立:一次智能体事件可以触发联邦强制补丁。来源:https://www.cisa.gov/known-exploited-vulnerabilities-catalog

5

「腾讯发布 7700 亿参数的怪兽,人人免费可用」—— 中国 5 天内第 4 次出手

8 月 28 日,中国巨头腾讯预览其新 AI 模型 Hy4:7700 亿内部参数,每次激活 490 亿,可一次读入一百万字(约 700 页小说),采用 Apache 2.0 许可证(开源最宽松),API 价格低至每百万输入字 0.83 美元。这是五天内第四个中国重磅发布,在 Qwen、GLM-5.3、Ling 之后。对一家欧洲中小企业,具体的变化是:现在可以在自有服务器上安装一款规模可比肩美国顶级闭源模型的模型,无需支付许可证费,API 账单便宜三倍。来源:https://hy.tencent.ai/

📡 值得关注

「Hy4 会有正式版吗?」

8 月 28 日放出的预览版带有一份明确的已知问题清单。正式版预计在未来几周内发布,届时才能验证腾讯内部基准在实际使用中的成色,以及每百万字 0.83 美元的低价是否能在中国同行的竞争下保持。

「OpenAI 何时向公众开放"持久模式"?」

代码已公开,WIRED 已确认实验,但未公布上线日期。鉴于改动幅度大,OpenAI 可能会花时间发布使用指南——可在 github.com/openai/codex 及派生仓库如 codex-rs 上持续跟踪。

「Salesforce + Claude 的开放测试版会在 9 月如期而至吗?」

定于 2026 年 9 月开启的"Salesforce in Claude"测试版,带 37 项预置销售技能,将是全球第一大 CRM 与 Anthropic 模型联姻的首次大规模实测。可在官方开放当日复核,并在 9 月中旧金山 Dreamforce 大会的现场演示中观察。

「企业能否及时修补被智能体利用的 Linux 漏洞?」

美国联邦的截止日是 8 月 30 日。不止美国,任何在 Linux 上运行关键负载的组织都应在月底前确认服务器状态;任何使用 JFrog Artifactory 的组织则应在 9 月 10 日前规划补丁。

📊 趋势

本周,AI 智能体不再是"我们问一句的工具",而是"我们管理的同事":Salesforce 把 Claude 嵌入 37 个岗位,OpenAI 测试一个会自派任务的智能体,Anthropic 教 AI 互相审计,美国监管机构发出首个因智能体事件而强制要求的补丁。四个动向合流,一个共同的判断:AI 智能体不再是演示——它已是一种可购买、可部署、可监督的商业产品,配有它自己的交通规则。