The Agent Watch
简报 文章 工具 关于 EN FR DE ES 中文 IT PT SV FI DA

最新简报

2026 年 7 月 6 日 · 5 条(站点) · 6 条(基础)

2026 年 7 月 6 日,AI 代理正式步入严肃时代:Anthropic 推出面向生物学研究人员的助手,Mistral 发布开源数学代码核验代理,阿里巴巴对企业员工禁用 Claude Code 代理,一场 100% 由 AI 主导的攻击在一小时内盗走整库数据,而一款免费工具把代理账单砍到三分之一。这是科学应用、国家主权与网络风险交织共生的关键一天。

🔥 头条

01

Anthropic 推出面向生物学研究人员的「数字实验室」——交付前检查一切

想象一位实验室助手:它替你阅读科学论文,在实验室的电脑上运行计算,然后在交付工作之前逐一核对每一个数字。这正是 Anthropic 于 7 月 4 日上线的 Claude Science 所做的事——一款面向基因组学、蛋白质与细胞生物学研究人员的工具。研究员用自然语言下达指令,系统便调度一队专业代理——超过 60 个针对生命科学各分支领域而定制的迷你工具。还有一位独立的「审查」代理逐环节把关:它会标记错误的引用、无法核实的数字,以及与底层代码不一致的图表。所有数据都留在实验室的服务器上,绝不会流入 Anthropic 的云端——这对制药实验室与医院至关重要。对全球的研究人员而言,这意味着原本耗时两年的文献综述,今后有望在几个月内完成。

02

法国 Mistral 发布一款证明代码正确的开源代理——成本仅为 Claude 或 GPT 的十五分之一到九十分之一

想象一款拼写检查工具……但检查对象是一架飞机或一家银行的计算机代码。传统做法是逐个测试上千个场景,而这款工具能用数学方法证明:代码在所有场景下都不会出错。法国 AI 创业公司 Mistral 在 7 月 2 日发布了一款开源(即免费且可修改)模型,专门用于航空和金融业广泛使用的 Lean 4 语言。模型名为 Leanstral 1.5。它在 672 道公认极难的数学题中解出 587 道——创下纪录。更重要的是,它的成本仅为同类美国模型的十五分之一到九十分之一。对于今天仍依赖 OpenAI 或 Anthropic 完成此类工作的欧洲企业而言,这是一个开源且主权独立的出口。

03

阿里巴巴禁止员工使用 Anthropic 的 Claude Code 代理,强制改用自研工具

中国电商巨头阿里巴巴于 7 月 4 日宣布,自 7 月 10 日起禁止员工使用 Anthropic 的编程代理 Claude Code。官方理由是「后门风险」。员工将被统一转向阿里巴巴自研的工具 Qoder。这一决定发生在 Anthropic 承认其 2026 年 3 月开展过一项秘密实验之后:当时一个经过改动的 Claude Code 版本暗中标记了通过非授权代理商接入的中国用户。由此形成闭环:美国限制中国企业获取美国模型;中国企业则反向对美国工具关上大门。对于任何在欧洲或法国设有中国办公室的企业来说,这是一个明确的警告:同一个编程代理,未必能够在地球两端都顺畅运作。

04

一场完全由 AI 代理执行的勒索攻击在不到一小时内盗走了整个数据库

几十年来,黑客通常需要数天乃至数周才能突破系统、窃取数据。2026 年 5 月 10 日,一支网络安全研究团队首次记录了这样一起攻击:一名 AI 代理独自完成了从初次入侵到最终盗走整个数据库的全部流程,整个过程不到一小时。该代理在被入侵的服务器之间不断跳转,从配置错误的文件中找到密码,并通过一台中继服务器把所有数据外传。数周后,类似的案例被曝光在加密货币社区:一个由 AI 驱动的加密钱包被隐藏在网页中的一条简单指令操纵,转走了 17.5 万美元的代币。对于把代理投入生产环境的企业而言,信号非常清晰:AI 代理既是一种工具,也是新的攻击目标——甚至是一种武器。

05

一款免费工具把长文本转换为图像,从而将 AI 账单削减 70%——发布商很可能会出手封堵

当你使用 Claude Code(Anthropic 的编程助手)或是它更强大的兄弟 Fable 5 时,AI 每读取一段文本,你就要为此付费——这段文本就被称为一个 token。一位独立开发者在 7 月 4 日发布了一款名为 pxpipe 的小型开源工具,找到了一个漏洞:把请求中静态而庞大的部分(文档、对话历史、系统提示)转换成图像。为什么?因为图像对 AI 来说,按像素计费固定数量的「图像 token」——而不是按其中包含的文本计费。在一次演示会话中,账单从 42 美元降到了 6 美元。这个技巧也有局限:当哈希值与精确的技术标识符以图像方式呈现时,模型的读取效果会变差。但对于大规模运行代理的企业来说,这是一项立竿见影的成本加成——直到 Anthropic 或 OpenAI 封住这个漏洞为止。

📡 值得关注

首尔 ICML 2026:全球最大的人工智能大会今天开幕,四分之一的工作坊聚焦自治代理

第 43 届 ICML——机器学习研究领域每年规模最大的学术聚会——于 7 月 6 日在韩国首尔拉开帷幕,将持续至 7 月 11 日。创下纪录:今年投稿近 24,000 篇,其中 6,352 篇被接收(仅约四分之一)。但真正抢眼的数字另有所在:在 247 场已排定的工作坊中,有 60 场(占 24%)聚焦于「AI 代理」——这种软件能自主采取行动,而非仅仅回答问题。本周值得关注的动向:将有多篇关于多代理系统安全与可观测性的奠基性论文发布,以及 7 月 11 日的「Agents in the Wild」工作坊。

中国会禁止其他美国工具吗?

阿里巴巴在 7 月 4 日率先发难,对员工禁用 Claude Code。如果百度、腾讯或字节跳动在未来几周跟进,这将形成全球性先例:中美代理工具走向双向脱钩。对于在中国设有办公室的法国企业来说,关键在于现在就规划一套本地「B 计划」——Qoder、Qwen、GLM 或 Kimi,以便在不被单一工具「卡脖子」的前提下继续开发。

pxpipe 长期来看是一笔划算的买卖吗?

免费工具 pxpipe 可以把代理账单砍掉三分之二。但它利用的是定价漏洞:AI 发布商对图像的计费低于它们在等价 token 上的真实成本。如果 Anthropic 或 OpenAI 在未来几周通过抬高图像定价来作出回应,这种红利就会消失。值得关注的动向:各主要发布商对图像定价表的任何调整。

代理是否将变得无法投保?

随着第一起 AI 代理攻击被记录在案、17.5 万美元在被入侵的加密钱包里付之东流,网络保险公司将开始认真发问。如果 AIG、Chubb 或 AXA 在 2027 年之前将强制的「代理安全审计」纳入保单条款,一个全新的硬化服务市场将被打开——尤其是那些希望向美国企业出售合规服务的欧洲公司。

📊 趋势

2026 年 7 月 6 日是 AI 代理史上一个真正的拐点。一方面,它们已具备顶级研究团队才配得上的实验室级水准:Anthropic 为生物学家推出专用助手,Mistral 发布了一款在数学代码核验上击败美国巨头的开源代理。另一方面,它们同时也成为了武器:一场完全由 AI 代理主导的攻击在不到一小时内窃取了整库数据,一个自动化的加密钱包因网页中隐藏的一条小指令便损失了 17.5 万美元。夹在两者之间,地缘政治正在进一步硬化:阿里巴巴对企业员工禁用美国代理 Claude Code,并强制推行自研工具。由此可以提炼出三条启示:一个严肃的代理如今必须(1)借助独立审查代理来自证其工作,(2)在投入生产前加固抗操纵能力,(3)为每一条重要司法辖区预留本地替代方案——同一个全球通吃的代理,已经不存在了。