The Agent Watch
简报 · 文章 · 工具 · 关于 EN FR DE ES 中文 IT PT SV FI DA

每日简报

2026年8月16日 · 5 条新闻

🔥 头条

1

阿里巴巴免费发布紧凑型 AI 模型,小体积也能有大性能

想象一辆小车,却拥有豪华轿车的性能。这正是 Qwen3.8-27B 的表现。阿里巴巴刚刚以 Apache 2.0 许可免费发布了这个 270 亿参数的模型。它能读懂文字和图像,能够同时记住 26.2 万个词的上下文,在一项需要像人类一样操作电脑的测试中拿到了 84% 的分数。它只需要一块高端 GPU 就能运行。对于一家希望拥有强力 AI 智能体、又不想把数据交给云巨头的中小企业来说,这是一个可以立刻上手的严肃选择。 来源:https://huggingface.co/Qwen/Qwen3.8-27B

2

中国模型在发布当天就发现了 Cursor 的一个漏洞

北京的实验室 Z.ai 发布了 GLM-5.3,一款专门面向代码与防御性网络安全的模型。就在发布当天,它就在 Cursor(深受开发者喜爱的 AI 代码编辑器)中找到了一个严重漏洞:一段恶意指令就可能让攻击者控制你的电脑。Z.ai 主动推迟了该模型的开源发布,以便留出安全审查时间。这是第一次:一家中国实验室选择放慢发布节奏,而不是冒着把危险工具交到错误的人手里的风险。 来源:https://z.ai/blog/glm-5.3

Source : z.ai →
3

英国一家初创公司筹集 3000 万美元,专门给 AI 找漏洞

Mindgard 是兰卡斯特大学的衍生公司,刚刚筹集了 3000 万美元。它的业务是:在人工智能系统里寻找安全漏洞。两年时间里,他们已经在你大概率正在使用的产品里发现了 150 多个漏洞:Cursor、ChatGPT、Google Antigravity。对于一家部署 AI 智能体的企业来说,接受这类公司的审计正在变成一道必答题——就像汽车上路前必须通过年检一样。 来源:https://mindgard.ai/blog/mindgard-raises-30m-series-a

4

一个平台给 AI 智能体加上了紧急停止按钮

Matimo Platform,一家年轻的加州初创公司,推出了一款面向 AI 智能体的治理平台。它的亮点是:一个紧急停止按钮。如果某个智能体开始乱来,你可以直接切断电流,就像拔掉一台过热电器的插头。该平台还提供一种“影子模式”,智能体只运行、不能行动,刚好够用来确认它做的是你期望的事。对于想要部署 AI 智能体、又不想失控的银行、保险公司或医院来说,这正是它们一直缺失的那种保险栓。 来源:https://www.einnews.com/pr_news/934440807/matimo-platform-an-ai-agent-governance-and-execution-system-launches-worldwide

5

法国一家初创公司把 GPU 的算力榨出了三到四倍

Kog,巴黎的十一人团队,找到了让图形处理器在 AI 智能体任务上压榨出三到四倍性能的方法。原本需要 8 秒才能回答的智能体,现在不到 2.5 秒,成本下降 60%。诀窍是把智能体和芯片之间对话的软件层一路重写,直到硬件最深的那一层。Kog 由 Scaleway、Bpifrance 和 French Tech 2030 投资支持,承诺为 AI 智能体基础设施带来欧洲主权。一场用真实模型进行的现场演示计划在 9 月举行。 来源:https://techcrunch.com/2026/08/14/kog-is-going-deeper-to-squeeze-more-inference-out-of-gpus/

📡 值得关注

GLM-5.3 的开源权重将在安全窗口之后放出

Z.ai 将其旗舰模型保留两周时间进行安全审查。Hugging Face 上的发布预计在 8 月 28 日前后。值得关注:最终的许可证、安全报告,以及已经拿到访问权限的首批合作伙伴的反馈。

Cursor 存在一个关键漏洞,已被两个独立来源确认

Z.ai(CurXecute)和 Mindgard 先后在相隔两天的时间里发现了同类漏洞。安全社区正在等待官方 CVE 以及 Cursor 的回应。这是一个月内第五次在 AI 代码编辑器中发现的严重泄露。

Qwen3.8 的大版本依然缺位

阿里巴巴曾承诺在 8 月 10 日所在的那一周放出超大版本(2.4 万亿参数)。到 8 月 16 日仍未在 Hugging Face 上架,距离承诺已经过去 16 天。而紧凑的 27B 版本则已经发布。

代理式 AI 正在走进薪酬与人力资源

印度的 Kredily 公司推出了一款 AI 智能体,为 2.5 万家印度中小企业处理薪酬和人力工作。关键细节:任何不可逆操作(付款、申报)都需要人工审批。这是关键垂直领域智能体(薪酬、合规)走向成熟的首个信号。

📊 趋势

AI 智能体的“隐形层”正在高速成形。当模型只能在基准测试上多拿几分时,吸引资本和工程投入的反而是治理、内存、GPU 基础设施和攻击性安全。中国实验室里同时存在三种发布哲学:立刻开放许可(阿里巴巴)、为审查延后发布(Z.ai)、以及带地域限制的开源权重。对欧洲企业来说,问题不再是“该选哪个模型”,而是“该拥抱哪一套完整的生态”。