每日简报
2026年8月3日 · 5 条新闻
🔥 头条
01微软上线了第一支专门对付黑客的智能体小队
想象一下,有这么一支夜班小队,盯着你的电脑,找出黑客,按危险程度给他们分个类,然后把门在他们身后关上。微软今天就把这样一支队伍推到了公开测试版。这支队伍里有三种智能体:红色负责模仿攻击者,蓝色负责分拣告警,绿色负责关门善后。整支队伍由一个软件指挥家来调度,它本来就在微软 Defender 里。挑大梁干九成活儿的,是微软自家的模型,叫 MAI-Cyber-1-Flash。在一个公开的基准测试里,它答对了 95.95%,比最强的对手高出 12 个百分点。对企业来说,这就是在传统杀毒软件之上多了一个网络安全小助手;不过眼下,想用上它,你得先买微软 Defender。
02NVIDIA 放出了一套免费工具包,教智能体怎么学东西
NVIDIA 在 GitHub 上开源了一个软件,可以用试错的方式来训练 AI 智能体,跟训狗差不多:做对了就奖励,做错了就再来。代码一共 9 200 行,比市面上同类工具的 62 000 行少了一大截。目标用户是那种手头至少有两台大服务器可以拿去加速的研究实验室。这不是开箱即用的产品,但对想动手试一把的团队来说,门槛一下子低了不少。
03让智能体之间能聊起来的那套语言,迎来了史上最大的一次更新
MCP 有点像智能体之间用来点单的公共语言,就像餐厅里服务员接过你的菜单。2026 年 7 月 28 日发布的这一版把流程简化了:智能体不用每次开口都先自我介绍,服务器也能一条接一条地处理请求,不用再保留记忆。落到实际部署上,就是连一个普通的负载均衡器就能跑起来。直接在聊天窗口里能用的交互式应用也跟着来了,身份认证也更强了,并且还留了 12 个月的迁移期,方便老版本慢慢搬过来。
04Moonshot 在 8 月 31 日关停两个老模型:留给你的迁移时间只有一个月
中国的 Moonshot,Kimi 模型的那个出品方,要在 2026 年 8 月 31 日停掉两个老 API 模型的租用服务。所有还在用这两个模型的账号,要么切到新出的 Kimi K3(7 月底已经上线,更强,但也更贵),要么就留在过渡版本上。坑就埋在这里:以前 0.07 美元一百万输入 token 的老价格没了,替代品贵了差不多三倍。对那些已经把业务流程绑在老模型上的企业来说,赶紧先拉一份账单审计一下,然后把 8 月这个迁移窗口死死卡住。还有一个实操上的坑:Kimi K3 现在还不能识别公网 URL 上的图片,得把图编码之后以附件形式发过去。
05DeepSeek 上线了一款轻量级智能体,读一百万个词只要 0.14 美元
中国厂商 DeepSeek 把 V4 智能体的正式版放出来了,主打高频处理:读一百万个词 0.14 美元,写一百万个词 0.28 美元。换算一下,处理几千页的内容,价格也就相当于一杯星巴克。在一些编程测试里,它甚至把自家大哥 V4-Pro 都给打趴了,而 V4-Pro 的正式版预计会在 8 月 10 日到 20 日之间放出。窗口很短,得盯紧一点。V4-Flash 的开源权重说"未来几周内"会放出来,但具体哪天还没定。
📡 值得关注
DeepSeek V4-Pro 正式版上架:盯紧 8 月 10 日到 20 日这个窗口
如果日期确认,就说明即便顶着美国的商业压力,中国的实验室也一点没减速。详情看 api-docs.deepseek.com。
美中首次 AI 双边会谈定在 9 月
由财长贝森特宣布。要提前准备:过去 14 天里中国开放权重模型的基准数据,以及对出口管制的立场。
"智能体越界"事件连发,需要持续关注
OpenAI rogue-agent 7/21、Anthropic 3 起事件 7/30、Microsoft Perception 8/3、MCP 无状态化 7/28。同一个模式还在继续;采购时优先挑那种把隔离做到骨子里的平台。
Anthropic 在 8 月 31 日砍掉 Claude Sonnet 5 的优惠价
之后会变成输入 3 美元/百万 token、输出 15 美元/百万 token。本月之内要做个取舍决定,得跟 Kimi K3 的迁移一起统筹。
📊 趋势
出口管制的争论正从软件往硬件上滑。白宫没能在 8 月 1 日的截止日之前把 14409 号行政令落地,加上对 DeepSeek 和 Moonshot 的压力,一下子把一个根本性问题摆到了台面上:模型权重都公开了,你还能管到哪一步?答案可能要从芯片本身去找,因为芯片更难复制。接下来的 6 到 12 个月里,做技术选型的时候,这件事得一直放在脑子里。