最新简报
2026 年 7 月 19 日 · 5 条要闻(网站) · 5 条要闻(基础)
2026 年 7 月 19 日,AI 智能体生态进一步消化了 WAIC 上海会议之后的一周:Moonshot AI 发布 Kimi K3——史上规模最大的开源模型,一上线就兼容主流智能体编程工具;Thinking Machines(Mira Murati、John Schulman、Barret Zoph 创办)以 Apache 2.0 协议发布 Inkling——美国实验室首款从设计之初就为驱动智能体而生的开源多模态模型;OpenAI 推出 ChatGPT Work——把 Operator、Deep Research 与 Workspace Agents 整合为一个统一入口的办公智能体;Prime Intellect 完成估值 10 亿美元的 A 轮融资,用于其面向企业的智能体训练平台;Anthropic 也作出回应——Sonnet 5 上线,Claude Cowork 同步扩展至网页和手机端。
🔥 头条
01
中国发布全球最大开源模型——一上线就能对接主流智能体编程工具
每个 AI 助手的背后,都有一个「模型」——一个用海量数字训练出来、能识别并生成语言的巨型文件。中国创业公司 Moonshot AI(阿里是其投资方之一)刚刚上线了 Kimi K3:参数量达到 28000 亿,上下文窗口高达 100 万 token(足以一次性吞下整个大型软件项目),并在发布之时便声明兼容市面上主流的智能体编程工具——Codex、Claude Code、Cline、RooCode——通过与 OpenAI API 格式一致的接口访问,地址为 api.moonshot.ai/v1。完整模型权重将于 7 月 27 日发布。该模型同时支持图像理解,因此可以直接向智能体发送截图,无需事先做格式转换。对于搭建智能体的人来说,这是构建可控成本、开放权重技术栈的一块有力候选(中国玩家正在把 100 万 token 这条边界往前推,而美国模型常常还停留在更短的上下文)。现实代价也不低:28000 亿参数跑起来,电费账单远非一台桌面小模型可比。迁移到生产之前,先在真实长任务上跑通验证;但信号已经清晰:当美国闭源模型越来越贵,中国正在用开放权重把能力分发出来。
02
一款能同时看懂文字、图像和音频的开源免费模型——出自几位前 OpenAI 成员之手
Thinking Machines Lab——由三位 OpenAI 前成员 Mira Murati、John Schulman 与 Barret Zoph 共同创办的初创公司——刚刚以 Apache 2.0 协议发布了 Inkling,这是一份真正无商业限制的开源许可。模型总参数量为 9750 亿,但每次推理时只激活其中 410 亿(采用「专家混合」架构——这一类模型对每个问题只动用一小部分「神经元」)。上下文窗口同样达到 100 万 token,并原生支持文字、图像与音频的理解。明牌的赌注是:Inkling 不一定在所有指标上拔得头筹,但它开源、可修改、并附带一份说明如何针对具体业务做定制开发的文档。它是一块地基——企业可以拿来搭建自己的专属智能体,不必为底层模型支付授权费。硬币的另一面是:即便是紧凑版本,依然需要约 600 GB 的显存——相当于半打高端显卡的容量。换句话说,这款模型不会跑在普通中小企业的机房里:要么走云服务商,要么等更小的版本。此外 而言,启示很直接:「开放」重新成为卖点,但「托管」依然是需要算清账的成本项。
03
OpenAI 推出整合一切的办公智能体——正面迎战 Claude 与 Copilot
如今一个员工要做一份演示或一份汇总材料,往往要把大量时间花在邮箱、表格、内部文档和浏览器之间来回切换。OpenAI 于 7 月 9 日宣布 ChatGPT Work:一款把这套多应用上下文聚合起来的智能体,可以按需产出文档、表格、演示文稿,甚至简单的网页。具体做法是:你描述想要什么,智能体去已授权的工具里抓取相应数据,再交回一份可以直接复核的成果。模型底座是 GPT-5.6,可在网页和手机上使用,覆盖 Pro、Enterprise 与 Edu 三档订阅。这次发布把近几个月独立推出的三款产品——Operator、Deep Research 与 Workspace Agents——并入了同一个统一入口。对项目负责人来说,价值有两层:要学的工具少了,而智能体懂得每个用户的权限边界(销售员只能看到他有权看到的内容)。在市场上,这等于直接回应 Anthropic 的 Claude Cowork 与微软的 Copilot Agents——办公智能体之战已经打响。IPO 之前值得一提的背景:美国银行已向 OpenAI 提供了 5.2 亿美元贷款以支撑这盘棋。
04
1.3 亿美元押注:让 AI 智能体在企业真实业务上练出来
总部位于旧金山的初创公司 Prime Intellect 于 7 月 16 日宣布完成 1.3 亿美元 A 轮融资,由 Radical Ventures 领投,Nvidia Ventures、Intel Capital、Dell Technologies Capital 与 Iconiq 跟投。公司估值达到 10 亿美元。其平台提供一整套能力:训练模型所需的算力、一套强化学习工具(一种让智能体在真实业务案例上反复试错、逐步改进的训练方法),以及评估工具,用于判断智能体是否真的胜任所交付的业务。赌注说得很直白:让每家企业都能在自有业务上「自建 AI 实验室」,不必依赖通用型供应商。本轮还出现一批明星个人投资者——Srinivas(Perplexity)、Levie(Box)、Weinberg(Harvey)、Wang(Cognition)、Foody(Mercor)——足见其背后的关系网络。此外 而言:值得密切关注,这正是可以在完整撰写规格之前,先用来小范围试验、为情报或分析类工作流定制智能体的平台类型。
05
Anthropic 反击:Sonnet 5 上线,Cowork 同步登陆网页与手机——瞄准日常智能体工作流
Anthropic 于 6 月 30 日发布 Sonnet 5,并将其定位为「迄今为止最具智能体能力的 Sonnet」——通俗讲,这是一款为在外部工具上编排动作链而量身定做的模型。自 7 月 7 日起,Claude Cowork——承载这些智能体工作流的界面产品——从桌面端扩展到网页和手机端,并从 Max 套餐开始逐步开放。一项「月度回顾」功能也已于 7 月 9 日进入内测。定位非常清晰:Anthropic 瞄准的是可重复运行的日常智能体工作流的成本可控性,正面竞争对象是 OpenAI 的 ChatGPT Work 与微软的 Copilot Agents。对用户而言,看得见摸得着的差别体现在持续运行的能力上:Sonnet 5 在更长的任务链上不轻易掉线,Cowork 也能在日常设备上使用了。此外 来说,这是智能体技术栈选型时需要纳入的一个信号——在需要长时间稳定运行、又不能把 API 预算打穿的场景下,Claude 依然是严肃选项之一。当前唯一的门槛是订阅档位——网页与手机端的 Cowork 需要相应订阅才能解锁。
📡 值得关注
中国搭建替代版 AI 治理框架——上海周边已有 29 国入局
2026 年 WAIC 于 7 月 18 日在上海开幕,与会同时还出现一个极具地缘政治意味的动作:成立 WAICO——一个由 29 个国家共同组成的国际 AI 治理组织。解读:中国不再等待美国来定义规则,而是与盟友一道另立框架。值得观察:未来 30 至 60 天内还会有哪些国家加入,以及这个阵营会演变成什么形态。
DeepSeek V4 公布新定价——并将于 7 月 24 日下线旧版模型
DeepSeek 已于 7 月中旬公布 V4-Pro(16000 亿参数,每次激活 490 亿)与 V4-Flash(2840 亿参数,每次激活 130 亿),两款均提供 100 万 token 的上下文窗口,并采用峰谷分时定价,高峰时段价格翻倍。启用缓存(一种避免重复处理相同问题的机制)后,Flash 版本成本下降 80%,Pro 版本下降 92%。此前的 deepseek-chat 与 deepseek-reasoner 模型标识符将于 7 月 24 日 15:59 UTC 起停用——仍在使用它们的智能体必须完成迁移。
NVIDIA 提出新的衡量单位:不再是单个 token,而是每一美元投入的成功率
NVIDIA 在 7 月中旬发布的一份宣言中主张:对智能体系统而言,核心衡量指标已不再是单个 token 的成本,而是每一美元算力投入所换来的成功次数,并把强化学习在训练后阶段带来的增益纳入考量。新一代 Vera Rubin GPU 与 NeMo Gym、NeMo RL 一起,被定位为支撑这一闭环的基础设施。此外,应纳入关于算力性价比的 FinOps 考量。
Bunkerhill Health 为医疗智能体融资——累计 5500 万美元(数字待核实)
Bunkerhill Health——一家为美国医院和医疗系统提供智能体工具的初创公司——于 7 月中旬宣布完成一轮融资,由 Sequoia Capital 领投,Felicis、Optum Ventures 与 Y Combinator 跟投。估值 3.67 亿美元。提醒:所披露的 5500 万美元口径可能为累计融资(种子轮 + A 轮 + B 轮合并),具体本轮数额仍有待确认。此外,这是一个面向高潜市场(医疗)垂直智能体的好范例,可与法国本土同类项目做对比。
📊 趋势
2026 年 7 月 19 日,AI 智能体生态用一个星期消化了一连串结构性转折:Moonshot AI 发布 Kimi K3——史上最大的开源模型,一上线就兼容主流智能体编程工具;Thinking Machines 推出 Inkling——美国实验室首款基于 Apache 2.0 协议、从设计之初就为驱动智能体而生的多模态模型;OpenAI 上线 ChatGPT Work——把 Operator、Deep Research 与 Workspace Agents 整合为一的统一办公智能体;Prime Intellect 完成估值 10 亿美元的 A 轮融资,提供面向企业的完整智能体训练平台;以及 Anthropic 的反击——发布 Sonnet 5,并把 Cowork 扩展到网页和手机端。对那些打算靠智能体挣到收入的人来说,浮现出四点启示。(一)办公智能体之战已全面开打——OpenAI(ChatGPT Work)、Anthropic(Cowork)与微软(Copilot Agents)正面交锋,把既有产品整合为统一入口正成为新的标准动作。(二)开放模型重新成为商业卖点——中国一侧是 Kimi K3,美国一侧是 Apache 2.0 协议下的 Inkling:两种开放路径,但传递出同样的信号:封闭已不再是主流位置。(三)100 万 token 上下文窗口成为新基准——Moonshot 与 Thinking Machines 同步推动这条边界,对那些要在长周期项目上工作的智能体来说,这是真正的能力跃迁。(四)企业级智能体平台的融资规模正在爆掉——Prime Intellect 估值 10 亿,Bunkerhill 深扎医疗:高潜市场垂直方向吸引的支票越来越大。