每日简报
2026年9月23日 · 5 条新闻
🔥 头条
1研究人员 发现 首个 「 会 是 人工智能 代理 的 恶意 程序 」 — 它 自己 做 决策
思科 Talos 在 周二 发布 了 一份 关于 一种 前所未有 的 恶意 程序 的 分析:一个 16 兆字节 大小 的 软件,潜伏 在 Windows 系统 中,它 决定 下一步 要 做 什么 时 — 盗取 密码、翻找 加密 钱包、进一步 渗透 电脑 — 已经 不再 等候 人类 的 命令。它 会 咨询 由 四家 商用 人工智能(DeepSeek、Qwen、Mistral、Gemini)组成 的 小组,收集 它们 的 意见,再 以 多数 票 做出 决定。对 普通 公众 来说,这 就像 是 一名 入室 窃贼,不再 通过 电话 等待 老 大 的 命令,而是 在 每次 行动 之前 先 咨询 专家组 的 意见 — 并且 即便 老 大 在 睡觉,它 也 会 继续 工作。这 是 首次 有 公开 记录 显示 Windows 上 出现 了 这样 的 模式。来源:https://blog.talosintelligence.com/the-closed-quorum-inside-the-first-reported-autonomous-ai-c2-implant/
2Anthropic 发布 Claude Opus 5.5:能力 持平 前代,运行 成本 却 降低 40%
Anthropic 在 周二 正式 上线 Claude Opus 5.5,作为 新 一代 的 首款 模型,它在 大多数 任务 上 达到 了 此前 最佳 模型 的 水平,但 企业 运行 它 的 成本 降低 了 40%。按 字 计费:每 百万 个 读取 的 字 4 美元,每 百万 个 生成 的 字 20 美元(之前 分别 为 5 和 25 美元)。在 Terminal-Bench(一项 让人工智能 自主 编写 代码 并 修复 缺陷 的 测试)上,它 的 成功率 达到 66.4%,超过 了 OpenAI 的 GPT-6 Astra(57.9%)和 Anthropic 上一代 模型(55.8%)。对 普通 用户 来说,可以 把 它 想象 成 一位 助手:过去 处理 一份 文件 要 花 一杯 咖啡 的 价钱,现在 只 用 三分之二 的 价格 就能 办 到 同样 的 事,而且 做得 更好。来源:https://anthropic.com/news/claude-opus-5-5
3OpenAI 推出 GPT-6 Sol 与 Luna:GPT-6 系列 补齐,价格 仅为 上代 一半
在 Anthropic 之后 仅仅 几个 小时,OpenAI 也 补齐 了 它 的 GPT-6 系列(九 月 初 已经 用 Astra 揭幕),一次 发布 两款 新 模型。Sol 面向 编程 和 自主 工作:读取 每 百万 字 2 美元,生成 每 百万 字 10 美元 — 价格 是 上代 的 一半。Luna 是 极致 低价 版本,价格 降至 0.10 和 0.50 美元。在一项 针对 编程 代理 的 基准 测试 中,Sol 以 80 分 拿下 第一 名,而且 用 的 字 数 只有 一半,时间 只有 一半,成本 大约 只有 三分之一。对 普通 公众 来说,这 好比 一家 航空 公司 同时 推出 一张 标准 价位 的 商务 票 和 一张 几 美分 的 经济 票:最 贵 的 票价 依然 贵,但 整个 客舱 突然 变得 负担 得起。来源:https://www.testingcatalog.com/openai-launches-faster-cheaper-gpt-6-sol-and-luna/
4小米 把 一款 巨型 人工智能 模型 开源 — 附带 7000 个 代理 训练 场
小米 在 周二 以 MIT 许可证 公开 发布 它 的 新 一代 MiMo-V2.6 系列,包含 两款 模型:Pro,拥有 10200 亿 个 参数,但 每次 处理 一个 问题 只 激活 42 个;以及 更 紧凑 的 Flash(共 3090 亿 个 参数,其中 15 个 处于 激活 状态)。两者 都 支持 文本、图像、声音、视频,能 一次 读 入 一整 本 厚 小说 的 内容。但 更 重要 的 是:小米 同时 公开 了 超过 7000 个 训练 环境,供 人工智能 代理 练习 — 可以 修复 代码、复现 安全 漏洞、构建 网站。对 普通 公众 来说,这 好比 一所 学校 免费 同时 开放 教材 和 操场:任何 人 现在 都 能 借助 巨头 们 同样 的 工具 来 训练 自己 的 数字 助手。来源:https://mimo.mi.com/docs/news/latest/v2-6
5DeepSeek 获邀 在 联合国 安理会 阐述 人工智能 风险 — 中国 实验室 首次
在 即将 到来 的 周三,联合国 安理会 召开 关于 人工智能 风险 的 第二 次 正式 会议 — 第一 次 还要 追溯 到 2023 年。这次,各家 实验室 坐 在 谈判 桌 前:山 姆 · 奥尔特 曼(OpenAI)亲赴 现场,Anthropic 派出 高管,而 DeepSeek — 那家 在 2025 年 1 月 以 R1 模型 震惊 全球 的 中国 实验室 — 提交 了 一份 书面 文本。其 创始人 梁 文锋 没有 出差,但 这 一 姿态 仍 具有 历史 意义:一家 中国 实验室 首次 在 最高 层面 进入 关于 人工智能 风险 的 多边 讨论。对 普通 公众 来说,这 好比 中国 的 汽车 制造商 多 年 来 对 安全 标准 保持 沉默,终于 同意 来到 全球 讲坛 上 讨论 安全 气囊 和 安全 带。来源:https://www.straitstimes.com/asia/east-asia/deepseek-to-brief-un-security-council-on-ai-this-week-sources-say
📡 值得关注
阿里 发布 自研 「 中国 制造 」 人工智能 芯片,2032 年 前 数据 中心 容量 达 20 吉瓦
这家 中国 云 巨头 在 周二 推出 了 它 的 新 一代 芯片 Zhenwu V900,号称 比 上代 性能 提升 三倍。计划 在 2027 年 第一 季度 进入 量产。阿里 目标 在 2032 年 前 拥有 20 吉瓦 的 算力 容量 — 在 中国 国土 上 提供 一套 替代 英伟达 的 本土 方案。「 三倍 性能 」 这一 数字 尚未 经过 独立 测试 验证。来源:https://www.bloomberg.com/news/articles/2026-09-22/alibaba-unveils-ai-chip-to-drive-20gw-of-data-centers-by-2032
Snorkel AI 融资 3.5 亿美元,向 人工智能 实验室 出售 「 原材料 」
这家 由 斯坦福 研究 人员 创立 的 加州 创业 公司,向 大型 实验室 销售 现成 的 训练 数据 集 和 模拟 环境,供 它们 测试 自己 的 代理。17 个月 内,其 估值 翻 三倍 至 35 亿美元,年化 收入 在 一年 内 增长 了 18 倍。对 普通 公众 来说,这 好比 一家 农场 现在 同时 给 所有 汽车 制造商 提供 种子 和 试验 田:没有 它,就 没有 新 模型。来源:https://snorkel.ai/blog/snorkel-ai-raises-350m-series-e-at-3-5b-valuation
xAI 的 Grok 4.7:价格 不变,但 更 快,更 擅长 长时间 独立 编程
xAI 在 周一 上线 Grok 4.7,价格 与 上代 持平(读取 每 百万 字 2 美元,生成 每 百万 字 6 美元)。它 已经 接入 Cursor 编辑器,并 通过 Grok Build — xAI 自家 的 命令 行 界面 — 供 用户 使用。它 的 承诺 是:在 困难 任务 上 花 更 多 时间,并 更 仔细 地 检查 自己 的 工作。厂商 声称 「 比 同类 模型 快 一倍,价格 只有 一半 」 — 这 一 数字 还有 待 独立 测试 验证。来源:https://x.ai/news/grok-4-7
9 月 23 日 周三,联合国 安理会 召开 人工智能 正式 会议
这 是 安理会 第二 次 以 正式 形式 讨论 人工智能 风险。山 姆 · 奥尔特 曼(OpenAI)预计 抵达 纽约,Anthropic 也 将 派 代表 出席。中国 一方,DeepSeek 与 月之 暗面 已 获邀 提交 书面 材料 — 其 代表 是否 出席 仍 待 确认。此次 讨论 可能 重新 调整 未来 几 周 「 人工智能 节奏 外交 」 的 各 项 指标。来源:https://www.straitstimes.com/asia/east-asia/deepseek-to-brief-un-security-council-on-ai-this-week-sources-say
📊 趋势
9 月 22 日 将 作为 人工智能 代理 领域 一个 转折 日子 被 铭记。三大 西方 顶尖 实验室 在 短短 几 小时 内 接连 发布 更 强大、且 价格 最高 降低 50% 的 新 模型(Anthropic Opus 5.5、OpenAI GPT-6 Sol 与 Luna),对 整个 生态 系统 的 利润 空间 形成 巨大 压力。中国 则 在 两个 战线 上 做出 回应:小米 把 一款 巨型 模型 与 其 训练 场 一同 开源,阿里 则 押注 一款 100% 国产 芯片,以求 摆脱 对 英伟达 的 依赖。安全 方面,最 引人 注目的 消息 来自 思科 Talos:研究 人员 首次 记录 到 一款 通过 咨询 商用 人工智能 小组 来 制定 战术 决策 的 恶意 软件 — 相比 编程 工具 中 那些 单纯 的 漏洞,它 又 向前 跨 了 一 步。最后,联合国 安理会 明日 召开 会议,并 首次 邀请 一家 中国 实验室 正式 就 风险 议题 发言。对 普通 公众 来说,信号 已经 清晰:人工智能 代理 不再 是 演示 阶段 的 话题,它们 已经 成为 国际 安全、贸易 战 与 外交 政策 的 议题。