最新简报
2026 nian 7 yue 9 ri · 5 actus (site) · 6 actus (base)
今天你跟 Siri 或客服机器人对话时,你已经学会它说话的时候你保守默 - 不然它听不见你。就像对讲机:按下键,说话,松手,对方说。于 2026 年 7 月 8 日,OpenAI 推出了 «GPT-Live»,一代新语音代理人他们打破了这个规则:他们听的同时也会答,就像两个人类之间真正的对话。你甚至可以强注一个小位 «呵» 去提醒他们,不会打断他们。原理:两层 AI 并行运行 - 快速一层负责语音交互,深层 GPT-5.5 在背后准备答案。结果:每周 1.5 亿人已经用聊天机器人的语音功能,所以所有客服热线、酒店预订、银行客服都必须复制这个架构,要不然就...
🔥 头条
01
OpenAI 发布 GPT-Live:对话机器人结束“对讲机”时代,你的语音助手现在说的同时也在听
今天你跟 Siri 或客服机器人对话时,你已经学会它说话的时候你保守默 - 不然它听不见你。就像对讲机:按下键,说话,松手,对方说。于 2026 年 7 月 8 日,OpenAI 推出了 «GPT-Live»,一代新语音代理人他们打破了这个规则:他们听的同时也会答,就像两个人类之间真正的对话。你甚至可以强注一个小位 «呵» 去提醒他们,不会打断他们。原理:两层 AI 并行运行 - 快速一层负责语音交互,深层 GPT-5.5 在背后准备答案。结果:每周 1.5 亿人已经用聊天机器人的语音功能,所以所有客服热线、酒店预订、银行客服都必须复制这个架构,要不然就是上个时代的古董。对于部署了电话代理人的公司,这就是要集成的新技术标准。
02
xAI 与 Cursor 推出 Grok 4.5:一个培训在数百万程序员真实交互上的 AI 模型(不只会写代码)
象一个汽车制造商他们想制造一款理想中的车 - 他们在实验室试验的同时,还将试车交给出租车驶驶的司机开一年,看看他们怎么用,哪里碎掉,哪里必须改进。xAI(Elon Musk 的公司)和 Cursor(世界数百万程序员在用的写代码工具)就这么做了。于 2026 年 7 月 8 日发布了 Grok 4.5,这是一个培训在上万亿次程序员真实交互上的 AI 模型。但是惊喜:它不只用于写代码!还能用在金融、法律、数据分析、多日长期任务里。今天就能在 Cursor 里面用到,价格是每 100 万个输入词 2 美元,输出词 6 美元。首例反馈:Cursor 订阅者的使用频度在一周内翻了一倍。对于一个技术团队,这是一个 «即拿即用» 的新模型,可以替代多个专业工具。
03
SambaNova 融资 10 亿美元并与起始于银行 JPMorgan 签订:银行要自己的 AI 机器,而不是 OpenAI 的
你把钱存银行时,你肯定更愿意看到管你账户的系统就跑在银行里面 - 在厚重的墙壁后面 - 不是在一个人不知道在哪里的远处服务器上。于 2026 年 7 月 8 日,加州公司 SambaNova (专门制造 AI 运行芯片)宣布一轮大融资 - 10 亿美元,公司估值五个月翻一番。同时,他们与美国最大的银行赵企起始于签下合作协议:赵企起始于会在自己总部安装 SambaNova 的机器,跑自己的 AI 代理人,而不需要传递敏感数据出去。对于一家银行、保险、医院或部门来说,这是一个重要趋势的开始:«主权 AI 基础设施»(无论是挪威、畮北克、法国还是其他»在本地跑,不依赖于美国云。对平民来说,这经常是个好消息:你的银行数据现在可以让 AI 处理,而不需要脱离本国。
04
一家美国社区小银行把 40% 贷款审批交给 AI 代理人 - 人类仍然拿着方向盘
你去银行申请贷款 - 买车,买房子 - 现在是一个银行员审核你的申请材料,另一个评估风险,又一个准备合同。美国超过 2,400 家社区小银行使用一家叫 Abrigo(总部在北卡罗来纳州)的软件。于 2026 年 7 月 8 日,Abrigo 发布了 APX,一个新平台:«代理人舰队»协作自动化这个全过程 - 采集申请、交叉检查、准备报价、跟踪还款。关键点:每一步都记录在可被银行监管机构查阅的日志里,人可以随时接手。预计成果:人工处理工作减少 40%。对于一个经纪人、贷款专员、银行高管,这是一个信号:专门面向某一个行业的 «垂直» 平台已经成熟起来,超越了“什么都能做”的演示。
05
OpenAI 审计了一套 «写代码 AI» 的考试:几乎三分之一的考题都是坏的
当不人说 «这个 AI 模型与一位高级工程师一样强» 时,背后通常依赖一些公开的考试套题。最常用的之一叫 SWE-Bench Pro。问题是这样的:于 2026 年 7 月 8 日,OpenAI 做了一件值得赞赏但也尴岈的事 - 对这个考试底子进行审计。结果:731 道题里大约 30% 都是坏的(题目误度、「正确答案」实际不正确、检验未准、检验过严、检验过松)。OpenAI 撒销了原本介绍这套考试的建议,邀请产业伙伴在经验超过三十年的工程师参与下制定更好的考题。对于一家选型给自己开发团队的公司考,这是一个猛烈的提醒:该考试中市面上贵史科技、Anthropic、Google、OpenAI、xAI 、DeepSeek 发布的成绩数据都有一部分是人为。原本的 «谁的 AI 写代码最牛» 现在是 «谁的 AI 在剩下的题里错最少»。
📡 值得关注
商业语音代理人会在 60 天内采纳 OpenAI 的 full-duplex 架构吗?
Vapi、Retell、Bland 这些公司为企业制作语音代理人(酒店预订、客服、预约)。如果他们在 2026 年 8 月底前集成同时听与说,市场标准就会改变,GPT-Live 成为考量。如果不,OpenAI 保持一年的领先。观察点:这些平台未来 30-60 天的 changelog。
同一天发布两个业务垂直的“代理人舰队”平台 - 信号还是并发?
8 月 8 日,Abrigo 发布了银行贷款平台,Akeneo 发布了产品信息管理(PIM)的代理人层。两个经验沉淀的业务垂直商同时采用同一模式。如果在 14 天内出现第三个业务垂直平台(医疗、法律、物流),那是真的市场趋势。如果什么都没有,只是并发。
OpenAI 对 SWE-Bench Pro 的审计会成为新的行业标准吗?
OpenAI 于 7 月 8 日公布了审计方法。问题是 Anthropic、Google DeepMind 和 Cursor 会不会逆向公布他们自己内部考题的审计。如果会,这是一个新的行业洁痴。如果不会,OpenAI 可能会因为它的透明度努力反而看起来像 «唯一自我批评的公司»。
JPMorgan 之后还会有多少银行或保险与 SambaNova 签约?
JPMorgan 与 SambaNova 公告背后还带着一位 Qatar Investment Authority 的投资者。这是一个信号,国际金融圈重视 «本地 AI» 的发展。如果 2026 年底前还有 2-5 个其他大名字(银行、军事、医疗)跟进,就能形成一个 300-500 亿美元的投资垂直。只有 JPMorgan 一家可能是个例外。
Akeneo Agentic Ziggy 在交易中:谁会领先签约?
Akeneo 于 8 月 8 日发布了 Agentic Ziggy。这是产品信息管理的代理人编排。它作为一个点重交易垂直的平台,面对 Google Shopping Optimization 和 ChatGPT Shopping 重新定义产品可见性的市场。未来 30 天内的首批零售商或品牌签约将验证或拒绝 «垂直型代理人舰队» 是否成为交易的新标准。观察点:Akeneo 客户的升级公告、Pimcore、Informatica、Salsify 的应对。
📊 趋势
2026 年 7 月 9 日,代理人型 AI 三条重要轴心同时出现。首先轴心:语音变得自然 - OpenAI 发布 GPT-Live ,时说时听上去,打破 walkie-talkie 隔阂,为下一代企业语音代理人提供技术蓝图。第二个轴心:模型不再是孤立产品 - xAI 与 Cursor 联合发布 Grok 4.5,培训期由真实使用数据付费,并由领先代理工具商独家分发,相当于代理人时代的 «Microsoft-OpenAI » 结算。第三个轴心:基础设施垂直化 - SambaNova 融资 10 亿并与 JPMorgan 签订把 AI 贯在银行墙壁后,Akeneo 与 Abrigo 同一天上线交易与信贷两大垂直的 «代理人舰队» 平台。共同点:从 «演示» 走向 «生产环境平台»。同时背后,OpenAI 还做了一件罕见的透明事情:公开审计一个参考的考试,指出 30% 的题都是坏的,邀请产业作出更好的表现。一句话总结:2026 年的 AI 代理人不再是什么 «玩具» - 是临界基础设施,驱使供应商既要强(模型遵量)、要可靠(考题遵量),又要垂直可见(垂直平台),还要尊重本地约束(本地部署)。明天的观察点:B2B 语音代理人接受度、Anthropic 与 Google 审计响应、赵企起始于之后的银行签约。