OpenAI 公开首款自研推理芯片
OpenAI 公开首款自研推理芯片,专为运行自家 GPT 模型而设计。结果:每瓦特文本生成量比当前最强 NVIDIA 芯片多 50%,速度提升三倍。对普通用户而言,数月后向 AI agent 提出复杂问题时,响应更快,成本更低。2026 年底小批量部署,2027 年全面铺开。数据尚未经独立实验室核实。OpenAI 称采用「量身定制」方式,芯片与模型协同优化。
2026年8月26日 · 5 条新闻
OpenAI 公开首款自研推理芯片,专为运行自家 GPT 模型而设计。结果:每瓦特文本生成量比当前最强 NVIDIA 芯片多 50%,速度提升三倍。对普通用户而言,数月后向 AI agent 提出复杂问题时,响应更快,成本更低。2026 年底小批量部署,2027 年全面铺开。数据尚未经独立实验室核实。OpenAI 称采用「量身定制」方式,芯片与模型协同优化。
Google 与四家全球顶级律所(Cleary Gottlieb、Freshfields、Weil、Williams & Connolly)合作。这些律所将采用 Gemini Enterprise for Legal,即 Google 首个律师专用 AI agent。它能在数秒内读完合同,从数百万文档中检索判例,并自动生成答辩要点。若 agent 10 秒完成初级律师 2 小时的工作,节省的成本相当可观。直接对手是 Harvey(已服务多家律所)与 Anthropic。这清晰预示法律市场已成为 AI 下一片主战场。
Okta(身份管理专家,2 万家企业客户)发布 Agent SSO。每个 AI agent 如今拥有独立身份与专属权限,企业可实时查看其操作,也可远程一键关停。Okta 同时披露:仅 34% 企业以管理人类员工的同等严谨度对待 agent。配套发布的开放协议 XAA(Cross App Access),用于统一企业间 agent 通信。这标志着 agent 正迈向生产部署,亟需配套访问管控。
Keenable(旧金山)走出隐身模式,完成 Accel 领投的 2600 万美元种子轮。创始人包括前 Yandex Search CEO 与前 Amazon AGI 首席科学家。公司提供覆盖 1000 亿文档的索引,专为 agent 高频查询设计。免费额度为每小时 1000 次查询。直接对手有 Tavily、Exa、Perplexity Search API,Keenable 宣称全面超越。这表明 agent 真正瓶颈已从模型转向实时信息获取能力。
OpenAI 捣毁一个由俄罗斯经 VPN 操控的 ChatGPT 集群。行动推广名为「国际 Burke 研究所」的伪智库,并在 X、LinkedIn、Facebook、Substack、Telegram 散播反欧盟德语内容。另有 34 篇学术文章被复制后伪造署名。这是 OpenAI 第九次官方披露,俄罗斯成为第四个被记录在案的挪用西方大模型的国家级行为方。
用户无需每次重新向 AI 说明背景:聊天中提及的内容会自动同步到 Cowork 工作区,反之亦然。Free、Pro、Max 版默认开启。敏感话题默认排除在外。
中国巨头阿里巴巴以预览版形式预热下一款模型,为 Qwen 4 蓄势。开发者有几周时间准备接入。中国阵营的发布节奏依然是周更。
Z.ai 计划在 2026 年 8 月 28 日前后发布 GLM-5.3,将成为本窗口期内首个权威开放权重实验室。重点关注 MIT 协议是否最终确认。
随 Agent SSO 一同发布的还有开放协议 XAA(Cross App Access),目标是统一企业间 agent 与 agent 的通信标准。
三个信号指向同一方向。(a) OpenAI 像匠人按客户脚型缝鞋一样,为自家模型量身定制芯片。(b) Okta 承认 agent 需要像员工一样佩戴通行徽章。(c) Google 武装全球顶级律所。对于不知从何入手的企业,可先思考:哪五项内部流程可放心交给 agent,以及应授予其哪些精确权限。这已是董事会层面的议题,不再只是 IT 部门的事。