每日简报
2026年8月5日 · 5 条新闻
🔥 头条
01能装进口袋的 AI 智能体:Liquid AI 发布 26 亿参数的小型大脑,免费下载
想象一个不需要连接远端服务器的助手:它直接在您手机里思考,仅占用不到 2.5 GB 内存。这就是 Liquid AI 刚刚发布的 LFM2.5-2.6B 模型,专门为驱动智能体而训练——挑选合适的工具、把任务拆成步骤、调用其他软件、最后拼装答案。在高端 Mac 上每秒 220 个词,普通智能手机上每秒 30 个词。按官方公布的基准测试,它在遵循指令和工具使用上跑赢比它大三四倍的模型。免费权重今天就上线 Hugging Face,无论好奇的开发者还是不想被云端 API 绑架的中小企业都能直接用。
02蚂蚁集团开放一个超轻量中国模型(1240 亿参数,每次只激活 50 亿),MIT 许可证
中国巨头蚂蚁集团的开放源代码分支 InclusionAI 周二发布 Ling-3.0-flash的完整权重。看似矛盾:总参数 1240 亿,但每次回答只激活 50 亿——一个按需唤醒的专家集合。混合架构,262 000 token 上下文窗口,MIT 许可证无任何限制。明确定位:智能体工作负载(使用工具、执行多步骤计划、串联软件调用)。它原生接入智能体开发者常用的 harness:Claude Code、Hermes Agent、OpenClaw。简单说:一个让您在长序列上跑智能体、又不被厂商锁定的免费新游乐场。
03手机摄像头变身自主视觉智能体:NewEyes 能扫描、能推理、能行动
把手机对准一个场景,NewEyes 应用不只描述它看到什么,而是接续执行一连串动作:扫描您的衣柜告诉您缺哪件、读停车牌提醒您挪车、离开房间之前把手绘草稿变成一个网站。这是 Collov Labs 押注的方向,自今年早些时候 2300 万美元 A 轮融资后的第一个大众消费产品。处理一部分跑在手机自带的神经芯片上(Qualcomm Hexagon),不必把内容全送云端。已经支持 Meta Ray-Ban 智能眼镜的 beta 版。如果您觉得纯文本智能体太乏味:在物理世界里行动的 AI,从眼睛开始。
04Nimble 发布网页搜索智能体:token 消耗直接减半
当一个 AI 智能体把全部时间花在为用户搜网页上,账单涨得飞快。Nimble 推出一个能学习企业业务领域(销售、市场、财务、客服)并相应调整搜索策略的搜索智能体。官方承诺:每次查询消耗的 token 不到一半,回答质量反而提升 21 分。首个点名客户:AI 原生 CRM 厂商 Rox,宣布接入后智能体成本下降 20 倍。通过标准 API 或 MCP 连接器即可作为工具接入。对于正在规模化部署智能体的中小企业来说,这是降低月度账单的切实路径。
05一家 AI 算力新云拿到 3 亿美元,要做小创业公司的 GPU 房东
Volta Infra Holdings 周二正式浮出水面:3 亿美元股权融资、50 亿美元结构性融资包、以及一项 100 亿美元、为期 6 年的合作,将在挪威建设一座 AI 算力中心。资本桌上:Andreessen Horowitz 与 Altimeter 联合领投,加上 Nvidia 和 Michael Dell 的家族办公室。目标客户群命名为「little tech」——那些需要海量算力、但又没有足够资产跟 Microsoft 或 Amazon 签多年合同的 AI 创业公司。Volta 扮演中间商:买入 Nvidia 芯片、出资建设数据中心,再按小时或按月转售算力。对于苦于找不到 GPU 资源的欧洲实验室来说,这是基础设施供给端进一步多元化的又一信号——不再只有那三家云巨头。
📡 值得关注
自愿网络安全测试框架:白宫召集 OpenAI、Anthropic、Google 和 Meta
8 月 4 日会议目标敲定一项政府提前获取前沿模型做测试的协议。官方文本尚未发布——本周密切关注。
Ling-3.0-flash 数字:本周将放出稳定版本
目前的分数来自一个启用了思考模式的「release candidate」。InclusionAI 应当发布一张表,把这些数字对应到 OpenRouter 上服务的最终模型。
NVIDIA 8 月 26 日发布季报
Volta/Nvidia 的动量将受检验:公司在向新云垂直整合 GPU 方面下了重注。关注数据中心业务的指引。
9 月特朗普-习近平峰会:中国开源权重模型可能迎来转折点
被多位分析师(Samm Sacks、New America)提名为美国对中国实验室限制可能发生转折的节点。
📊 趋势
本周两条暗流交叉。一方面,「agent-as-black-box」链条树立了新的方法论标准:Liquid AI 在做智能体强化学习时,把 Claude Code、Hermes Agent、OpenClaw 这些智能体 harness 当作黑盒,原样捕获其轨迹;InclusionAI 在集成侧遵循完全相同的逻辑。另一方面是「基建许可」:Volta 募资 3 亿美元替年轻实验室购买 Nvidia GPU,白宫则在同步制定前沿模型访问规则。对于智能体构建者,启示很清楚:推理在压缩(模型装进口袋)、harness 成为参照点、而物理基础设施本身成为治理议题。把这三扇窗口都记在心里,规划未来半年。