LEION · DAILY AI 第 73 期 · 2026-09-19 · 周六

Agent 走向生产级,端侧与具身同步突破

第 73 期聚焦:Agent 框架收敛于生产级原语;端侧 AI 手机与主动智能 OS 同周落地;具身世界模型密集开源并验证 scaling 路径。

01 / 05

Claude Code 与 LangChain 同日更新,Agent 框架收敛于生产级原语

AI Agent Claude Code LangChain 生产化
事件

Anthropic 于 9/18 发布 Claude Code v2.1.277,强化无头/SDK 会话可靠性、插件与市场完整性、会话成本记账保留;新增 AGENTS.md 项目指令支持、网关出口边界 flag(CLAUDE_GATEWAY_PROXY_IS_EGRESS_BOUNDARY)与沙箱排除,缩小不安全行为面。同日 LangChain 发布 v2.45.0,补齐 durable runs、MCP/持久会话、工具历史保留与按 run 计费的用量上报。

关注理由

主流框架正在收敛到同一组生产原语:工具/插件注册表与签名、沙箱化执行、可恢复运行、按 run 的遥测与成本归因、网关出口管控。这标志 Agent 从原型验证转向可审计、可规模化的生产部署,治理与可观测性成为一等公民而非附加项。

02 / 05

努比亚 NaviX Ultra 开售,全球首款量产 AI 智能体手机

终端智能 AI 手机 GUI Agent 端侧
事件

中兴旗下努比亚 9/16 开售 NaviX Ultra,搭载字节豆包手机助手(消费者版 9/14 发布)。其系统级 GUI Agent 架构可理解屏幕内容、跨应用模拟点击滑动完成多步任务;核心模型算力全端侧运行,并改采标准化的 MCP 与 A2A 协议接入超 10 家合作平台(抖音、美团、滴滴等)。

关注理由

这是 AI 手机从"装模型"转向"替人办事"的拐点信号——手机从被动应答进化为能理解场景、跨应用执行的个人智能体。端侧运行降低隐私风险,MCP/A2A 取代强制注入,意味着智能体接入正从野蛮生长走向协议化、合规化。

03 / 05

vivo、OPPO 同周开发者大会,端侧大模型与主动智能 OS 成主线

终端智能 端侧大模型 OS vivo / OPPO
事件

9/16–17,vivo 发布原系统 7 与蓝河 OS 4,首披露预研的蓝心 30B MoE 端侧模型;OPPO 发布 ColorOS 17,其端侧模型采用线性注意力架构、原生 128K 上下文,内存占用降 48%、能耗降 55%。两家均把"个性化主动智能"定义为终端下一阶段方向,将原子技能转化为智能体可调用的工具。

关注理由

头部厂商同周交卷,竞争焦点从单点模型参数转向"芯片—OS—模型—应用—生态"全栈协同。主动智能(听懂意图、记忆偏好、主动办成事)正在成为终端 OS 的默认形态,端侧大模型是这一形态的基础设施。

04 / 05

清华联合生数科技开源 Motus 大一统世界模型

具身智能 世界模型 开源 清华
事件

清华实验室联合生数科技 9/8 开源 Motus 大一统世界模型,将 VLA、世界模型、视频生成、逆动力学、视频-动作联合预测五种具身范式整合进同一架构,实现"观察—预判—输出动作"闭环。公开测试 50 项通用任务,对比 Pi-0.5 成功率提升 35% 以上、最高 40%。

关注理由

具身智能长期受困于能力碎片化——看懂、预判、执行分属不同框架。Motus 把感知—推理—行动打通到一个模型,开源降低研发门槛,对国产具身模型路线具有示范意义。

05 / 05

智元发布 GE-Act 2.0 原生世界-动作模型,验证数据 scaling 路径

具身智能 世界-动作模型 scaling law 智元
事件

智元(AGIBOT)9/10 发布 GE-Act 2.0 原生世界-动作模型(WAM),全部参数从随机初始化在具身操作数据上训练;在 300→30000 小时 100× 数据跨度上做零样本评测,G1-OP 成功率从 17.1% 升至 44.1%,G2-90D 从 13.4% 升至 31.1%,且未见饱和。同周智元还发布 AGILE2.0 感控一体模型,打通感知—运动全链路。

关注理由

GE-Act 2.0 首次系统验证了原生世界-动作模型存在类似大语言模型的 data scaling 定律,为"数据越多、能力涌现"的具身路线提供实证。这意味着具身智能的训练范式正从任务特化微调转向大规模预训练加零样本泛化,数据规模将成为核心壁垒。