今日主线 · TODAY'S MAIN LINE
能力就位,交账开始
今天五条信号收束到同一句判断:AI 的两端都已跨过「能力演示」门槛,竞赛重心同步下沉到「可信」与「可交付」。AI 编程侧,Claude Code 五天补三道权限围栏、Codex 开始对密钥脱敏,说明高自主的前提是「可信的沙箱」;Claude vs Codex 的选型之争也已从「比模型」变成「比全家桶 + 每任务成本」。具身侧,上半年融资 322 笔 / 935 亿元、行业喊出「交付时代」,西湖机器人以「通用大脑」半年吸金 5 亿元,家庭消费级(欧拉万象、越疆 LUMO)同步起量——资本与产品正从「堆 Demo / 拼硬件参数」转向「订单、通用模型与真实场景」。一句话:稀缺的不再是能力,而是可验证的信任与可结算的交付。
C1 · TRUST
AI CODING · 权限围栏
编程智能体进入「patch-now」周:Claude Code 五天补三道权限绕过,Codex 开始对密钥脱敏8/8
事件 · What
8/4–8/8 Claude Code 连发 v2.1.222–226 五个版本,修补三类 agent 权限 / 沙箱绕过:worktree 隔离失效(隔离子智能体可对主仓库执行破坏性 git 操作)、PreToolUse 自动放行 hook(后台任务可越权)、制表符 / 不可见字符隐藏 bash 执行以避开审批;同期 Codex 0.147.0(8/7)对展示命令与会话记录中的密钥做脱敏,stateless MCP 2026-07-28 规范在两款 CLI 落地。Ollama 亦在 Apple Silicon 上用 MTP 投机解码把 Qwen3.5 解码速度约翻倍。
为何值得关注 · Why
高自主 coding agent 若能被「悄悄绕过敏感操作审批」,自主即是敞口——这些属于 patch-now 级修复,尤其对跑无人值守任务(后台、定时、CI)的团队,本周应升级并把 Codex 密钥脱敏打开。更深一层:审批框从来不是真正的安全边界,可信沙箱 + 多层防御才是;这标志编程智能体的竞争从「能力」补到「可信」,与安全运营(你本职的封禁 / 策略治理)同源——权限最小化与可审计,迟早要写进 agent harness。
信源与可信度:Claude Code / OpenAI Codex CHANGELOG、JavaRubberDuck、Founder's Wire、Ollama Blog(一级);版本与修复「高」,本地推理提速为厂商口径「中」。
C2 · STACK
AI CODING · 选型
Claude vs Codex 从「比模型」变成「比全家桶」:Opus 5 守硬工程,Codex 守云并行8/12
事件 · What
截至 8/12,Claude Opus 5 在 SWE-bench Pro 79.2% 领先 GPT-5.6 Sol(约 64.6%),为年内最大差距;Terminal-Bench 2.1 口径不一(Opus 5 约 86.7% / Sol 89.5%)。Claude Code 安装量 22.3M(VS Code Marketplace 第三方第一),靠 hooks / subagents / MCP / worktree / 可恢复事件日志构成最深可编程 harness;Codex 以云沙箱 OS 级隔离、并行 worktree、CI/CD SDK 见长,并入 ChatGPT 订阅。模型层已分化为 Anthropic 四档 Claude 5 家族 vs OpenAI GPT-5.6 三层。
为何值得关注 · Why
选型已不是「哪个模型强」,而是「哪套全家桶 + 每任务成本」——harness 决定能力上限,模型可换。对团队:按控制模型(要定向 fleet 选 Codex、要 peer mesh 选 Claude Code)与 token 账单选,而非榜单差值;并行会等比放大 token 支出,预算要按 token 算,标价只是入口。也提示:当头部差距缩进评测噪声区,harness、上下文管理与提示词开始比模型本身更决定结果。
信源与可信度:Alphacorp.ai、OrcaRouter、Dreaming.press 对比分析(二级);榜单多厂商自报「中(口径不一)」,安装量与功能「高」。
E1 · DELIVER
具身智能 · 交付时代
具身智能喊出「交付时代」:上半年融资 322 笔 / 935 亿元,同比 +137%8/12
事件 · What
8/12 具身智能50人论坛夏季峰会披露,上半年行业融资 322 笔、总额 935 亿元(同比 +137%);业内判断行业正从「讲故事」迈入「交付时代」。与此呼应:全球人形 H1 出货约 1.91 万台(同比 +272%),中国占 97%,超 70% 流向工商业应用(半年前约一半);宇树 8/11 开启上海 IPO 申购,发行市盈率约 219 倍。
为何值得关注 · Why
资本从「堆 Demo」转向「可交付订单」,是产业化拐点的硬指标,比任何宣发口径都实在。结合宇树 IPO、AgiBot 44% 份额,具身智能正批量从实验室走向工商业部署;供应链高度向亚洲(中国)集中。对做 SOC / 企业安全的你:机器人上岗即新增一类联网资产与攻击面,的「交付时代」也意味着「暴露面时代」——端点与身份认证治理要提前进场。
信源与可信度:具身智能50人论坛夏季峰会、AJP、Smart Analytics Global(一级 / 行业研究);融资笔数与出货量为行业研究口径「中(未独立审计)」。
E2 · BRAIN
具身智能 · 通用大脑
西湖机器人半年 4 轮融资累计 5 亿元,资本押注「通用大脑 + 全身统一大模型」8/12
事件 · What
8/12 西湖机器人(西湖大学成果转化)完成 A 轮(海愿基金领投近亿元),半年 4 轮累计 5 亿元;坚持「通用大脑 + 人形全身小脑 + 自研本体」全栈路线,GAE 通用运动大模型实现指令 → 全身运动直接映射、跨本体部署,通用大小脑双预训练架构已适配多款双足本体,在手订单近亿元,合作方含阿里、英特尔、京东。
为何值得关注 · Why
投资逻辑从「硬件关节参数」转向「决定泛化的通用基础模型」——大脑公司成新宠。其「实景实训真机数据回流 → 模型迭代」闭环,是具身从实验室到商业落地的关键;也提示护城河正从本体硬件移向「模型 + 数据飞轮」。对你:具身数据的归属、脱敏与合规(工信部数据集质量标准 11/1 实施)会成为企业采购的硬门槛,安全与数据治理能力是差异化卖点。
信源与可信度:机器之心 Pro、亿欧、每日经济新闻(一级);融资额与订单为厂商 / 媒体口径「中(未独立证实)」。
E3 · CONSUMER
具身智能 · To C 起量
家庭消费级具身集体起量:华为具身「一号员工」创业欧拉万象,越疆发布「具身全栖」LUMO8/12
事件 · What
原华为具身 Lab「一号员工」周顺波创立欧拉万象,all in 家庭消费级,成立三月获高瓴、招商局、百度风投三轮数亿元融资,初代半身高轮式底盘 + 机械臂,计划 12 月小批量 Beta;越疆 8/5 发布全球首款「具身全栖」人形机器人 DOBOT LUMO(空弈大模型,情绪感知 + 主动陪伴),开辟家庭陪伴赛道;诺因智能以合成数据引擎把消费级机器人真实数据占比压到约 10%。
为何值得关注 · Why
To C 陪伴 / 家庭从概念进入产品化;与工信部《具身智能数据集质量要求及评价方法》(11/1 实施,从规模导向转质量导向)形成「落地 + 治理」双线。值得跟踪:家庭场景虽难,却是构建数据飞轮、走向千家万户的必经入口;真机数据占比与合成数据路线将决定体验上限,也决定隐私合规边界——这正是企业安全能力可外溢到消费机器人的切口。
信源与可信度:每日经济新闻、新京报、霞光社、腾讯新闻具身智能日报(一级);融资与产品节奏「高」,体验上限待真机验证「中」。