目录

AI 编程与具身智能双线爆发:Coding Agent 成本骤降 67%,人形机器人出货占全球 97%

今日主线:AI 编程(Coding Agent)从“能写代码”走向“低成本、可治理、可协作”,具身智能从“舞台表演”大步跨入“真实干活”。成本与份额两个维度同时出现标志性拐点。

一、AI Coding 方向

1. GitHub Project HydraFusion:多模型动态编排,编程成本骤降 36%–67%

事件简述:9 月 4 日,GitHub 在 Copilot CLI 中上线研究预览 Project HydraFusion,可按任务动态编排多个大模型协同编码。

核心内容:HydraFusion 提供三种执行模式——Single(单模型执行)、Cascade(廉价模型先试,质量不足再升级强模型)、Critique(一模型写码、二模型审查、再回改)。GitHub 称其在 TerminalBench 2.1、DeepSWE、CheckpointBench 三个基准上达到或超越 Claude Opus 5,同时预估 token 成本下降 36%–67%。所有 Copilot 订阅档均可通过 /experimental 命令调用,不单独收费。这标志着编程智能体进入“多模型调度即服务”阶段,成本优化从堆更强模型转向架构级编排。

2. Anthropic Claude Fable 5.1:缓存读取价砍 75%,长时域 Agent 成本骤降

事件简述:Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1,并将缓存读取价从每百万 token 1 美元降至 0.25 美元。

核心内容:Fable 5.1 输入/输出价不变,但缓存读取价降幅达 75%,典型任务整体成本约降 25%,高度 Agent 化任务最高降 45%。该模型在 Terminal-Bench 等基准上翻倍,并首次在生产级安全防护开启下完成评测;同系列拆出的 Mythos 5.1 仅向可信网络安全/生命科学伙伴开放,实现“能力—护栏”解耦。缓存降价直接利好长上下文、长会话的自主编程智能体,使“带着完整项目上下文反复跑 Agent”的经济性大幅提升。

3. 腾讯 WorkBuddy 开放平台上线:Agent 进入“组网”阶段

事件简述:9 月 2 日,腾讯 WorkBuddy 宣布开放平台(open.WorkBuddy.cn)正式上线,首批引入超百家生态伙伴。

核心内容:平台打通硬件、应用与开发者三层生态,开放 Skill / Expert / Connector 能力,Connector 支持 MCP 与 CLI 双方案双向接入,定位为统一管理上下文、记忆与任务状态的“Agent 底座”。其要解决的是单点、场景、供给、产业四类割裂。WorkBuddy 的“组网”思路,反映的是国内 Agent 平台从“单智能体工具”向“可编排、可互联的智能体基础设施”演进。

4. 网易有道《中国办公 Agent 用户报告》:编程占任务量 38.5%

事件简述:9 月 7 日,LobsterAI 基于超 100 万用户数据披露,编程/代码以 38.5% 占比遥遥领先(约为文档写作的 4 倍)。

核心内容:报告显示前 5% 重度用户独占 53.5% 算力,平均单任务规模每 3 个月翻一倍,DeepSeek 系列调用份额超 85.8%。结论显示 Agent 正从尝鲜迈入生产力阶段,但八成轻度用户仍待激活。数据印证“编程是办公 Agent 第一大刚需场景”,也为国产模型(DeepSeek)在 Coding 赛道的统治力提供量化佐证。

5. 微软 Project Zenith:为 AI 开发者打造的 Windows 11

事件简述:9 月 6 日,微软推出 Project Zenith 版 Windows 11,专为 AI 开发者设计。

核心内容:设备需配备 64GB 以上统一内存与 250GB/s 带宽,预装 VS Code、GitHub Copilot、Python 3.14+、Node 24+ 等完整开发工具链,支持本地运行 300 亿参数以上大模型,并加入 OS 级身份认证与 MXC 隔离容器保障 Agent 安全。这是操作系统层面向“本地智能体开发”的正式押注,把模型推理、工具链与 Agent 安全容器打包进系统级底座。

6. JetBrains Kotlin Toolchain 0.12:Compose MCP 让 AI 代理直连运行态应用

事件简述:9 月 7 日,Kotlin 工具链 0.12 将库发布能力从 JVM 扩展至 Android、iOS、WebAssembly,并推出 Wasm 网页应用构建预览。

核心内容:Compose Multiplatform 同步支持命令行 Hot Reload 及启动 MCP 服务器,使 AI 代理可直接与运行中的应用交互——重载、重启、读取界面结构。这意味着 IDE/框架侧开始原生提供“让编程智能体操控真实运行态 UI”的接口,是 Coding Agent 从“改代码”走向“改并验证运行效果”的关键一环。

二、具身智能方向

7. 清华 × 极佳视界 GigaBrain-WBC-0.5:全球首个人形机器人行为世界模型

事件简述:9 月 2 日,极佳视界联合清华大学发布人形机器人通用全身控制基础模型 GigaBrain-WBC-0.5。

核心内容:这是全球首个面向人形全身控制的“行为世界模型”(Behavior World Model),也是首次把“听得懂全身指令的通用小脑”带出平地:能利用环境、判断处境、摔倒自起。此前“通用小脑”代表英伟达 SONIC 仅限平地,而该模型驱动 Unitree G1 实现跨地形全身协调,精准击中“能跨地形却不能通用、能通用却只能平地”的长期痛点。世界模型开始从视频生成下沉到机器人运动控制,是具身智能底层能力的实质跃迁。

8. 广州 XAIR Expo 2026:全球首个通用具身可微粒子世界模型 + 系统级大脑 RoboForge

事件简述:9 月 3 日至 6 日,广州 XAIR Expo 2026 具身智能博览会上,两家具身智能企业发布“全球首个”新品。

核心内容:广东智动未来发布全球首个面向通用具身的可微粒子世界模型,并展出 AUTOLIFE S3 智能人形机器人——该模型彻底重构环境认知与作业逻辑,使机器人能自主推演操作角度、发力力度及周边连锁变化,降低真机试错损耗。云蝶科技发布世界首个系统级具身智能大脑 RoboForge,联合南洋理工研发,设 Harness 模块完整记录任务证据链、自动诊断失败来源,形成“持续自我演化闭环”,并推出“1+N 真实世界具身智能联合研究计划”打通产学研闭环。两个“世界首个”折射广州海珠区具身智能产业的商业化加速。

9. 深朴智能数亿元 Pre-A+ 融资;上半年中国人形机器人出货超 4 万台、占全球 97%

事件简述:9 月 4 日—7 日,深朴智能(Simple AI)完成数亿元 Pre-A+ 轮融资;同期世界机器人大会数据显示中国人形机器人上半年出货超 4 万台。

核心内容:深朴智能定位为 AI 原生具身智能系统服务商,以酒店等类家庭场景为商业化入口,其 HiFi-UMI 数据生产引擎已处理超 2 万小时、432 万段操作数据,覆盖 480 多个场景,实现“无本体数据直达真机”。融资方包括珂玺资本、上海科创旗下知识产权基金、线性资本等。另据中国电子学会数据,2026 年上半年中国人形机器人出货量已超 4 万台,全球占比进一步提升至 97%,标志具身智能进入“小批量试用→大规模落地”关键拐点。

10. 中国邮政广州中心:具身 AI 机器人分拣达 1200 件/小时

事件简述:中国邮政广州处理中心部署具身 AI 分拣机器人,单台处理量达 1200 件/小时。

核心内容:机器人在日均约 650 万件邮件(峰值超千万)的枢纽中,利用多模态感知与自主决策识别、抓取并喂入分拣流,同时标记异常/破损件。与无人叉车、升级自动线协同运行。这是具身智能在物流高频、高强度真实场景落地的标杆案例,证明“可规模化上岗”已不只是演示,而是进入生产系统的稳定性验证阶段。


小结

今日两条主线共振:编程侧靠“多模型编排 + 缓存降价 + 系统级底座”把 Agent 成本与可用性压到新低,具身侧靠“世界模型下沉到运动控制 + 数据闭环 + 真实场景部署”把机器人从表演推向干活。成本拐点与出货拐点同日显现,AI 正从“能力展示”全面转入“生产力部署”。