目录

2026-09-05 AI热点:GPT-6 Astra 开启 Computer-Use,具身智能破纪录上货架

本期聚焦 AI Coding具身智能 两大方向,精选 10 条当日(及近 48 小时)最有价值的信息,帮你快速把握产业与技术脉搏。

一、AI Coding:模型、成本与工程化的三重提速

1. OpenAI 发布 GPT-6 Astra:Computer-Use 落地,Codex 会"说话"了

9 月 5 日,OpenAI 面向开发者推出 GPT-6 Astra,主攻"原始智能"场景:更强的 Computer-Use(自主操作软件界面)、异步工具调用与 Responses API 内的可控转向。配套更新包括——Codex 现有会话新增语音线程,开发者可以口述与写过 PR 的智能体讨论架构与下一步;Codex 压缩机制可跨上下文窗口保留笔记并使之可检索;演示中 Astra Ultra 用单条提示在 75 分钟内"造"出一个可运行的 macOS 27 桌面。

核心看点:Agent 正从"写代码"走向"操作整台电脑"。当模型能点按钮、翻文件、开终端,软件工程的自动化边界被一次性推到了 OS 层。

2. Anthropic 推 Fable 5.1 / Mythos 5.1,缓存读取价砍 75%

Anthropic 发布 Claude Fable 5.1Claude Mythos 5.1:输入输出价不变,但缓存读取价从每百万 token 1 美元降至 0.25 美元(降幅 75%),典型任务整体成本降约 25%、高度 Agent 化任务最高降 45%。同模型拆出 Mythos 5.1,仅向可信安全/生命科学伙伴开放,实现"能力—护栏"解耦。Cognition 已把 Devin 的 Opus 5 流量迁至 Fable 5.1。

核心看点:长时域 Agent 的最大成本项就是缓存读取。降价直接把"跑一整夜的多 Agent 任务"从奢侈变日常,“记忆租金"成了新的竞争维度。

3. 国产模型编程登顶:Qwen3.8-Max 居 CodeArena 榜首,Gemini 3.8 Flash GA

9 月 2 日阿里更新旗舰 Qwen3.8-Max(2.4T 参数、1M 上下文),在聚焦前端编程的 CodeArena 榜单以 1691 分登顶,超越 Claude Opus 5 与 Kimi K3;同期 Google GA 发布 Gemini 3.8 Flash,保持低价(0.75/3.75 美元每百万 token)并把重心放在长周期软件工程、自主 Agent 与多工具调用,另推安全版 3.8 Flash Cyber。

核心看点:国产模型在编程能力上首次全面登顶全球榜单,叠加谷歌把"长周期 Agent"做成默认卖点,AI Coding 的模型选型正从"谁更聪明"转向"谁更便宜且更持久”。

4. GitHub Copilot HydraFusion 多模型编排,Claude Code 上线组织级 MCP

GitHub 推出 Project HydraFusion:把编程任务拆给多个模型分别规划、构建、审查、收尾,宣称同等质量下成本可降 67%;Copilot 代码审查升级为可"批准"PR(默认关闭、管理员开启)。Claude Code 2.1.259 新增组织统一推送 MCP 服务器与 GitLab MR 支持,意味着 Agent 工具链正式进入企业 IT 治理视野。

核心看点:单模型霸权让位于"模型编排"。MCP 正成为事实上的 Agent 集成标准,代码评审的信任模型也被重写。

5. Coder × SpaceXAI:把云端 coding agent 带进受监管企业

9 月 2 日,Coder 发布 Agent Relay——自托管的云编码智能体执行环境,SpaceXAI 为首发伙伴。Cursor 等云端 Agent 的推理与规划仍在厂商侧,但工具调用执行在客户自己的 Coder 工作区,源码、密钥与内网服务不出客户网络;环境按任务沙箱化、策略即基础设施、每次运行留完整审计日志,支持气隙部署。

核心看点:企业不是拒绝 Agent,而是拒绝"把代码交给别人跑"的部署模式。自托管执行层把最 regulated 的行业(银行、国防、政府)也纳入了 AI Coding 的覆盖范围。

6. 编程智能体资本与安全:Cognition 估值 470 亿美元,Git 漏洞敲响警钟

据彭博,Devin 母公司 Cognition 接近完成约 10 亿美元融资,估值从 260 亿跃升至约 470 亿美元,年化营收超 9 亿美元——编程智能体是当前 AI 应用层商业化兑现度最高的赛道。同期披露的 Git core.fsmonitor 漏洞可波及 Codex、Claude Code、Cursor、goose 等 7 款 coding agent:恶意仓库能在智能体自动跑 git status 时于沙箱外执行任意代码,多数产品已发补丁。

核心看点:资本与产业共振的同时,攻击面也从"模型越狱"转向"Git 灵活特性 × Agent 自动化"——所有在不可信目录运行 coding agent 的团队都需立即升级。

二、具身智能:从破纪录到上货架,大脑与场景双线提速

7. 第二届世界人形机器人运动会:天工 Ultra 百米 8.64 秒破人类纪录

第二届世界人形机器人运动会(北京,8 月 22–26 日)汇聚 666 支队伍、2056 台机器人、51 个项目天工 Ultra 百米跑出 8.64 秒,快过博尔特 9.58 秒的人类纪录;跳高越过 3 米;AgiBot 累计交付约 1.5 万台居全球首位,UBTech U1 陪伴系列开启首批消费级交付。赛事规则全自主模式计分翻倍,灵巧手专项全自主权重设为遥控的两倍。

核心看点:行业正从"谁遥控得准"转向"谁的大脑小脑更聪明"——由世界模型理解物理环境、由大模型把自然语言映射为动作序列,再借 Sim2Real 逼近泛化,“举一反三"首次成为可能。

8. OpenAI 官宣自研人形机器人,英伟达开源 SONIC 运动基座

奥特曼首次明确 OpenAI 将自研人形机器人(“人手一台"方向);英伟达则开源 SONIC 运动基础大模型——用 700 小时真人动作捕捉训练出通用全身控制策略,同一套策略可驱动多种本体、实时模仿复杂武术动作,被视为具身研发的"开箱即用底座”。

核心看点:AI 巨头从"卖大脑"走向"造身体”。当世界顶级实验室亲自下场做硬件,具身智能的竞争正式进入"全栈自研"阶段。

9. 国内具身智能融资爆发:上半年 935 亿元,同比增 5 倍

IT 桔子数据显示,今年上半年国内具身智能赛道融资总额达 935 亿元,同比增长 5 倍。落地案例:成立不足一年的 Moqi(魔奇)获阿里、腾讯共同投资,估值逾 70 亿元,其轮式机器人 15 分钟完成 70–80 个长程动作,自研 MoRA 把推理放在边缘侧;前京东副总裁创办的天工机器人完成数亿元 A 轮,加码物流分拣。

核心看点:资本逻辑很清晰——硬件本体已相对成熟,赛场暴露的"大脑"短板正是未来要攻坚的方向,物流分拣成为首个大规模商业化标杆场景。

10. Hugging Face 开源 Microduck + 李飞飞 Atlas 世界模型

Hugging Face 发布开源机器人 Microduck(会滑旱冰),开放硬件与软件资料,把 LLM 领域验证过的"开源 + 社区"模式复制到机器人。与此同时,李飞飞创立的 World Labs 发布 Atlas 全模态世界模型,可从单张静态图生成 1 分钟 1440P 高清视频,画面遵循光影、重力与运动逻辑,直接赋能机器人仿真与数字孪生。

核心看点:世界模型是具身智能的"大脑地基"。单图生成长视频意味着机器对物理世界的理解与想象上了一个台阶,将反哺机器人训练与 Sim2Real。

小结

今天 AI Coding 的主线是更强模型 + 更低成本 + 更稳工程化:GPT-6 Astra 把 Agent 推到 OS 层,缓存降价让长任务变便宜,HydraFusion 与组织级 MCP 把"多 Agent 协同"标准化,Coder 解决了受监管企业的部署痛点。具身智能的主线是破纪录 + 上货架 + 全栈自研:天工 Ultra 改写人类运动纪录,OpenAI 与英伟达亲自下场做身体与底座,资本半年涌入 935 亿。两端共同指向一个判断——AI 正从"会写代码 / 会跳舞"走向"能稳定干活"