主题: Agent 竞争从模型层升维到平台与编排层,AI 攻防进入"分钟级"时代,国产"算力×开源"双线提速
编制时间: 2026-09-12
本期看点: Agents API 公测 AI Agent 军团攻击 龙猫 2.0 万亿开源


一、要闻速览(Top Stories)

序号事件标签关键词
1OpenAI Agents API 开启公测,Codex harness 产品化AI Coding托管沙箱、子智能体、上下文压缩
2阿里 Qoder 发布 Mobile Use 插件,打通三端验证闭环AI Coding安卓/鸿蒙/iOS、闭环验证、Canvas
3工信部发布《"人工智能+软件"专项行动实施方案》AI Coding智能体软件、2028/2030 目标、应用商店
4美团龙猫 2.0 万亿参数模型正式开源综合万卡国产算力、MoE、Agentic Coding
5AI Agent 军团攻陷 48 国 395 组织的 PaperCut 服务器综合GreyNoise、供应链安全、Codex+DeepSeek
6OpenAI 暂停 ChatGPT Pro 20X 新订阅:Astra 算力吃紧综合算力瓶颈、负毛利、GPT-6 Astra
7Grok 4.6 上架三大云平台,Grok Bot 开放 Cursor 用户AI Coding渠道扩张、SpaceXAI、多平台分发
8Claude Code /diff、Cursor Projects、A2A CLI 集中更新AI Coding代码审查、多智能体协作、互操作
9天工 Ultra 破纪录后转向"可靠性",已进工厂试点具身智能人形机器人、工厂实测、X-Humanoid
10乐享科技正式公开具身大模型"以太"(Aether)具身智能能量模型、跨本体协作、数据高效

筛选标准:侧重 AI Coding 与具身智能方向;每条一句话概括事件 + 快速定位标签。


二、AI Coding 方向深度动态

在这里插入图片描述

1. OpenAI Agents API 公测:把"Codex harness"变成开发者基础设施

事件: 9 月 11 日前后,OpenAI 宣布 Agents API 进入公开测试(Public Beta),基于其 Codex harness 提供托管式云端智能体运行时,开发者可构建连接沙箱环境与自定义工具的云端 Agent。

核心能力 / 核心细节:

  • 托管执行环境:提供云端沙箱,也支持自带基础设施(自建 VM、临时容器、私有测试环境),Agent 可直接执行代码、访问文件系统、自动调试;
  • 长时程任务管理:内置跨多步骤的执行状态跟踪与上下文压缩(context compaction),缓解 Agent 长跑任务的"失忆"问题;
  • 工具生态:支持自定义工具、第三方连接器(云存储、源码托管、监控平台)与工具搜索,内置子智能体(subagents)编排能力。

值得关注的原因:

  • 竞争重心正式从"模型能力"转向"运行时/编排层":OpenAI 将打磨 Codex 的内部工程能力直接产品化,第三方 Agent 框架的"胶水层"价值被大幅压缩;
  • 国内视角:阿里 Qoder 的 Agent Harness、美团 CatPaw 等也在同步做平台化,中外厂商罕见地进入同一张"Agent 基础设施"牌桌,国内开发者出海或选型都需要重新评估依赖边界;
  • 工具执行与算力时长的定价尚未完全公布,成本敏感团队建议先在小流量试点验证。

2. 阿里 Qoder Mobile Use 插件:给编程 Agent 补上"最后一公里"验证

事件: 9 月 11 日,阿里 Qoder 推出 Mobile Use 插件(Beta):Agent 在修改安卓、鸿蒙、iOS 代码后,可直接在设备或模拟器上运行应用、完成交互并确认修改是否生效。

核心能力 / 核心细节:

  • 三端各走原生工具链:安卓走 Emulator/ADB/Instrumentation,鸿蒙连 DevEco Previewer/HDC/ArkXTest,iOS 用 Xcode Simulator/Accessibility/XCTest,上层以统一 Skill 与 CLI 提供给 Agent,不做"最低公分母"式强行对齐;
  • 同一设备会话闭环:开发者在 Canvas 上圈选问题区域,Agent 在同一台设备上构建、运行、截图、比对,不符则回到代码修改再次验证,全程共享会话与证据(截图/日志/断言);
  • 诚实承诺:官方强调某平台能力缺失时明确说明,“不会以一条不等价的命令冒充成功”。

值得关注的原因:

  • 把编程 Agent 的闭环从"提交代码"推进到"验证结果",直击移动开发中 Agent 最大的断点——改完代码不知道 App 到底跑没跑对;
  • 鸿蒙工具链(HDC/ArkXTest)被系统性纳入 Agent 生态,对国内鸿蒙开发者是稀缺的原生支持;
  • 与 OpenAI Agents API 形成有趣对照:一个做云端运行时平台,一个做端侧验证闭环,编程 Agent 竞争开始分层纵深。

3. 工信部《"人工智能+软件"专项行动实施方案》:智能体软件有了国家路线图

事件: 9 月 11 日,工信部正式对外发布《"人工智能+软件"专项行动实施方案》(工信部信发〔2026〕209 号),锚定 2028 与 2030 两个时间节点。

核心能力 / 核心细节:

  • 2028 年目标:智能编程工具与智能开发平台推广应用覆盖 2 万家规模以上软件企业、组织 100 项软件企业智能化技改、在重点行业打造 100 个智能体软件标杆应用、孵化 5 个以上优质开源项目;
  • 2030 年目标:关键软件全面实现智能化升级,智能编程、智能体软件及智能服务成为产业新增长极;
  • 关键部署:建设智能体软件应用商店与技能包(Skills)资源库;要求加强 AI 生成代码安全审查,研究智能体身份标识、可信互联、行为管控等安全技术。

值得关注的原因:

  • "智能体软件"首次被系统性写入国家级产业政策,"应用商店+技能包资源库"的提法与国际上 Agent Skills 生态方向高度一致,标准话语权之争已经开场;
  • 对国产智能编程工具(Qoder、CodeBuddy、通义灵码等)是明确利好,“揭榜挂帅”+财政专项的落地节奏值得跟踪;
  • 同时划出监管红线:AI 生成代码的知识产权合规与安全审查将从"建议"变成"硬要求",企业侧需提前建立审查流程。

4. 工具链快讯:Claude Code /diff、Cursor Projects、A2A CLI 集中更新

事件: 9 月 11 日前后多家编程工具密集更新(据开发者社区 Newsletter 汇总):Anthropic Claude Code 新增常驻交互式 /diff 审查窗格,代码变更实时刷新并支持多会话并排;Cursor Projects 开启 Beta,引入可持续委托子智能体、共享记忆与工件、跟进 PR 与定时任务的"协调者"线程;A2A 协议发布官方命令行工具,可在终端获取 agent card、收发消息并管理 Agent 任务。

值得关注的原因:

  • "审查与协作体验"成为编程 Agent 新的差异化战场——生成能力趋同后,拼的是人机协作界面;
  • A2A 官方 CLI 落地意味着多智能体互操作协议开始进入日常开发工具链,跨厂商 Agent 协作从愿景走向可用。

三、具身智能方向深度动态

在这里插入图片描述

5. 天工 Ultra 破纪录之后:从"跑得快"转向"用得住"

事件: 9 月 12 日,路透社专访北京人形机器人创新中心(X-Humanoid)工程师郭庆:其天工 Ultra 在世界人形机器人运动会上以 8.64 秒跑完 100 米(较博尔特世界纪录快近 1 秒)后,团队下一个目标是"把高性能变成高可靠、高可用"。

核心能力 / 核心细节:

  • 天工家族本届运动会共斩获 15 金 12 银 18 铜;Ultra 决赛在三套仿真训练策略中选用了"久经实战"的一套,反应时间比预赛缩短约半秒;
  • 落地侧:天逸 2.0 已在福田康明斯发动机工厂试点搬运 8-12kg 料箱,Omni 已完成总部 1 层爬到 17 层的实测;
  • 路线判断:小型人形机器人(Omni)先落地商业服务与轻工业,Ultra 型未来面向户外巡检与应急救援。

值得关注的原因:

  • "从赛场到工厂"是具身智能今年最重要的叙事转折,与近期行业"挤泡沫"讨论(梅卡曼德邵天兰开炮数采中心模式、证监会窗口指导抬高人形机器人 IPO 门槛)形成鲜明对照;
  • 外滩大会同期披露:上半年全球人形机器人出货约 1.91 万台、同比增长 272%,中国厂商占比超 97%——高增长与高质疑并存,检验标准正在从"动作演示"切换为"任务成功率、连续运行时长、人工接管频次"。

6. 乐享科技公开具身大模型"以太"(Aether):能量模型路线撞上 OpenAI 的"异类心智"

事件: 9 月 10-11 日,乐享科技 CEO 郭人杰正式公开具身智能大模型 Aether(以太)——即 8 月 26 日宇树 G1 与智元远征 A3 跨本体协作 Demo 背后的模型;因与 OpenAI 首席科学家 Pachocki 9 月 6 日长文《An Alien Mind》在理念表述上高度重合而引发行业争议。

核心能力 / 核心细节:

  • 技术路线:约 4B 参数、仅用约 200 小时人类操作视频训练、未使用真机采集数据;既非 VLA 也非传统世界模型,而是"能量模型"——以自由能驱动端到端决策,统一整合任务完成度、物理约束、流式记忆与动作可行性;
  • Demo 表现:两台异构机器人共享同一"大脑"完成擦玻璃、取衣、跨本体搬运交接(无脚本自主协作),并为省力自发寻找"能量最优解"(抓挂绳拎拖鞋、毛巾搭肩一次多带);
  • 架构组件:Self Model(本体能力边界自感知)+ Evolution Manager(真实交互中持续自进化)+ 主动感知(自主调整视角补盲区)。

值得关注的原因:

  • 为行业"数据焦虑"提供另一解法:200 小时视频训出 4B 模型若被第三方复现验证,将直接冲击"百万小时数据军备竞赛"的逻辑;
  • 跨本体协作 + 十分钟无剪辑实景长任务,是少数接近"泛化"的公开样本;但与 OpenAI 概念撞车风波也提醒:创新叙事最终要靠可复现评测与规模化订单说话。

四、产业趋势总结

  1. Agent 竞争升维:从"拼模型"到"拼平台与编排":OpenAI Agents API、Qoder Agent Harness、Grok Bot、Cursor Projects 同场竞技,运行时、编排层与证据链成为新的护城河。
  2. Agent 安全进入"分钟级"攻防:PaperCut 事件中 AI Agent 军团最快 7 分钟拿下域管理员权限,工信部方案同步要求 AI 生成代码安全审查与智能体行为管控——防御方必须达到"Agent 速度"的自动化响应。
  3. 编程 Agent 的新战场是"验证闭环":Qoder Mobile Use 把验证推进到真机交互,Claude Code 强化 /diff 审查,生成能力趋同后"证明改对了"成为下一个决胜点。
  4. 国产"算力×开源"双轮提速:美团龙猫 2.0 在万卡级国产算力集群完成全流程训练并开源,叠加"十五五"算力网新增 4 万亿直接投资与燧原科技上市,国产全链路自主可控进入兑现期。
  5. 具身智能"挤泡沫"与"拼可靠性"并行:一边是邵天兰开炮、IPO 门槛抬高、估值回调,一边是天工进厂、上半年出货同比+272%——资本故事退潮后,真实任务成功率成为唯一硬通货。

从当天 10 条要闻中提炼的跨事件共性趋势。


五、值得持续关注的信号

  • 9 月 14 日:DeepSeek V4-Pro 将全量路由至 V4.1 Flash 并按 Flash 计价,实际体验与降价连锁反应值得观察;同日也是 CISA 联邦机构 PaperCut 漏洞修复大限;
  • OpenAI Agents API 的正式定价与 GA 节奏——将直接决定第三方 Agent 框架与国内 Agent 开发平台的生存空间;
  • ChatGPT Pro 20X 恢复销售的时间点,是观察头部模型厂商算力扩容进度的最佳标尺;
  • 天工 Tianyi 2.0 在福田康明斯工厂的搬箱试点能否转为常态化部署,是"人形机器人进厂"叙事的首批关键样本;
  • Qoder Mobile Use 鸿蒙端(HDC/ArkXTest)适配深度,及其"能力缺失如实说明"承诺的兑现情况;
  • 乐享 Aether 的 4B/200 小时训练配方能否被第三方复现,将检验"能量模型"路线的真实成色。

本日报基于公开报道整理,仅供参考。

Logo

作为“人工智能6S店”的官方数字引擎,为AI开发者与企业提供一个覆盖软硬件全栈、一站式门户。

更多推荐