栖居在城市的大地上,分享城市中的感想予你,在留言板留下你的足迹,希望你在这里有所收获,祝幸运

一个年轻人,一个小镇青年,如果获得更好的人生,第一步要摆脱异托帮,凡是别人向你建构、推销那些快乐,要一概拒绝;虽然你做不到,我还是愿意这么提。然后把那些所有的及时性的,就像那个肥宅水一样,能够让你瞬间高兴的东西,你都应该把它视若为敌人,是你生活中的毒药,你应该去做那些吃力不讨好的事情,比如说学一门技艺,精益求精锤炼一门技艺,这能够使你获得人生的支撑,或者你非常努力的去读书考一个好大学,也可以。这些东西才是你生活的真谛

最新文章

今天 WAIC 2026 收官,"具身智能从身体竞赛转向大脑竞赛"成为行业最响亮的回声;与此同时,AI Coding 端 OpenAI 静默下调 Codex 上下文、MCP 锁定史上最大协议修订,"工程纪律"取代"模型军备"成为新主轴。本期围绕 WAIC 闭幕的产业范式切换、腾讯系全栈具身布局、MCP 7-28 协议升级、Codex 上下文博弈、触觉具身智能落地五条主线展开。

1. WAIC 2026 闭幕:具身智能从"身体竞赛"转向"大脑竞赛",55% 资金流向"大脑"

7 月 20 日,2026 世界人工智能大会暨人工智能全球治理高级别会议在上海闭幕。本届大会具身智能参展企业从去年的 80 多家猛增至 200 余家,现场集结 208 款具身智能终端、超 300 台真机,核心关键词从"能走、能跳、能翻"切换为"量产、适配、场景交付"。

事件简述: 开幕当天,智元联合擎天租平台部署的 60 台机器人已在世博、张江、西岸"三地四馆"上岗,承担指路、导览、递送等真实服务,背后支撑的是 GO-2 具身基座大模型与 GE-2 世界模型。乐聚智能展示了 3 台量产级机器人连续运行 8-10 小时不间断作业,纸箱拆垛综合成功率超 95.8%,部分方案已在工厂稳定运行 3-4 个月。梅卡曼德展示了"一脑多形"具身智能体系——基于自研 Mech-GPT 多模态大模型同时驱动人形机器人和工业机器人,并完成全球首例人形机器人多机协作系统工业实景演示。智元精灵 G2 Max 24 小时不间断在京东物流真实仓储作业,节卡联合华域汽车实现 10 秒锁付单颗精密螺钉、99% 识别准确率。

值得关注的原因: 上半年已有近 440 亿元资金涌入国内具身智能赛道,其中 55% 流向机器人的"大脑"。这一数字与"身体竞赛"时代的硬件堆料形成鲜明对比——行业投资逻辑正从"押注硬件形态"转向"押注智能通用性","一脑多形"使同一套基座模型可同时驱动工业机械臂、人形机器人和移动机器人,标志具身智能已跨越技术验证奇点,进入可复制、可协同、可进化的规模化商用深水区。

信息来源: https://finance.sina.com.cn/jjxw/2026-07-20/doc-iniikxuu4898118.shtml

2. 腾讯 WAIC 2026 收官发布 Hy-Embodied 三件套 + 持续在线具身智能体 Apexio

7 月 19 日,腾讯 Robotics X 实验室、福田实验室联合腾讯混元在 WAIC 期间首次系统性发布"感知—身体—行动"闭环的具身智能系列新模型与智能体成果。

事件简述: 本次发布三款基座模型:Hy-Embodied-VLM-1.0(具身 VLM 基座,仅以 A3B 规模、约十分之一计算量即接近上一代 A32B 旗舰效果,更适合机器人端部署);Hy-Embodied-RxBrain-1.0(具身原生的世界认知模型,将"会推理"与"会想象"统一,是腾讯在世界理解模型上的关键探索);Hy-Embodied-VLA-0.5(视觉-语言-动作模型,构建"数据—模型—训练—部署"协同发力完整学习栈,通过亚毫米级高精度 UMI 采集系统积累超一万小时人类示教数据)。同时发布持续在线具身智能体 Apexio(三层不同频率在线能力——按需唤醒的认知系统、15Hz 持续感知的行动系统、毫秒级反射式执行系统),以及具身原生智能体框架 TairosAgent,对 2025 年发布的 Tairos 具身智能开放平台进行全面升级。

值得关注的原因: 腾讯从"不取而代之做硬件、只做机器人厂商合作伙伴"的边界定位出发,过去一年已与宇树、智元、越疆、松延动力、乐聚、华沿、博世、蓝思、景德镇、敦煌等产业链伙伴协同,本次系统性发布"感知—身体—行动"全栈具身基座 + 持续在线智能体框架 + 升级的开放平台,是大厂首次在国内完成从模型到智能体到平台的具身全栈闭环,与同期梅卡曼德"一脑多形"形成"通用基座 vs 场景基座"两条技术路线的同台竞技。

信息来源: https://finance.sina.com.cn/hy/hyjz/2026-07-19/doc-iniiimtc7924002.shtml

3. MCP 2026-07-28 协议锁定:史上最大修订,无状态核心 + Extensions 框架重构 Agent 通信层

MCP(Model Context Protocol)团队于 5 月 21 日锁定 2026-07-28 规范的发布候选版本(RC),最终版将于 7 月 28 日正式发布,这是 MCP 自发布以来的最大规模修订,6 个 SEP(Specification Enhancement Proposals)协同重构协议层。

事件简述: 核心变化是 MCP 在协议层转为无状态:移除 initialize/initialized 握手(SEP-2575)与 Mcp-Session-Id 头(SEP-2567),任何请求都可以落到任意服务器实例上,远程 MCP 服务器可部署在普通轮询负载均衡器后,无需 sticky session、共享 session store、网关深度包检测。引入 Extensions 框架(反向 DNS 标识符、capability negotiation、独立仓库与版本管理),首批重磅扩展是 MCP Apps(服务器渲染、沙箱 iframe 内的交互式 UI)与 Tasks(长时任务管理)。授权机制向 OAuth 2.1 / OpenID Connect 收敛,W3C Trace Context 通过 _meta 固定键名传递实现 OpenTelemetry 兼容的分布式追踪。正式弃用 Roots、Sampling、Logging,12 个月内保留兼容。

值得关注的原因: MCP 已成为 AI 编程与 Agent 工具的事实标准通信协议,无状态化是 Uber 等运行"每周数万次 Agent 执行"的网关团队长期诉求的落地——协议层从"易用原型"升级为"可规模生产"基础设施。Extensions 框架把 UI 渲染、长时任务、授权等本不属于线协议的能力剥离到独立扩展,使协议本身保持精简并能向后兼容演进。7 月 28 日最终发布前需重点关注 SEP-2468(RFC 9207 iss 验证)——这是 7-28 期间最可能被在野利用的攻击面。

信息来源: https://blog.modelcontextprotocol.io/posts/2026-07-28-release-candidate

4. OpenAI 静默下调 Codex 上下文窗口至 272k + 强制 Auto-compaction,引爆"长上下文陷阱"讨论

7 月 19-20 日,OpenAI 在 GitHub PR 中将 Codex CLI 的模型上下文窗口从 372,000 tokens 静默下调至 272,000 tokens(-27%),无官方公告,话题在 Hacker News 收获 209 点 / 93 评论;同一 PR 新增针对误删 $HOME 的系统级护栏。

事件简述: Codex 负责人 Tibo 在 X 平台解释,372k 窗口是 Codex 订阅者"配额异常消耗"的主因,更大上下文意味着每个请求计费 token 更多,订阅者无感知地看着额度蒸发。回滚配合新的推理优化可让配额使用量提升约 10%,372k 后续会重新引入。但开发者社区实测发现,Codex 的 auto-compaction 机制在剩余 10-20% 上下文时即触发不可预测摘要,等效可用窗口约 218k,开发者无法回退到压缩前状态,常陷入"读取、压缩、幻觉、重读"的死循环。同一 PR 还新增了防误删 $HOME 的护栏条款,作为对近期 Codex 误执行 rm -rf 摧毁用户主目录事件的回应。

值得关注的原因: 这是头部 AI 实验室首次公开为"保护用户配额"而非"自身容量"回滚上下文窗口,标志上下文窗口已从"能力炫技"转变为"计费杠杆"。事件折射出当下 AI 编程的核心效率陷阱——长上下文不等于高智力,社区共识转向 100-200k 性能甜区 + 用外部 Markdown / Sub-agents / RAG 维持"真记忆仓库"的工程纪律范式。同期 Codex-resets.com(专门追踪 Codex 配额重置时机的社区站点)登顶 HN 首页、293 点,更直接揭示"当用户为你的速率限制建倒计时网站时,定价模型本身就是产品体验"。

信息来源: https://github.com/openai/codex/pull/33972/files

5. 新智具身(NeoteAI)WAIC 展示触觉具身智能新突破:从"看见"到"触摸"的关键节点

7 月 19 日,由复旦大学可信具身智能研究院孵化、上海新智具身智能科技有限公司(NeoteAI)在 WAIC 2026 通过四大展台联动,集中展示了触觉具身智能在工厂生产线、电子设备、轨道交通等真实物理交互任务中的前沿突破。

事件简述: 新智具身展示了自研自适应视触觉 AI 传感器和触觉具身大模型。汽车车灯装配任务中,机器人凭借视触觉传感器实时捕捉接触区域形变与受力变化,结合视触觉融合大模型"边操作、边感知、边调整",动态修正动作轨迹完成精准对位、螺丝旋拧、接口插接;板卡插拔系统针对操作空间狭小、接口精密、部件易损等难点,融合视觉识别、视触觉感知和动作控制实现狭小空间对位;轨道交通数据接口连接演示了触觉在跨设备、跨轨距场景下的通用化能力。

值得关注的原因: WAIC 2026 释放的明确信号是机器人"从看见世界迈向触摸世界"——视觉感知已无法满足非结构化物理交互的精度需求,触觉反馈是机器人从工业封闭场景迈向消费电子、轨道交通、家居等开放场景的关键阶梯。新智具身以"视触觉传感器 + 触觉具身大模型 + 自研硬件"形成软硬一体闭环,区别于纯软件路径,是国内首批在"触觉具身智能"细分赛道上完成工程化样板间验证的团队,验证了复旦系"可信具身智能"研究院的产业化路径。

信息来源: https://new.qq.com/rain/a/20260719A08U8Y00

WAIC 2026 进入第三日,具身智能从“展台秀”加速走向“产线考场”,机器人开始以“能不能干满 8 小时”接受验收;与此同时,AI Coding 领域出现一份来自 Databricks 的朴素却有力的实测报告,提醒企业采购应回归自己的代码库。今日重点聚焦产业规模里程碑、双脑具身框架、触觉原生模型、开源编码成本优势与量子混合 Agent 平台。

极智嘉发布 Gravity“双脑”具身框架,首次揭示“一核双引擎”战略

7 月 17 日,极智嘉(Geek+)在 WAIC 2026 发布面向长程复杂任务的统一具身智能框架 Gravity,并率先推出核心模块 Gravity 4D 具身模型。该框架采用“双脑协同(Mixture-of-Transformers, MoT)”架构:认知脑(AR Transformer)负责读懂复杂指令、拆解任务;行动脑(Diffusion Transformer)在动手前进行物理预判,推演不同动作的后果并生成最稳妥的连续动作序列。极智嘉同步揭晓“一核双引擎”通用具身智能布局,即以 Gravity 为技术核心,依托全球智慧物流真实业务网络构建数据飞轮,并通过 GINO ECO 开放生态推动规模化商用落地。

值得关注的原因:长期以来,具身智能领域“语言脑”与“物理脑”各自为政,高层语义规划与低层运动控制难以无缝衔接。Gravity 将二者统一在同一个框架内,使机器人具备“先想清楚、再动手”的完整心智,对从仓储物流向更复杂工业场景迁移的具身系统具有范式意义,也标志着极智嘉从 AGV/AMR 厂商向通用具身解决方案提供商的战略跃迁。

信息来源:极智嘉 WAIC 2026:首发 Gravity“双脑”框架

千觉机器人发布 VTLA 具身触觉模型,构建“模型—数据—硬件”全栈触觉生态

WAIC 2026 期间,千觉机器人集中展示触觉原生技术,发布 VTLA(Vision-Tactile-Language-Action)具身触觉模型,并推出覆盖指尖、夹爪、平面及曲面等多种形态的触觉传感器矩阵。VTLA 模型驱动的现场演示包括:双臂长序列纸盒成型(在纸板被人为移动等干扰下实时感知受力与形变)、耳机精密装配(识别边缘碰撞、姿态偏差和微小滑移并动态纠偏),以及与得物合作的商品真伪鉴定(通过纹理、硬度、弹性等触觉特征完成鞋垫取放与云端校验)。同期亮相的 XTacUMIG1 穿戴式视触觉多模态数据采集夹爪,可同步采集视觉、触觉、位姿轨迹和夹爪状态等多维数据,用于生成具身训练数据集。

值得关注的原因:当前多数具身模型过度依赖视觉,而真实世界的物理交互需要精细触觉反馈。千觉机器人将触觉提升到与视觉、语言、动作同等的模型输入维度,并打通从数据采集硬件到模型训练的全链路,有望解决柔性物料、精密装配、消费品质检等场景中的“看不清、抓不稳”难题,推动机器人从“看见世界”走向“理解世界、交互世界”。

信息来源:WAIC 系列|千觉机器人展示触觉原生技术,发布 VTLA 模型及全栈触觉生态

中国 AI 核心产业规模突破 1.2 万亿元,人形机器人整机企业超 140 家

7 月 19 日,WAIC 2026 主论坛披露数据显示,我国人工智能核心产业规模已突破 1.2 万亿元,人形机器人整机企业超过 140 家,具身智能正加速从概念验证走向制造业真实场景。本届 WAIC 展览总面积首次突破 10 万平方米,1100 余家企业参展,3000 余项展品集中亮相,超 300 款产品全球首发。现场观察人士指出,人形机器人的“考场”已从“能不能动”转向“能不能干满 8 小时”,验收标准越来越贴近真实产线要求。

值得关注的原因:1.2 万亿元和 140 家整机企业是判断中国具身智能产业是否进入规模化阶段的两个关键数字。前者说明 AI 已从技术投入期进入经济产出期,后者意味着人形机器人赛道已聚集足够多元的技术路线与供应链玩家,竞争焦点正从“技术炫技”转向“商业闭环”与“真实交付能力”。

信息来源:AI 行业日报:人形机器人整机企业超 140 家,具身智能正走向制造业场景

Databricks 实测:开源编码模型成本约为前沿闭源模型的三分之二

Databricks 近日用工程师真实提交的代码变更对多款前沿与开源编码模型进行实测,测试横跨十几种编程语言、数百万行代码,覆盖 Bug 修复、功能调整、重构和 API 集成等日常工程任务。结果显示,部分开源编码模型的实际能力与前沿闭源模型处于同一层级,而成本仅约为后者的三分之二。报告同时指出,公开基准排行榜存在“专项调优”与“数据污染”导致的分数膨胀,企业采购不应只看榜单,而应把模型拉到自己代码库中实测。

值得关注的原因:这份报告触及 AI Coding 落地的核心矛盾——公开 benchmarks 越来越像“表演”,而真实工程表现才是采购决策的关键。开源模型以三分之二成本追平前沿模型,意味着企业开始有能力把 AI 编程从“少数团队试点”扩展为“全组织部署”,也预示编码模型市场的竞争将从“参数规模”转向“内部效能账本”。

信息来源:GPT-5.6 与 Grok 4.5 同日发布,但前一天测试显示开源编码模型成本仅为前沿三分之二

图灵量子发布全球首个行业级量子—经典混合 Agent 平台 QAgent

7 月 18 日 WAIC 2026 现场,图灵量子发布 QAgent 平台,首次实现自然语言输入到量子算力调度的端到端闭环。该平台已接入超过 100 项量子—混合行业工具技能,覆盖金融、医药、材料等领域,用户可通过自然语言描述任务,由 Agent 自动编排并调用量子计算资源与经典算法工具。QAgent 将量子计算的复杂参数配置、资源调度与结果解释封装在 Agent 层之后,降低了企业使用量子算力的门槛。

值得关注的原因:QAgent 是 AI Agent 向底层算力形态延伸的一次重要尝试。它把“量子计算”这一高门槛资源转化为可通过自然语言调用的服务,同时验证了 Agent 架构在跨异构计算资源编排中的通用性。对于需要探索量子优势的金融、医药、材料行业而言,这提供了从“了解量子”到“使用量子”的过渡路径,也为 AI Coding 的底层算力编排提供了新的可能性。

信息来源:AI 行业日报:图灵量子发布全球首个行业级量子—经典混合 Agent 平台

WAIC 2026 进入第三日,具身智能从“展台秀”加速走向“产线考场”,机器人开始以“能不能干满 8 小时”接受验收;与此同时,AI Coding 领域出现一份来自 Databricks 的朴素却有力的实测报告,提醒企业采购应回归自己的代码库。今日重点聚焦产业规模里程碑、双脑具身框架、触觉原生模型、开源编码成本优势与量子混合 Agent 平台。

极智嘉发布 Gravity“双脑”具身框架,首次揭示“一核双引擎”战略

7 月 17 日,极智嘉(Geek+)在 WAIC 2026 发布面向长程复杂任务的统一具身智能框架 Gravity,并率先推出核心模块 Gravity 4D 具身模型。该框架采用“双脑协同(Mixture-of-Transformers, MoT)”架构:认知脑(AR Transformer)负责读懂复杂指令、拆解任务;行动脑(Diffusion Transformer)在动手前进行物理预判,推演不同动作的后果并生成最稳妥的连续动作序列。极智嘉同步揭晓“一核双引擎”通用具身智能布局,即以 Gravity 为技术核心,依托全球智慧物流真实业务网络构建数据飞轮,并通过 GINO ECO 开放生态推动规模化商用落地。

值得关注的原因:长期以来,具身智能领域“语言脑”与“物理脑”各自为政,高层语义规划与低层运动控制难以无缝衔接。Gravity 将二者统一在同一个框架内,使机器人具备“先想清楚、再动手”的完整心智,对从仓储物流向更复杂工业场景迁移的具身系统具有范式意义,也标志着极智嘉从 AGV/AMR 厂商向通用具身解决方案提供商的战略跃迁。

信息来源:极智嘉 WAIC 2026:首发 Gravity“双脑”框架

千觉机器人发布 VTLA 具身触觉模型,构建“模型—数据—硬件”全栈触觉生态

WAIC 2026 期间,千觉机器人集中展示触觉原生技术,发布 VTLA(Vision-Tactile-Language-Action)具身触觉模型,并推出覆盖指尖、夹爪、平面及曲面等多种形态的触觉传感器矩阵。VTLA 模型驱动的现场演示包括:双臂长序列纸盒成型(在纸板被人为移动等干扰下实时感知受力与形变)、耳机精密装配(识别边缘碰撞、姿态偏差和微小滑移并动态纠偏),以及与得物合作的商品真伪鉴定(通过纹理、硬度、弹性等触觉特征完成鞋垫取放与云端校验)。同期亮相的 XTacUMIG1 穿戴式视触觉多模态数据采集夹爪,可同步采集视觉、触觉、位姿轨迹和夹爪状态等多维数据,用于生成具身训练数据集。

值得关注的原因:当前多数具身模型过度依赖视觉,而真实世界的物理交互需要精细触觉反馈。千觉机器人将触觉提升到与视觉、语言、动作同等的模型输入维度,并打通从数据采集硬件到模型训练的全链路,有望解决柔性物料、精密装配、消费品质检等场景中的“看不清、抓不稳”难题,推动机器人从“看见世界”走向“理解世界、交互世界”。

信息来源:WAIC 系列|千觉机器人展示触觉原生技术,发布 VTLA 模型及全栈触觉生态

中国 AI 核心产业规模突破 1.2 万亿元,人形机器人整机企业超 140 家

7 月 19 日,WAIC 2026 主论坛披露数据显示,我国人工智能核心产业规模已突破 1.2 万亿元,人形机器人整机企业超过 140 家,具身智能正加速从概念验证走向制造业真实场景。本届 WAIC 展览总面积首次突破 10 万平方米,1100 余家企业参展,3000 余项展品集中亮相,超 300 款产品全球首发。现场观察人士指出,人形机器人的“考场”已从“能不能动”转向“能不能干满 8 小时”,验收标准越来越贴近真实产线要求。

值得关注的原因:1.2 万亿元和 140 家整机企业是判断中国具身智能产业是否进入规模化阶段的两个关键数字。前者说明 AI 已从技术投入期进入经济产出期,后者意味着人形机器人赛道已聚集足够多元的技术路线与供应链玩家,竞争焦点正从“技术炫技”转向“商业闭环”与“真实交付能力”。

信息来源:AI 行业日报:人形机器人整机企业超 140 家,具身智能正走向制造业场景

Databricks 实测:开源编码模型成本约为前沿闭源模型的三分之二

Databricks 近日用工程师真实提交的代码变更对多款前沿与开源编码模型进行实测,测试横跨十几种编程语言、数百万行代码,覆盖 Bug 修复、功能调整、重构和 API 集成等日常工程任务。结果显示,部分开源编码模型的实际能力与前沿闭源模型处于同一层级,而成本仅约为后者的三分之二。报告同时指出,公开基准排行榜存在“专项调优”与“数据污染”导致的分数膨胀,企业采购不应只看榜单,而应把模型拉到自己代码库中实测。

值得关注的原因:这份报告触及 AI Coding 落地的核心矛盾——公开 benchmarks 越来越像“表演”,而真实工程表现才是采购决策的关键。开源模型以三分之二成本追平前沿模型,意味着企业开始有能力把 AI 编程从“少数团队试点”扩展为“全组织部署”,也预示编码模型市场的竞争将从“参数规模”转向“内部效能账本”。

信息来源:GPT-5.6 与 Grok 4.5 同日发布,但前一天测试显示开源编码模型成本仅为前沿三分之二

图灵量子发布全球首个行业级量子—经典混合 Agent 平台 QAgent

7 月 18 日 WAIC 2026 现场,图灵量子发布 QAgent 平台,首次实现自然语言输入到量子算力调度的端到端闭环。该平台已接入超过 100 项量子—混合行业工具技能,覆盖金融、医药、材料等领域,用户可通过自然语言描述任务,由 Agent 自动编排并调用量子计算资源与经典算法工具。QAgent 将量子计算的复杂参数配置、资源调度与结果解释封装在 Agent 层之后,降低了企业使用量子算力的门槛。

值得关注的原因:QAgent 是 AI Agent 向底层算力形态延伸的一次重要尝试。它把“量子计算”这一高门槛资源转化为可通过自然语言调用的服务,同时验证了 Agent 架构在跨异构计算资源编排中的通用性。对于需要探索量子优势的金融、医药、材料行业而言,这提供了从“了解量子”到“使用量子”的过渡路径,也为 AI Coding 的底层算力编排提供了新的可能性。

信息来源:AI 行业日报:图灵量子发布全球首个行业级量子—经典混合 Agent 平台

WAIC 2026 进入第二天,腾讯集中释放具身智能全栈方案与 WorkBuddy 独立 App 两枚重磅炸弹;RoboScience 首秀全球首个云端具身大模型 Visics,"一脑多手、30 秒换手"改写跨本体操作规则;Claude Code 七月大更新则为编程 Agent 系上安全围栏——从"放权"到"限权"的范式切换正在同步发生。

腾讯 WAIC 发布具身智能全栈方案 + WorkBuddy 独立 App

7 月 18 日,腾讯在 WAIC 2026 正式升级发布具身智能全栈方案,贯穿云底座、模型层、平台层与应用层。模型层推出 Hy-Embodied-VLA-0.5(视觉-语言-动作统一建模)、Hy-Embodied-VLM-1.0(十分之一计算量达旗舰性能)与 Hy-Embodied-RxBrain-1.0(首创文本推理+视觉想象连续认知协同);智能体层发布 TairosAgent 框架与 Apexio 智能体,整合"大脑""小脑"与身体为持续感知-决策-行动闭环;基础设施层推出业内首个云端 EaaS(Embodied-AI-as-a-Service)服务。同期,WorkBuddy 独立 App 登陆 iOS/Android/鸿蒙三端,成为首个支持鸿蒙的通用智能体应用;ADP 4.0 海外版上线,接入 LINE/Telegram 等海外渠道。

值得关注:腾讯首次系统性展示从基座模型到云服务的全栈链条,标志互联网巨头从"做模型"转向"做产业底座"——EaaS 让给机器人装大脑像接云服务一样简单。WorkBuddy 独立 App 三端齐发则印证了 AI Agent 从对话工具走向全场景工作 OS 的趋势。

来源:新浪财经 | 环球网

RoboScience Visics:全球首个云端具身大模型"一脑多手、30 秒换手"

首次亮相 WAIC 的 RoboScience(机器科学)把具身智能最难啃的骨头搬上台面:跨灵巧手操作。同一颗"大脑" Visics 驱动多款灵巧手,现场拆手换手后 30 秒重新开工——无需重新采集数据或现场训练,行业首次实现灵巧手的"一脑多手、换手即用"。Visics 同时以纯软件形态部署在云端,成为全球首个具备云端部署能力的具身大模型,给机器人"装大脑"从此像接入云服务一样简单。现场连闯三关:换本体、换物品、换任务,观众随机指定物品也能即时完成识别与抓取。

值得关注:跨本体操作是具身智能的公认痛点——换手意味着动作空间、控制方式、硬件参数全部改变,传统方案需要重新采集数据+训练+适配。Visics 的"换手即用"本质上是在模型层实现了硬件抽象,将"入职培训"成本压缩到 30 秒,直接挑战当前绑定自家硬件交付"大脑"的主流商业模式。

来源:新浪财经

腾讯×越疆:Physical AI"深圳方案"在真实产线跑通全链路落地

WAIC 期间,腾讯 Robotics X 与越疆联合发布了一份被真实产线持续验证的方案:在全球头部化妆品企业的真实产线工位上,越疆机器人承载腾讯 VLA 模型完成训练与部署,任务成功率超过 95%。面对随机来料、规格材质不一的工件、固定且紧迫的产线节拍,机器人持续完成精准识别、抓取与装配。此前越疆空弈 DobotWAM 在 LIBERO 四个标准套件取得平均 99.25% 成功率,但仿真中的"标准答案"无法应对工厂的"开放题",此次真实产线验证才是从实验室到工厂的跨越。

值得关注:VLA 模型在真实产线的落地验证被视为具身智能从实验室走向产业的关键节点。仿真环境学的是"标准答案",工厂产线全是"开放题"——光照变化、来料随机、节拍固定、工件各异。95% 成功率在真实工厂持续运行,标志着 Physical AI 从论文+仿真+展台演示真正进入了"日常打工"阶段。

来源:上观新闻

Claude Code 七月大更新:后台 Agent 围栏 + 成本控制

7 月 17 日 Anthropic 发布 Claude Code v2.1.212,核心主题是让长 Agent 会话可控:/fork 命令将整段对话复制到独立后台会话运行(原 /subtask 改名),主会话可继续工作;新增 session 级 web search 上限(默认 200 次)和 subagent spawn 上限(同 200 次,/clear 重置),防止 Agent 陷入循环烧 token;超过 2 分钟的 MCP 工具调用自动转入后台保持会话响应性;/resume 改为交互式选择器而非手动输入 ID。此前一周 Copilot CLI 硬阻塞 plan 模式下的文件编辑、Codex 0.144.5 加强危险命令检测——三家 Coding Agent 在同一周集体收紧自主权限。

值得关注:过去一年的叙事是"让 Agent 自主运行",本周三家巨头同时系上安全围栏——从"放权"到"限权"的范式切换正在发生。异步 Agent + 成本上限 + 循环阻断的组合,把编程 Agent 从"需要人类时刻看护的高能婴儿"推向"具备工程直觉的自律系统",比任何单点 benchmark 更接近生产力重构。

来源:Claude Code changelog | EveryDev.ai

xAI 开源 Grok Build 终端 Agent(Apache 2.0)

本周 xAI(现 SpaceXAI)将终端 Agent "grok" 的完整 Rust 源码以 Apache 2.0 许可发布在 GitHub,已获约 13,000 stars。这不是 API wrapper,而是 xAI 内部使用的同款终端 Agent 真实源码——编辑文件、运行命令、持长任务、接入 MCP/skills/hooks。但需注意:仓库仅以延迟方式镜像内部 monorepo,不接受外部贡献,尚未有 tagged release,实质是"读源码+自编译"而非"加入社区"。

值得关注:三家美国 AI 巨头(Anthropic/OpenAI/xAI)的终端 Coding Agent 源码现在全部可见(Anthropic Claude Code 已开源核心逻辑、OpenAI Codex 有详细文档、Grok Build 完整源码),编程 Agent 的技术壁垒正在从"代码秘密"转向"数据飞轮+工程治理"。对开发者而言,阅读三套源码是理解 Agent 工程化的最佳入口。

来源:GitHub | Geek Source Codes

今日 AI 行业的焦点是「WAIC 2026 开幕 + 万亿参数开源模型 + 灵巧手全栈化」三线交汇:WAIC 上 60 台人形机器人首次以"志愿者"身份规模化上岗,标志具身智能从展品迈入同事角色;月之暗面 Kimi K3、美团 LongCat-2.0 同日放大招,国产开源大模型正式跨入万亿级生态竞争;瑞士 Mimic Robotics 把灵巧手+外骨骼+模型做成全栈管道,把"数据荒"工程化。AI 编程与具身智能在 2026 年中段同步跨过规模化门槛。

月之暗面发布 Kimi K3:全球首个 2.8 万亿参数开源模型

7 月 16 日,北京月之暗面在 WAIC 2026 开幕前夕正式发布 Kimi K3,总参数 2.8 万亿,是目前全球规模最大的开源大模型。K3 基于自研的 KDA 混合线性注意力(Kimi Delta Attention)+ 注意力残差(Attention Residuals)架构,原生支持视觉理解,配备 100 万 token 上下文窗口,主要面向长程软件工程、知识工作、深度研究和多模态理解。MoE 扩展到 896 专家激活 16,结合 Stable LatentMoE 框架后整体扩展效率较 K2 提升约 2.5 倍。

值得关注的是,K3 整体表现仍略逊于 Claude Fable 5 和 GPT-5.6 Sol,但稳定超过其他所有模型,并在长周期软件工程等代码基准上突出。月之暗面年内已完成 6 轮融资,最新投前估值 315 亿美元,年度经常性收入突破 3 亿美元,API 收入占比超七成——开源战略正在把"估值-收入-生态"三件套重新耦合。完整模型权重将于 7 月 27 日前发布,可通过 kimi.com、Kimi App、Kimi Work、Kimi Code、Kimi API 即时调用。开源战已从"中国能不能造"转向"中美开发者生态怎么打"。

信息来源:https://www.ce.cn/xwzx/gnsz/gdxw/202607/t20260717_3091867.shtml

美团开源 LongCat-2.0:1.6 万亿参数 Agentic Coding 模型完成国产 5 万卡全流程

7 月 17 日,美团技术团队正式开源 LongCat-2.0,总参数 1.6 万亿、平均激活约 480 亿,是行业首个在 5 万卡国产算力集群上完成全训练+推理生命周期的万亿级模型。LongCat-2.0 主打 Agentic Coding 任务,原生支持 100 万 token 长上下文,引入 LongCat 稀疏注意力与 N-gram Embedding 两项架构创新以提升长上下文效率与 token 级表征,并同步发布对国产硬件优化的推理代码,配套开源 VitaBench 2.0 长期动态智能体评测基准。

5 万卡国产全流程 + 动态激活 48B + 100 万上下文 + 国产硬件推理优化 = 国产大模型第一次把"算力-模型-推理-评测"四件套在同一份发布里闭环。LongCat-2.0 既是 Agentic Coding 基础设施升级,也是国产 GPU 在万亿参数级别"跑得动+训得起"的关键背书。

信息来源:https://aitoolly.com/en/ai-news/2026-07-17

WAIC 2026 开幕:智元远征 A3 Ultra 成唯一入选"镇馆之宝"的人形机器人

7 月 17 日,2026 世界人工智能大会(WAIC)暨人工智能全球治理高级别会议在上海开幕,主题为"智能伙伴,共创未来",首次采用"三地四馆"办展模式,1100 余家企业参展,3000 余项展品亮相,超 300 款产品全球首发,展览面积首次突破 10 万平方米。158 场论坛、1500 余位院士与企业家参与,规格创历届新高。智元机器人尚未发布的"远征 A3 Ultra"成为本届"镇馆之宝"中唯一入选的人形机器人展品,也是为数不多的"未发布先拿奖"产品。

A3 Ultra 整机身高 174cm,搭载 360° 视觉融合激光雷达、700 TOPS 算力与三层异构计算架构,配合 UWB+RTK 厘米级融合定位,标配高阶灵巧手,可独立完成接待、讲解、巡检等标准化服务,全天候不间断作业。大会期间约 60 台人形机器人首次以"志愿者"身份承担导览与问询支持,续航 10 小时并支持自主充电——情境大模型的成熟让机器人从"展品"正式转岗为"同事"。208 款具身智能终端、超 300 台真机集中亮相,宇树、智元、傅利叶等头部企业同台。

信息来源:https://so.html5.qq.com/page/real/search_news?docid=70000021_5756a58cc0626952

瑞士 Mimic Robotics 发布 M1 灵巧手 + U1 外骨骼:把"数据荒"做成全栈管道

7 月 16 日,瑞士苏黎世/旧金山 Physical AI 公司 Mimic Robotics 正式发布仿生机械手 M1 与可穿戴外骨骼 U1,主打工业级通用灵巧操作。M1 拥有 15 个主动自由度、21 个关节,电机全部放在前臂并通过腱绳驱动手指,反向驱动阻力低于 0.05Nm,可通过电机电流感知约 50g 的重量变化,负载能力超过 25kg,指尖集成法向力与剪切力触觉传感器。U1 则把人手约束在 M1 的运动空间内,关节编码器、触觉传感器和腕部相机与机器人一一对应,从源头消除传统遥操作的 retargeting 误差。

Mimic 提出了"数据金字塔":底层人类视频做预训练,中层可穿戴设备做精细对齐,顶层机器人本体遥操做部署优化。整套硬件+软件+模型自研,团队来自 Google DeepMind、特斯拉 Optimus、ETH、MIT、斯坦福。公司明确表示不追人形整机,而是把"人手"作为固定接口做深,再把策略迁移到任意机械臂上。这是物理 AI 公司第一次把"硬件可观测性 + 数据质量分层 + 模型跨形态迁移"打包成产品级解决方案。

信息来源:https://www.mimicrobotics.com/en/blog/solving-dexterity-a-full-stack-approach

阿里 Qwen3.6-Plus:27B dense 模型登顶国产编程模型,单卡 4090 可跑

7 月 14 日,阿里通义千问发布 Qwen3.6-Plus,27B 稠密参数在 SWE-bench Verified 上拿到 77.20%、LiveCodeBench 拿到 83.90%,均为国产第一,且以不到 GLM-5 与 Kimi K2.5 三分之一到二分之一的参数规模实现系统性超越。Q8_0 量化后仅需 27GB 显存,单张 RTX 4090 即可在本地启动 server,十分钟内接入 OpenCode、Hermes、Claude Code 等主流 Agent 框架。

Qwen3.6-Plus 同步支持多模态 Agentic Coding:在 Claw-Eval 真实世界智能体评测中超越所有国产竞品,给一句"帮我做一个在线番茄钟"可自主完成需求拆解、前端规划、代码编写、测试与交付。OpenAI 兼容协议 + 27B dense + 4090 可跑 + 多模态 Agent —— AI 编程"高能力"与"低部署门槛"在同一个产品里合体,把"代码必须上云"的隐含假设撕碎,也把 Agentic Coding 从口号推向桌面。

信息来源:https://www.toutiao.com/article/7662562385139401235/