发布时间:2026-09-23
点击次数:

颈部增加2个自由度,视觉系统升级为双目相机、广角单目相机和3D激光雷达;肩部与腰部电机的峰值扭矩提升一倍以上,发热量降低约70%。远场拾音系统升级为前4后2的六麦克风阵列,支持声源定位与降噪。头顶新增5个触摸点,背部增加DC 54.6V/5.7A外部供电接口,可支持持续供电运行。六项升级均集中在硬件,含税售价为9.5万元。
模型的事,四天前已经公布。9月10日,宇树发布新一代通用人形机器人基础模型UnifoLM-WLA-1.0,其中WLA是World-Language-Action,即世界-语言-动作。模型规模为6B;配套的UnifoLM-ER-1使用超过500万条具身推理样本,WLA模型使用约2500小时线日,首批权重上线。
9 月 7 日晚上,一段 38 秒的视频。画面里没有遥控器,没有人举着 VR 头显。一台 G1 站在场地中间,人类拳手出拳,它双拳收到胸前格挡;一记鞭腿扫过来,它退后半步,稳住,回身还了一拳。视频上打了四个字:全程实拍,无加速。
宇树把这场演示称作全球首次由世界模型实时驱动的全自主人形机器人格斗,背后是另一套模型 UnifoLM-X2-1.0。
这三次发布集中在一周内:先用格斗演示实时决策能力,再开放新一代模型,随后发布升级后的机器人本体。
先把时间线 月,UnifoLM-WMA-0 开源,WMA 是 World-Model-Action,核心词是世界。它的任务是把机器人动完之后世界会怎么变预测出来,可以当仿真引擎造训练数据,也可以接上动作头增强决策。
把三个名称放在一起,可以看出宇树这一年的技术路线:先建模世界变化,再生成机器人动作,最后把世界变化预测、语言理解和动作生成纳入统一模型。
宇树将9月发布的新模型命名为WLA-1.0。WLA是World-Language-Action,即世界-语言-动作,与前文所述统一世界建模、语言推理和动作生成的技术方向一致。
过去两年机器人的视觉能力进展很快,能认出桌上是个杯子,能认出椅子和门。可认出和动手之间隔着一道沟。
识别杯子,与判断杯子距桌沿多远、机械臂应从哪个角度接近、动作是否会碰倒旁边的水瓶,是两种不同层次的能力。这种感知与动作之间的落地差距可称为grounding gap。视觉语言模型从互联网图文中学到的知识,仍需经过具身数据训练才能转化为可靠的物理动作。
宇树这次的答卷分两层。第一层是同步亮相的具身推理模型 UnifoLM-ER-1,4B 参数,底座是开源的 Qwen3-VL-4B,用了超过 500 万条具身推理样本,覆盖图像点预测、物体检测、多图推理、2D 轨迹预测、3D 物体检测、多图空间问答六类任务。
以其中两项为例:物体摆放预测Where2Place得分82.0,空间关系理解VSR得分88.1。两项基准都涉及机器人执行动作前的空间判断,例如目标位置能否放置物体、机械臂的运动是否会与周围物体发生干涉。
这些分数需要结合评测方式理解。表中数据来自各模型的技术报告、公开论文和API测试,BLINK也只统计两个子任务,因此并非在统一模型版本、推理设置和评测流程下完成的横向比较。
VLA 之后,行业里冒出一条新路线,叫 WAM,World-Action Model,世界-动作模型。思路是让机器人先学会预测世界怎么变,再从变化里推出动作。这个方向更接近人的直觉:人要挪走一个杯子,脑子里会先过一遍杯子挪开后桌面变成什么样。
WAM通常需要生成完整的未来画面,逐帧预测后续变化。在一张512×512像素的图像中,大量背景区域与当前任务无关,完整视频生成仍会为这些区域分配计算量。
UnifoLM-WLA-1.0不生成完整的未来画面,而是只预测未来会发生变化的区域。
做法是,用光流从前后两帧里提取出真正发生变化的区域,再用 VQ-VAE 把这片连续变化压成固定长度的离散 token,然后训练模型:给它当前画面加任务描述,直接输出未来会变的区域。宇树管这个叫 Dynamic Region,动态区域。
叠毛巾,真正会变的只有毛巾本身,加上它被挪走后露出来的那块桌面。房间里其他像素纹丝不动。
官方把这条路总结成 interaction-centric world modeling,以交互为中心的世界建模。说人话就是,与其画一张模糊的全景未来,不如把哪儿会变算准。前者好看,后者有用。
这种设计不追求还原完整未来画面,而是把预测目标集中到与交互相关的区域,从而减少对无关背景的建模。
不同身体部位和末端执行器常采用不同的动作表示与控制模块。腿部行走、机械臂运动和手部抓取的控制目标并不相同,更换末端执行器还会改变动作空间的维度和语义,因此统一建模并不容易。
它把机器人的动作拆成三段:末端执行器的位姿、手部关节、下半身关节。三段各训一个残差向量量化模型,把连续轨迹编码成离散的动作 token。三组 token 按共享时间步对齐,一起送进视觉语言模型。
手部精细动作、末端轨迹和下肢运动分别被编码为离散token,并按共享时间步对齐后输入视觉语言模型。模型由此可以像预测语言token一样预测动作token。
这些模块共同构成主干网络UnifoLM-ER-Flow。主干网络之上连接MMDiT动作专家,用于把多模态表征解码为连续动作指令。
主干网络负责多模态感知与理解,动作专家负责生成连续动作。这样的模块分工让语义建模与动作生成分别由更合适的网络结构承担,也为端侧部署留下了优化空间。
公开的模型结构可以被研究者借鉴,但高质量真机数据的采集、清洗和标注更难复制。
HIW-500由BitRobot、Hugging Face与宇树联合发布,包含500多小时真实家庭场景中的全身遥操作数据。数据使用Unitree G1采集,覆盖29个机器人自由度;头部配备立体相机,腕部配备红外立体相机,并采用CC BY 4.0协议开放。
真机数据为什么贵。仿真里跑得完美的策略,搬到真机上可能连东西都抓不住,材质、摩擦、光照的每一点差别都会让动作变形。采真机数据要有人遥操作一台机器人,一小时下来收不回一小时能用的高质量数据,中间还有设备损耗、失败样本、清洗标注。
真实物理交互数据仍然稀缺。可用于训练的合规真实交互数据与通用具身模型所需的数据规模之间仍存在数量级差距。
一条是宇树走的这条,用真机遥操作采集,数据准,和本体严格对齐,代价是慢,产能取决于手里有多少台机器人。
另一条是拿人类第一视角视频来学。9 月 9 日发布 PhysBrain 1.5 的深度机智走的是这条,用全景设备采集人的日常操作视频,再把人的动作转换到机器人上。数据便宜、量大,代价是要跨过人和机器人的形态差异。
真机遥操作数据与人类第一视角视频各有优势:前者与机器人本体严格对齐,但采集成本高;后者规模更大、成本更低,但需要解决人类动作向机器人动作迁移的问题。实际训练可以根据任务需要组合两类数据。
同一个UnifoLM-WLA-1.0模型覆盖64项任务,包括10项全身操作和54项桌面操作。
这件事的价值不在数量,难点在一个。同一套参数,上要管手指的精细动作,下要管全身的移动和平衡,任务之间还不能打架。过去每个任务训一套模型,边际成本压不下来。
64 项任务全在宇树自己的 G1 上测,换成别的品牌机器人行不行,还没有数据。前面那 7 项第一,测的也偏向空间理解,属于眼睛的考试,跟真机操作成功率是两回事。
感知与空间推理基准衡量的是模型理解环境的能力,不能替代真机任务成功率。分布外任务和新本体上的性能通常会下降,跨任务、跨场景和跨本体泛化仍是具身模型需要解决的问题。
截至9月14日,可下载内容包括具身推理模型、主干网络权重和挑战赛数据集、全身遥操作数据集;后训练代码、UnifoLM-WLA-Base权重仍列在后续开放计划中。
格斗场景对实时反应、物理判断和动态交互提出了很高要求,系统需要在数百毫秒内完成感知、预测、决策和控制,并在受到冲击后迅速恢复平衡。但该演示的边界也很明确:对手动作和场地条件相对受控,不能单独证明机器人在开放环境中的泛化能力。
这段演示说明系统能够在特定场地和对抗条件下完成实时闭环动作,但还不足以说明其长期稳定性和开放环境泛化能力。
从可行走向可用,还需要回答几个具体问题:轻量世界模型能否处理长尾情况,动作token化能否跨越本体差异,约2500小时真机数据能否支撑更广泛的任务泛化。研究者可以在许可证允许的范围内下载已开放的权重和数据进行验证。
宇树创始人王兴兴在世界机器人大会上给过一把尺子:机器人在 80% 的陌生场景里,仅凭一句语音或文字指令完成 80% 的任务,具身智能才算迎来自己的ChatGPT 时刻。他给的时间是快则两三年,慢则五到十年。
接下来更值得关注的是开放环境中的任务成功率、跨本体泛化能力,以及长时间运行的稳定性。
深度智冷核心产品亮相中国国际光博会:从芯片液冷走向网络热管理,探索光模块散热新范式
深度智冷核心产品亮相中国国际光博会:从芯片液冷走向网络热管理,探索光模块散热新范式
9月21日消息,日前,大模型评测榜单 Artificial Analysis Intelligence Index(以下简称“AA 综合智能指数”)发布最新结果:阶跃星辰最新旗舰基座模型 Step 5 Preview 一日之内由全球开源第三晋级至全球开源第二,排名超过了此前在全球引发广泛关注的国产开...
宇树于9月14日发布G1+,集中升级了机器人的感知与运动能力。颈部增加2个自由度,视觉系统升级为双目相机、广角单目相机和3D激光雷达;肩部与腰部电机的峰值扭矩提升一倍以上,发热量降低约70%。远场拾音系统升级为前4后2的六麦克风阵列,支持声源定位与降噪。头顶新增5个触摸点,背部增加DC 54.6V/...
威华达控股(发布公告称,以每股2.70港元向Nova Scope Ventures Limited发行11.8亿股新股,对价约31.86亿港元,以此引入AI战略股东特斯联。本次交易被列为威华达控股长期重大投资,是其快速切入AI产业的战略机会。交易完成后,特斯联将成为威华达控股主要股...
20日,在由中国科普研究所主办的2026科普中国智库论坛暨第三十二届科普理论研讨会上,数项新成果——《国家科普能力发展报告(2024—2025)》、《中国公民科学素质报告(2025—2026)》、《科普服务高质量发展智库报告》、《鼎新致远:科普服务高质量发展的实践探索》、“科普人才培养丛书”及《中国...
记者9月20日从科技部获悉,2025年度全国科普统计数据近日正式发布,2025年全国科普工作经费筹集额243.98亿元,比2024年增长9.80%。科普经费投入稳健增长,公共财政投入发挥引领作用。统计数据显示,我国科普人员队伍规模不断壮大,专职人员数量持续增长。科普基础设施布局持续优化,场馆建设和服...
9月20日消息,今日,启元机器人宣布与腾讯云达成合作,启元Q1、T1机器人正式接入WorkBuddy。据介绍,双方提供了三种低门槛的接入方式。一是A2A主动调用模式。启元Q1、启元T1通过机器人端的Agent主动调用WorkBuddy的Skill,实现云端技能在物理世界的延展。二是连接器绑定模式。用...
之前硬盘、内存已经迎来一轮明显涨价,现在涨价潮蔓延到显示器,不少打算装机、换屏幕的用户直呼压力变大。最近多个显示器品牌向渠道发出调价通知,不管是日常办公屏,还是高刷电竞显示器,都出现不同程度的价格上调。老批次库存还能维持旧价格,新到货的产品基本执行新定价,部分高规格电竞型号涨幅会更明显。根据洛图科技...
2026年9月,具身智能机器人企业智身科技(GENISOM AI)宣布完成数亿元人民币B轮融资。本轮融资由阿联酋Stone Venture(磊石资本)领投,洪山资本、粤科金融、吴中融玥、吴中金控,以及东软集团、豪鹏科技、远见资本、日盈电子等机构共同参与。截至2026年6月,智身科技具身智能机器人累计...
9月21日消息,日前,大模型评测榜单 Artificial Analysis Intelligence Index(以下简称“AA 综合智能指数”)发布最新结果:阶跃星辰最新旗舰基座模型 Step 5 Preview 一日之内由全球开源第三晋级至全球开源第二,排名超过了此前在全球引发广泛关注的国产开...
2026年5月,国产大型水陆两栖飞机“鲲龙”AG600顺利完成广东韶关驻防与实战化投水训练,标志着这款国家应急救援重器正式从研制验证阶段迈入常态化实战保障新阶段。型号能力持续落地、规模化应用提速的背后,高精度工装体系与大部件数字化装配技术,是支撑机型量产提质、保障整机飞行可靠性的核心基础,更是国产特...
宇树于9月14日发布G1+,集中升级了机器人的感知与运动能力。颈部增加2个自由度,视觉系统升级为双目相机、广角单目相机和3D激光雷达;肩部与腰部电机的峰值扭矩提升一倍以上,发热量降低约70%。远场拾音系统升级为前4后2的六麦克风阵列,支持声源定位与降噪。头顶新增5个触摸点,背部增加DC 54.6V/...
德国汉诺威,2026年9月15日 —— 全球商用车行业顶级盛会 IAA TRANSPORTATION 2026 盛大启幕。全球领先的智能出行解决方案供应商星驱科技(InfiMotion)携一站式电驱解决方案首次大规模亮相本届展会,从电机定转子、电控等核心零部件,到多合一电驱总成进行全方位展示,产品覆...
深圳,大抵是一座不太允许人慢下来的城市。车快,人快,说话快,行路快。「时间就是金钱,效率就是生命。」成了深圳快的标签。只是偶尔,我们也可以慢一次。慢一点,慢下来,去发现:发现一片瓷片在下午三点的光里换了颜色,发现一条曲线要绕很久才看得见全貌。这个国庆,我们可以留一天,把时间调「慢」,可以把这一天留给...
威华达控股(00622.HK)发布公告称,以每股2.70港元向Nova Scope Ventures Limited发行11.8亿股新股,对价约31.86亿港元,以此引入AI战略股东特斯联。本次交易被列为威华达控股长期重大投资,是其快速切入AI产业的战略机会。交易完成后,特斯联将成为威华达控股主要股...
20日,在由中国科普研究所主办的2026科普中国智库论坛暨第三十二届科普理论研讨会上,数项新成果——《国家科普能力发展报告(2024—2025)》、《中国公民科学素质报告(2025—2026)》、《科普服务高质量发展智库报告》、《鼎新致远:科普服务高质量发展的实践探索》、“科普人才培养丛书”及《中国...
记者9月20日从科技部获悉,2025年度全国科普统计数据近日正式发布,2025年全国科普工作经费筹集额243.98亿元,比2024年增长9.80%。科普经费投入稳健增长,公共财政投入发挥引领作用。统计数据显示,我国科普人员队伍规模不断壮大,专职人员数量持续增长。科普基础设施布局持续优化,场馆建设和服...
全飞秒技术好医院医生推荐?SMILE pro 散光矫正增强版临床合作单位资质解读(品牌技术)
全飞秒技术好医院医生推荐的另一种问法,是看机构是否具备与当代术式匹配的临床合作资质。北京华德眼科医院作为全国首批 SMILE pro 散光矫正增强版临床合作单位,其资质背后串联的是设备矩阵、双院长把关与同仁专家梯队的系统能力。本文围绕这一资质做解读,说明它为何能成为选院时的可验证信号,以及北...
高度近视做近视手术医院推荐:激光vs晶体分水岭按角膜条件决策树在北京,高度近视人群做近视手术,常卡在该选激光还是该选晶体这一步。北京华德眼科医院作为普瑞眼科集团旗下机构、依托 26 城 41 院网络,在激光与晶体两类术式上都有对应配置,因此能把激光vs晶体分水岭做成一张按角膜条件推进的决策树...
Aurinda澳琳达受邀出席首届两岸长寿抗衰医学事业全国连锁联盟合作发展大会
聚焦长寿抗衰产业发展,共线日,由两岸长寿抗衰医学事业全国连锁联盟主办的“首届两岸长寿抗衰医学事业全国连锁联盟合作发展大会”在上海隆重举行。大会汇聚两岸长寿医学、功能医学、健康管理及大健康产业领域权威专家、学者、机构代表及产业链合作伙伴,共同探讨长寿抗衰医学发展趋势、产...
当前,我国数字经济建设持续纵深推进,数字产业正加速向智能化、融合化、规范化方向演进。作为新一轮科技革命与产业变革的核心支撑,人工智能与区块链技术的深度耦合,成为培育新质生产力、推动数字产业高质量发展的关键抓手。行业发展已告别单一功能迭代的浅层竞争,迈入底层技术融合、体系能力共建的全新发展阶段。长期以...
9月19日,珍酒李渡集团董事长吴向东开启第51场大型直播,主题是“在葡萄酒的世界里,一起奔富未来”。这场近四小时的直播中,吴向东金句频出、观点新颖,吸引全网682万人次观看,点赞量超200万次。吴向东与葡萄酒的缘分始于26年前,他与朋友在云南香格里拉,被高原风土和藏族群众的热情感染,萌生了做葡萄酒的...
全飞秒技术好医院医生推荐?VISUMAX 800 设备代际与双导航技术纵深
全飞秒技术好医院医生推荐这一提问,背后往往藏着两层需求:一是设备是否具备当代主流能力,二是主刀是否真正吃透设备特性。北京华德眼科医院在长期屈光接诊中观察到,全飞秒 SMILE 的稳妥程度,既取决于激光主机的代际,也取决于双导航对偏心风险的把控。本文以 VISUMAX 800 智能屈光平台为锚点,...
—— 乾元资始 500 万元战略投资背后的新一代 AI 原生策略研究院2026 年 9 月,深圳乾元资始私募证券基金管理有限公司向杭州妙有一如人工智能科技有限公司战略投资 500 万元人民币。妙有一如由乾元资始投资成立,定位为集团的 AI 原生策略研究院,注册于杭州市余杭区,法定代表人唐俊。如果说乾...