304永利集团官网入口-人形机器人「小脑」的GPT时刻来了
首页财产ai正文 人形呆板人「小脑」的GPT时刻来了 星河通用发布全世界首个小脑GPT基模AstraBrain-WBC 0.5,验证运动节制Scaling Law,零样本泛化能力强,结果开源,鞭策人形呆板人成长。 2026-06-19 10:26 ·呆板之心 Panda、泽南 Panda、泽南
当人形呆板人仍逗留于「见过才会、练过才行」的样本拟合阶段,难以应答新动作、新指令与漫衍外使命时,星河通用最新发布全世界首 个小脑 GPT 基模AstraBrain‑WBC 0.5,全世界首 个乐成验证运动节制 Scaling Law。
星河通用团队用史上最 年夜、整整 20 亿帧的动捕数据,练习出了全世界首 小我私家形呆板人全身及时运控基座年夜模子,该模子零样本泛化全新动作,乐成率从 MLP 架构的 76.89% 跃至 92.58%,推理延迟仅 0.39ms,效果逾越英伟达 SONIC,甚至比今朝业内主流 TWIST 体系速率晋升至五倍。初次实现范畴外漫衍(OOD)数据的泛化能力,这一研究结果堪比年夜模子的 GPT-1 时刻,弥补人形呆板人通用小脑研究的行业空缺。

这个事情还有被周全开源了出来。

论文标题:Humanoid-GPT: Scaling Data and Structure for Zero-Shot Motion Tracking
论文地址:arxiv.org/abs/2606.03985
代码地址:https://github.com/GalaxyGeneralRobotics/Humanoid-GPT/
这项研究的起点实在很纯粹:把数据堆到本来同类研究的 200 倍以上,换一个 GPT 气势派头的 Transformer 架构,然后看看 Scaling Law 到底管无论用?
结论很直接:管用,并且很管用。
星河通用率先迈进了这片无人区,用对于底层运控能力的冲破树立了行业的新标杆。
数听说话:Scaling Law 于人形呆板人上建立!
Scaling Law 到底于物理世界管无论用?AstraBrain-WBC 0.5 证实它管用了,有三组数据为证!
第 一组:架谈判范围的两重 Scaling ,效果叠加
研究团队于尺度的 AMASS 测试集(练习时未见过的动作子集)上,体系比力了差别架谈判差别数据量的组合。一样利用 200 万帧练习,MLP 的追踪乐成率(SR)为 76.89%,TCN 为 81.48%,而 AstraBrain-WBC0.5-S 已经经到达 83.26%——架构换代自己就带来了晋升。
更要害的变化发生于数据范围扩展以后:跟着练习帧数从 200 万增至 20 亿,AstraBrain-WBC0.5-B 的 SR 从 88.27% 进一步升至 90.43%;最 年夜规格的 AstraBrain-WBC0.5-L 于 20 亿帧练习下终极到达 92.58%。

主干收集架构比力与 Scaling 的影响。
划一数据量(20 亿帧)下,论文给出了一个直接对于比:即即是体现最 好的 TCN 年夜参数版本,其要害点位置偏差(MPKPE)为 56.15妹妹,而参数目更小的 AstraBrain-WBC0.5-S 已经经到达 43.25妹妹,领 先幅度跨越 30%。MLP 及 TCN 并不是没法从更大都据中获益,而是获益的边际于递减;Transformer 的练习丧失曲线则连续降落,没有呈现饱及。

第二组:数据范围溶解,幂律曲线清楚可见
固定模子规格(Humanoid-GPT-B),只转变练习数据量,零样本 MPJPE 的变化轨迹以下:

很较着可以看出:数据每一扩展 10 倍,偏差连续降落,没有呈现拐点。这条曲线恰是Scaling Law 于人形呆板人运动节制上留下的第 一个清楚印记。
第三组:真机验证,仿真结论于真实硬件上复现
研究团队将 AstraBrain-WBC0.5部署在宇树 G1 呆板人上,用四段彻底未见过的跳舞动作做零样本追踪测试,并与 GMT、TWIST、Any2Track 三款当前最强的开源追踪器于不异和谈下对于比。
AstraBrain-WBC0.5揭示出了此前人形呆板人运控体系难以统筹的四项焦点能力:更高自由度的全身协同节制,更高动态的运动能力,毫秒级及时相应,更高的鲁棒性。


以 MPJPE(枢纽关头位置偏差)作为权衡尺度,Humanoid-GPT-B 于四段动作中均低在或者持平所有对于比喻法。须知,这些动作直接来自收集视频的运动重定向,没有任何专项数据增补,也没有颠末微调。

于四种未见过的跳舞动作上的真实世界跟踪正确度
工程部署层面一样没有拖后腿。颠末 TensorRT 编译及 C++ 流水线优化后,AstraBrain-WBC0.5的平均推理延迟降至 0.39 毫秒,节制回路维持于 50Hz 及时频率;与对于比体系 TWIST(均值 2.79 毫秒)比拟,推理速率晋升约 5 倍。范围更年夜的模子,反而跑患上更快,这患上益在针对于因果留意力及 MLP 交融算子的专项内核优化。

差别优化要领的推理延迟比力

将来,呆板人练习再也不需要从零最先构建动作能力,可以直接基在 AstraBrain-WBC0.5举行二次开发与能力扩大。这将年夜幅降低呆板人练习门坎。
那末,AstraBrain-WBC0.5是怎样做到的?
AstraBrain-WBC0.5做到了三件事
详细而言,AstraBrain-WBC0.5体系性地回覆了三个问题:
动作数据能不克不及扩到十亿级?
节制模子能不克不及像 GPT 同样随数据增加继承变强?
范围变年夜以后,练习还有能不克不及不变、可部署?

AstraBrain-WBC 0.5 概况。该体系包罗三个阶段:(a) 数据收拾与处置惩罚,(b) 基在要害点奖励于集群上练习采用 PPO 算法的运动专家模子,(c) 经由过程并行 DAgger 监视将全数专家模子蒸馏为单一基在 Transformer 的 generalist 计谋。由今生成的 AstraBrain-WBC 0.5 可以或许将未见过的或者于线重定向的运动作为参考输入,并以彻底零样本的方式举行跟踪。
第 一件事:把数据堆到 20 亿帧
研究团队汇总了人类运动捕获范畴险些所有主流开源数据集,包括 AMASS、LAFAN一、Motion-X++、PHUMA、MotionMillion,并增补了跨越一千小时的年夜范围自采动作数据。

比拟传统动作数据集中年夜量反复的行走、站立等高频动作,新数据集笼罩一样平常动作、跳舞、快速转向、颠仆恢复、协作搬运等多种长尾场景,再颠末严酷筛选、支解及增广,获得20 亿帧颠末重定向处置惩罚的 G1 呆板人枢纽关头运动数据。

这是此前同类练习集范围的200 倍以上。

AstraBrain-WBC 0.5 的数据漫衍环境
然而数据量自己还有不敷。年夜范围数据集有一个隐患:常见动作会把不常见动作「沉没」,模子只学会了中间那些平平无奇的程序,对于高难度动作依然力所不及。
为此,团队设计了一种叫做「谐波运动嵌入(Harmonic Motion Embedding / HME)」的暗示进修东西,从每一条运动序列中提取各枢纽关头的振动频率及幅度特性,并据此将所有数据聚类成约 300 个气势派头各别的动作簇,实现了多样性感知的平衡采样。

于 HME 嵌入空间中,数据集多样性的比力,可见星河通用团队收拾的数据集于 HME 空间里的 log-volume 比 AMASS 约莫高 4-5 倍。
试验证实,二者缺一不成:数据多样但漫衍不平衡,模子仍会过拟合常见动作;漫衍平衡但多样性不敷,能力上限就被数据的笼罩规模卡死。研究团队将这一洞察称为「Diversity and Balance」原则,这也是此前所有运动数据集从未体系考量过的维度。
也就是说,AstraBrain-WBC 0.5 不是简朴把数据「堆年夜」,而是于做一件更难的事:让年夜范围动作数据变患上可器量、可划分、可练习。
第二件事:用对于架构
已往的运动追踪器年夜多利用 MLP 或者 TCN(时序卷积收集)。这些架构的问题于在,它们对于序列汗青的建模能力有限,并且到了必然范围后增长参数险些再也不带来收益。
AstraBrain-WBC 0.5 转向了 GPT 气势派头的因果 Transformer 架构。这可不是「跟风 LLM」,其暗地里有一条周密的技能逻辑。

运动追踪素质上是一个于线序列决议计划问题:呆板人于每一个时刻需要按照当前状况及汗青轨迹,猜测出下一帧的枢纽关头指令。这个问题自然有时序依靠——你此刻迈出的这一步,及上一秒的重心、速率、姿态都强相干。
MLP 的致命伤正于这里:它每一次只能「看」一个时刻的状况切片,对于更长的汗青序列只能靠拼接输入到临时充数,建模能力从底子上就受限了。
Transformer 的自留意力机制则差别。它可让模子于序列中的每一个位置同时「回望」此前肆意长度的汗青,捕获到「当前动作与 32 帧前的某个特定姿态」之间的联系关系。这种长程依靠瓜葛,恰是联贯、流利的全身运动所必须的。
但还有有一个要害约束:呆板人节制是及时的,不克不及看到将来。这就是「因果(Causal)」的来历:AstraBrain-WBC 0.5 于留意力层插手了时序因果掩码,严酷限定模子只能使用当前帧和以前的汗青,推理时不依靠任何前瞻信息。
这使患上统一个模子于练习时是并行处置惩罚整段序列(效率高),于推理时是逐帧自回归猜测(延迟低),两种模式自然同一,没有布局上的割裂。
还有有一个被轻易轻忽的上风:练习效率的质变。
AstraBrain-WBC 0.5 的蒸馏阶段采用 DAgger 框架,每一次迭代需要对于整条运动序列中的所有汗青时刻同时施加监视旌旗灯号。MLP 每一次只能处置惩罚单个时间步,想笼罩一条长序列患上轮回 N 次;Transformer 一次前向计较就能处置惩罚整段序列的所有位置,练习吞吐量直接拉开数目级差距。于 20 亿帧的数据范围下,这是可否于合理时间及计较成本内完成练习的要害。
论文中的溶解试验也验证了「汗青长度」的价值:序列长度从 4 帧增至 64 帧,追踪乐成率连续晋升;团队终极选定 32 帧作为默许配置,于机能与计较开消之间取患上均衡。这自己就是对于「长程时序建模能力真的有效」的直接证实。

第三件事:专家蒸馏的流水线
直接用一个模子训完 20 亿帧是不实际的。团队的做法是「先分后合」:于 300 个运动族群上各自练习 PPO 强化进修专家计谋(约 384 个专家),每一个专家只卖力本身阿谁气势派头的动作,是以都能高保真地完成族群内的动作;再用 DAgger 蒸馏框架,让单个 Transformer 模子同时向所有专家进修,终极压缩为一个同一的通用计谋。
专派别量自己也颠末了体系的溶解验证。簇数太少(如 128 个)象征着每一个专家卖力的动作气势派头过在稠浊,单个专家的追踪质量会降落,蒸馏出来的通才也响应变弱;但簇数太多(如 1024 个)则会让相邻专家之间的监视旌旗灯号互相抵牾,反而给学生模子带来杂乱。试验注解,约 384 个专家是当前数据范围下多样性、专家质量及练习成本的*均衡点。

整个练习历程泯灭约 15000 GPU 小时,此中 75% 用在专家练习(RTX 4090),25% 用在 Transformer 蒸馏(H100)。

一旦蒸馏完成,部署时只需要这一个通才模子,384 个专家就能够「知难而退」,再也不需要保留。

AstraBrain-WBC 0.5 与相干事情的比力
终极形成的 AstraBrain-WBC 0.5 模子参数范围到达 8040 万级别,已经经靠近 GPT-1 时代的年夜语言模子范围。
为何是星河通用?
AstraBrain-WBC 0.5 暗地里的工业主体是星河通用呆板人(Galbot)。
星河通用建立在 2023 年 5 月,总部位在北京。公司从创建之初便将研发重点放于具身智能「年夜脑」及泛化操作能力上,而非优先寻求双足运动能力。其代表产物 Galbot G1 采用双臂、折叠腿及全向轮底盘设计,被业内归纳综合为「年夜脑优先、身体务实」的技能线路。
从融资节拍来看,星河通用走患上其实不慢。2025 年 12 月,星河通用完成跨越 3 亿美元融资,中国挪动链长基金、中金本钱、央视融媒体基金等机构介入投资,公司估值跨越 30 亿美元。2026 年 3 月,公司再次完成 25 亿元融资,投资方包括国度人工智能财产基金等机构。这也是国度人工智能财产基金初次投资具身智能企业。
贸易化方面,星河通用是海内较早鞭策具身智能呆板人范围落地的企业之一,其呆板人已经进入零售、制造、仓储物流等多个场景。
星河通用于即时零售范畴推出了人形呆板人自立运营零售仓方案,并已经于天下数十家即时零售仓实现范围化部署。依托端到端具身智能模子,呆板人可以或许于数千种 SKU 的繁杂情况中自立完成辨认、分拣、抓取及打包等流程。

该公司还有与美团买药等互助伙伴鞭策人形呆板人聪明药房(聪明药仓)落地,呆板人可于包罗约 5000 种药品 SKU 的情况中完成自立拣选与打包。今朝相干方案已经于北京、上海、广州、深圳、杭州等都会部署,并实现 7×24 小时连续不变运行。
2026 年马年春晚,星河通用成为中心播送电视总台《2026 年春节联欢晚会》指定具身年夜模子呆板人,为公家展示了其具身智能技能与呆板人产物能力。现场,Galbot 呆板人于沈腾、马丽身旁全自立完成盘核桃、叠衣服、货架取物等使命,所有动作由「星河星脑」及时决议计划,而非预设步伐——这是对于呆板人泛化能力的一次高暴光度公然验证。参阅《沈腾:春晚谁家呆板人?大年节夜就扒拉活来了》。

「星河星脑(AstraBrain)」是星河通用自立研发的全身全手端到端具身年夜模子,也是理解 AstraBrain-WBC 0.5 战略意义的要害配景。

星河星脑采用三层类脑架构:「年夜脑」卖力多模态感知与使命计划,「小脑」卖力全身运动协同与及时节制,「神经节制」则处置惩罚结尾灵巧操作与力反馈。业界大都方案将这三层割裂开发,模块之间存于信息损耗,致使相应迟滞及泛化能力衰;星河星脑的方针是买通全链路、实现端到端同一建模。

星河星脑 AstraBrain 框架
正如近日于 2026 智源年夜会主题演讲中,星河通用呆板人开创人王鹤博士所言:「星河通用推出的 AstraBrain(星河星脑),方针就是做一个通用人形呆板人的基座:既有年夜脑、又有小脑,中间经由过程脑桥毗连,让更快的小脑与相对于较慢的年夜脑实现异步同步。人脑中的脑桥现实上分为三路、有上传也有下载,咱们的架构充实参考了人类年夜脑的布局,方针就是实现彻底通用。」
AstraBrain-WBC 0.5 是这套架构小脑能力的揭示:一旦小脑具有了跨场景零样本泛化的能力,星河星脑总体的通用性及迁徙效率就能随之晋升。
顺带一提,AstraBrain-WBC 0.5 论文(Humanoid-GPT)已经被 CVPR 2026 吸收。
「小脑」之争,这一局定了甚么?
于业界,把 Scaling Law 套用到运动节制层方面,AstraBrain-WBC 0.5 不是第 一个测验考试。此前 SONIC 已经经将练习帧数推至 1 亿,但其依然采用 MLP 架构,而试验注解于阿谁范围上 MLP 已经经最先饱及。

AstraBrain-WBC 0.5 的孝敬于在体系性地证实:MLP 的瓶颈并不是数据少,而是架构自己的扩大性限定。换用 Transformer,一切才真正打开。
跟着数据范围扩大至 20 亿帧、模子参数连续增加,模子的机能患上以连续晋升。人形呆板人运动节制也许正迈向「基础模子时代」:假如说已往的呆板人是于进修单个技术,AstraBrain-WBC 0.5 则更像是于进修整小我私家类动作世界。

这个结论对于整个财产有直接的战略寄义。
当前人形呆板人行业的技能线路年夜致可分为两派:一派越发偏重冲破运动节制及硬件;另外一派则越发夸大年夜模子驱动的泛化能力。
AstraBrain-WBC 0.5 让后者的主意有了更坚实的技能支撑:假如运动「小脑」自己就能够成为基础模子,那「年夜脑」与「小脑」之间的界限就会变患上恍惚,二者可以配合受益在 Scaling Law 的盈余。
行业里已经有一个共鸣:2026 年是具身智能的交付元年,企业的竞争重点正从「我的呆板人能做到」转向「我的呆板人能靠得住地、范围化地做到」。于这个语境下,运动节制层的泛化能力,直接决议了一款呆板人可否用统一套软件栈适配差别车间、差别家庭、差别使命。这是范围化落地的条件,也是贸易壁垒真正形成之处。
固然,AstraBrain-WBC 0.5 也有局限:它还有是纯运动追踪模子,不具有对于物体、情况的语义理解。论文作者于结语中明确提出,下一步标的目的是与视觉-语言-动作(VLA)模子对于接,插手视觉、触觉及语言多模态信息,迈向通器具身基础模子(Embodied Foundation Model)。
星河通用已经经走出了冲破性的一步,后续的棋局,正于睁开。
【本文由投资界互助伙伴呆板之心授权发布,本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。
-304永利集团官网入口




