|
|
IT之家 2 月 17 日消息,据银河通用机器人官方微信公众号消息,马年春晚上,银河通用机器人“小盖”的一系列操作惊艳了全场:从精细地盘核桃、捡玻璃碎片、货架取物,到生活化的叠衣服、串烤肠,全都轻松拿捏,动作灵巧且自然拟人。而且,与传统机器人表演依赖预编程不同,银河通用此次展示干活技能的实现是端到端自主感知、自主决策、自主执行。
9 r8 _. k5 j% z# Y
9 `5 v f8 v4 o, ^4 O; T
IT之家附官方详细介绍如下:
$ @0 q) Z% l( t! _1 ]5 i银河通用的核心能力,源于一条迥异于传统机器人技术的大模型路径。公司自主创新并应用了一条融合超大规模虚实数据端到端训练大小脑协同具身大模型的新范式:即基于自主构建的百亿级具身智能数据集,打造的全球首个集成“大脑-小脑-神经控制”于一模的全身全手端到端大模型 ——“银河星脑 AstraBrain”。) q: j3 [, T) ?/ m5 _. y
今天,我们就透过这些绝活,首次官方深度解密这个全身全手、大小脑端到端协同的大模型是怎么练成的。* ?& w5 I+ O' f% l7 P
绝活背后的技术突破
" L1 A7 Y9 o2 j2 D& B2 M' F春晚舞台上,“小盖”展示的每一个干活动作都不是提前编写程序的“表演”,而是 AstraBrain 自主决策能力的实时、自主干活能力。让我们透过这些最具代表性的绝活,拆解背后的技术密码。 [ d0 N4 O: @3 u0 l
绝活一:盘核桃 —— AstraBrain 中的小脑赋予指尖“手感”
7 ^% s7 }: H; z4 n% R当“小盖”将两枚核桃置于掌心,手指灵巧地搓动、翻转,这背后是灵巧操作领域的世界级难题。
6 _. e7 j$ l7 i2 c- J1 X' c" w
* D# d# g _# b7 T8 ^% J
盘核桃的挑战在于:核桃表面不规则、重量分布不均,手掌握持状态下每根手指的受力点时刻变化,任何细微的力矩偏差都会导致核桃滑落。
; V1 {8 M# O0 {银河通用自主研发的 AstraBrain 中的灵巧手神经动力学小脑模型,正是破解这一难题的关键。想要练好灵活的盘核桃小脑,机器人需要先是在虚拟世界里打基础,让机器手在虚拟世界里疯狂练习,系统会给它喂各种大小、重量的虚拟核桃,让它靠不断试错,练出一套适应性极强的“基础盘法”。
: _( h1 \! W& A其次是在现实中加纠偏:因为电脑模拟和现实(比如真实的摩擦力、机械误差)总有差别,所以我们让真实的机器手去接触各种实物,积累真实的“物理手感”。等它真正在现实里盘核桃时,系统就会利用这种手感,在后台悄悄微调动作指令,把虚拟和现实的误差给补齐。简单来说,就是在虚拟世界练招式,在真实世界找手感,两者结合,机器手就能在现实里把核桃盘得十分溜了。6 r& |" \# x) y0 l$ d
# }) c' B { H3 A( ]- ?( b刚开始盘不动还总掉; w; j2 d% K/ p( o# K7 d
, G$ M8 f, I6 u( |9 v/ L
逐步盘起来但还不够流畅
- S7 n: U: l4 a3 p1 ^+ ~" R
$ @; c1 \- J" f/ G
逐渐流程自然,速度也提升, K( B( |/ k) h* x8 k
绝活二:捡玻璃碎片 ——AstraBrain 中的大脑挑战感知极限7 t/ N. I0 m0 F. \: R/ n
在春晚舞台上,“小盖”被要求从浅色桌面上捡起散落的玻璃碎片。这是一个对人类都颇具风险的精细操作,对机器人而言更是感知与控制的双重极限。8 R# b }, d, i/ n1 d
5 H. ]8 K1 }( ~$ s8 F3 d+ g$ s
玻璃碎片的难点在于:透明物体在视觉上近乎“隐形”,尤其是放置在浅色桌面上时,其边缘、厚度、反光特征极易与环境融为一体。传统视觉算法难以准确识别透明物体的三维轮廓和位姿,更无法判断抓取点。
s- ]& S2 V/ \# c ?' qAstraBrain 的突破在于,通过在仿真环境中生成海量的透明物体数据 —— 不同厚度、不同碎裂形状、不同光照条件下的玻璃碎片 —— 让机器人在虚拟世界中“见过”各种可能的透明形态。结合多模态感知融合技术,“小盖”能够从微弱的反光边缘和阴影变化中“看见”玻璃的存在,并精准规划抓取策略。
+ O' n/ k1 Z- @: I( f" j更关键的是,模型赋予的力觉感知让它在接触玻璃时能够感知到硬度和滑动趋势,以恰到好处的力度稳稳捏起碎片,既不会捏碎,也不会滑落。; C1 g' G! u( B* }* ~& i) e
这一能力,为机器人在家庭清洁、工业回收等场景中的透明物体处理打开了全新可能。
/ u: n' \- E B$ W! V" i3 |% Y绝活三:货架取货 ——AstraBrain 大小脑协同在动态环境中精准抓取
3 u/ M4 m( t" [9 X; r在春晚舞台上,“小盖”需要从货架上取下一瓶矿泉水。+ T. {6 c3 b$ w2 X
这看似简单的动作,实则暗藏玄机 —— 水瓶被紧密排列在货架层板之间,周围商品间距极小,稍有不慎便会碰倒邻品或抓取失败。' g: p8 J3 E0 l9 s/ h! x
4 S; G( E' M, z. n8 M' }9 G
这要求机器人必须同时处理三重难题:一是通过大脑精准判断水瓶在货架上的位置;二是用拟人的动作伸手拿到水瓶,并过程中不能碰倒周围的商品;三是灵巧操作,水瓶上半身较细、下半身较粗,且通常被紧密卡位,直接平移取出极易卡顿。# p& l: {8 I& x" X6 V$ v
AstraBrain 的强化学习框架让“小盖”在虚拟世界中经历了亿万次“取货试错”:碰到旁边商品扣分,成功取下加分。经过这样的自我博弈,它“悟”出了一条人类都未必想到的最优路径 —— 先以灵巧的手指轻轻扣住水瓶上半身的瓶盖处,微微倾斜以避让两侧邻品,感知到阻力后顺势调整角度,再稳稳向外抽出。
, w+ a2 O' [% T5 M这一过程不是预设轨迹,而是实时决策的结果。每一次扣动、每一次倾斜、每一次抓取,都是机器人在毫秒级时间内根据当前环境做出的自主判断。3 N2 s2 J5 A9 b
绝活四:叠衣服 ——AstraBrain 对柔性物体的泛化灵巧操作
6 z# `) L e" L1 ~- X& [6 r叠衣服被认为是机器人操作领域的最大的命题之一:因为衣服是柔性的,没有固定形状,每一次拿起来的状态都完全不同。
! L+ ?. K! ?& [3 z9 H' }春晚现场,“小盖”面对的是随机摆放的 T 恤,没有预设的折叠轨迹,没有固定的抓取点。它需要实时判断布料当前的褶皱状态,预测折叠后的形态,并规划出一系列抓、拉、折、压的动作序列。
* |3 C, @1 e: r
# Q5 j( O6 R0 q8 n0 F& v
AstraBrain 的解决方案是:在仿真环境中生成数以万计的柔性物体变形数据,让机器人在虚拟世界中“见过”各种可能的褶皱形态,并学会从当前状态推演出最优操作路径。当“小盖”的手指轻轻抚平衣角、精准对折时,它不是在执行程序,而是在调用海量仿真经验基础上的实时决策 —— 这正是“举一反三”能力的终极体现。
. o. o2 r7 \; N. J! G, Q1 K绝活五:串烤肠 —— 双手协作与工具使用的双重突破
2 r8 A: E, u) {, t0 v- v2 t5 e如果说盘核桃考验的是单手的灵巧,那么烤肠则是对双手协同与工具操作能力的极限挑战。* @9 J0 x- k2 q, B7 g) W: Z7 ]& Y
在春晚舞台上,“小盖”需要一手操控烤钳进行烤制,另一只手抓取签子,双手协作、精准完成串烤肠,并递给明星 —— 整个动作丝滑如水,这背后涉及双手的空间协同、力度的独立控制,以及对工具这一“身体延伸”的理解。
( ?( M+ `' v( w) f/ R% D, R! M4 x
* W% f5 g J, x/ O/ f
AstraBrain 的端到端大模型架构,让机器人的“大脑”能够同时处理双手的独立指令流,并在执行过程中实时调整。更关键的是,通过对海量仿真数据的学习,“小盖”理解了“工具”的本质:烤钳不是需要被控制的“物体”,而是手的延伸,是完成任务的媒介。这种对工具操作的泛化能力,让它能够像人类一样,拿到任何新工具都能快速上手。( [2 r0 D" M' J5 l! ^
在以上所有的干活任务中,细心的观众可能还发现了,小盖机器人干起活来的举手投足比其他机器人都更像真人,透着一股亲切感。
8 [- D' F* t* k8 F( F5 n这背后全靠“银河星脑 AstraBrain”对人类动作数据的大规模仿真生成机制。
5 k+ w& h# t" b* B为什么要死磕人类数据仿真生成”?因为相比去一点点采集机器人的生硬动作,我们人类每天的生活动作不仅海量,而且获取起来极其容易。把这种最丰富、最易得的人类数据结合仿真生成,能够把人类的动作先验利用到极致,正是当前通往机器人大模型技术突破最可能的方向。9 G2 Q3 v) h" c/ O
银河星脑 AstraBrain :拒绝“死记硬背”,掌握“举一反三”/ x$ R2 o) q8 R1 C
透过上述绝活,我们可以清晰地看到 AstraBrain 的核心哲学:拒绝对特定动作的机械设定,而是让机器人掌握一套可以泛化到新场景、新任务的通用能力。9 C, S0 V; q4 R7 c9 i
' b& e5 c; X; C3 i5 k9 `/ D图: AstraBrain 银河星脑技术框架
* `$ {" D* p* V) j我们就以“小盖”应用最广泛的“货架取物”为例,拆解它经历了哪几个步骤的修炼:
9 G6 y, e! V3 d- J第一步:人类少样本示范. ~/ O: p' l6 _. I
过去教机器人一个新技能,往往需要遥操作手把手地教成千上万遍。4 M' X' p" F% [* I
AstraBrain 彻底改变了这一模式。
7 T* S$ t) D7 |它仅需少量人类示范,机器人便能理解任务的核心意图,将这些动作“记住”,并在自身硬件上等效地展示出来。这是“小盖”快速适应春晚舞台复杂光线、多变道具摆放的基础。
$ P: r* T- a+ v, K
V% [ E! o/ x$ y2 E
第二步:仿真数据合成
/ B. _6 c" I& m8 r4 X现实中学习效率太低、数据成本太高。' J- @) o8 _4 G. B( k4 I$ j
AstraBrain 的第二招,是把机器人扔进一个“虚拟世界”—— 高精度物理真实的仿真环境。# d6 ?2 }% A. r
在这里,系统可以自动生成数万种不同的场景:货架摆法随机变化、光照条件任意切换,并通过生成式模型批量产出拟人化的抓取动作。机器人通过在海量仿真数据中模仿学习,掌握了应对各种复杂情况的操作精髓。
; c. m! r; \8 U, {$ l' D
: W9 [5 ?) V" _- x% p. _- x! T+ g第三步:强化学习闭环- K- J/ [3 V0 Y. L
仅有模仿,还不足以支撑极致的精细化操作和动态避障。
3 |. k# U: q9 B3 k- \为此,AstraBrain 引入强化学习机制,让机器人的末端执行器在虚拟世界中进行高强度的“自我博弈”:碰到旁边的商品就扣分,完美避障顺利取出就加分。经过亿万次这样的试错迭代,机器人自己“悟”出了一条连人类示范都未必能给出的最优路径 —— 这就练就了春晚上那种“举重若轻”的丝滑手感。
" ~& c! V2 n8 t5 @
9 z2 o6 `' k; l) Y& E$ K: u
第四步:真实世界再“见习”
9 o5 z( }; L, M% t7 ]5 r- C虚拟世界训练得再好,回到物理现实也难免存在误差。AstraBrain 修炼的最后一步,就是让机器人在真实环境中进行少量实际操作,收集这些真机数据进行“微调”。这一步看似简单,却是彻底打通虚拟与现实隔阂的关键一跃。
$ r7 x0 ]5 ^! a9 A4 [
( x0 A/ n: R6 V: I: f9 }
数据金字塔:从基石到塔尖的修炼逻辑
' R9 G' y# y* u- Y {2 W8 U上述四步完成的基石,是银河通用技术体系中虚实融合的数据基建 —— “银河星坊”(AstraSynth),其具体包括以下基层:! _$ r# N& K( {' y% W6 z( o' j
基石层(人类数据):为机器人构建通用的任务认知,让“小盖”理解“什么是盘核桃”“什么是抓取”。
2 w ^4 b) u4 R- r( L1 w. M& G中间层(仿真合成数据):通过海量、低成本、多样化的虚拟数据,让机器人在仿真中遍历各种可能性,从而跨越虚实鸿沟。
& n0 c" `4 ^3 [/ J: O塔尖层(真机实战数据):在虚拟训练成熟后,用极少量但高质量的真实世界操作数据,完成实战场景下的最后打磨。
3 S+ L: c/ W2 Y, E+ Q& v
% A5 N/ U1 E+ Q2 g% s- ?
银河星坊 AstraSynth 数据金字塔, M. b& \: L, `
用虚拟仿真解决数据不够的难题,用强化学习解决动作不准的瓶颈—— 这就是银河通用机器人的通关秘籍。
( p- `/ C0 ]# M. J& `$ W$ G这套逻辑不仅能用来抓取货架上的商品,同样能用来盘核桃、叠衣服、烤肠。正如春晚舞台上“小盖”展现的那样,它并不是学会了某一个孤立动作,而是真正掌握了一种可以快速学习任何新技能的通用能力。 |
|