
畴昔咱们说机器东谈主“灵巧”,大量指它能识别图像、听懂语音、算得赶快——但手脚不听使唤,走路像醉汉,拿个杯子齐抖三抖。现时不同样了。清华李阐明团队干了一件实在事:把AI的‘大脑’和机器东谈主的‘当作百骸’真的连通起来,不是靠一堆孤独模块免强,而是让视觉、决策、开通死字、力觉反映全在一个息争框架里及时协同。这叫‘全身智能’——名字听着直白,背后是VLA(视觉-话语-动作)模子+超大边界具身数据+端到端闭环查验的硬核组合。

这不是望梅止渴。他们用的不是仿真器里跑分的假造东谈主,而是真刀真枪在真实场景中网罗动作数据,教机器东谈主学东谈主类若何弯腰、回身、伸手、微调手指力度。更关键的是,这套范式不挑硬件——适配不同枢纽构型的东谈主形平台,也不卡在实践室里,已在仓储搬运、家庭赞助等轻量任务中跑通闭环。一位参与测试的工程师暗里说:“畴昔调一个抓取动作要写几十行规章代码,现时喂一段视频+一句提醒,模子我方‘想昭彰’若何动。”
有益念念的是,这项服从没挤在顶会刷榜,而是径直进了2026蚂蚁InTech科技奖名单。评审团里坐着Michael I. Jordan、张宏江这些名字,看中的恰正是‘能不成让智能真的长在身体上’。具身智能的下一程,拼的早不是谁参数多,而是谁能让机器东谈主稳稳接住你递来的一杯水——不洒、不烫、还知谈你手有点抖。李阐明团队没喊标语,但他们交出的,是一份可落地、可迭代、带着体温的时期答卷。
这种“体温感”,其实藏在许多细节里。比如机器东谈主端水时,会把柄杯壁冷凝水的几许,自动调整执持角度看重打滑;老东谈主起身扶椅背,它不光判断位置,还会预判重点偏移趋势,提前半秒微调相沿力——这些齐不是写死的规章,而是从上万段真实家庭照护视频里“悟”出来的动作直观。
团队公开的测试日记里有个小插曲:一台样机第一次在厨房到手翻开抽屉后,没按预设经过取物,反而停顿两秒,把抽屉轻轻拉回1.3厘米——因为视觉模子识别出抽屉轨谈有幽微锈迹,怕硬拽损坏。这个“冠上加冠”的动作,自后被标注进新一批查验数据,成了通盘同型号机器东谈主的默许举止。
更实在的是资本死字。他们用的传感器决策遁藏了动辄上万元的高精度力矩编码器,改用国产工业级IMU+自研触觉贴片组合,在保证0.1牛·米以内力控精度的同期,单台本色硬件资本压到传统决策的62%。这不是降配,而是把钱花在刀刃上:省下的预算全投进了真实场景长周期网罗——在北京、成齐、苏州三地27户老东谈主家庭装了不带心事录像头的旯旮计较盒,只收动作轨迹和力反映,连络采了11个月。
现时这套系统已接入蚂蚁链的轻量化推理引擎,能在4GB内存的镶嵌式拓荒上跑通全栈VLA推理。这意味着将来社区养老驿站的旧款干事机器东谈主,刷个固件就能升级“全身智能”。时期不一定要炫,但得让修水管的师父、教钢琴的敦朴、关注阿尔茨海默症父母的儿女,齐认为“这玩意儿真能搭把手”。
李阐明在里面共享会上说了一句话:“AI不是要取代东谈主开云体育,是让东谈主少弯几次腰、少熬几个夜、少为‘万一’人心惶惶。”这话没上新闻稿,但刻在了他们委派给杭州某养老中心的首台样机底座上——一滑小字,激光蚀刻,温润不反光。
