【软盟资讯 · 7×24快讯】(2026年09月22日) 9月22日,理想汽车Foundation Model团队发布世界动作触觉模型ME-Dex-1.0,将触觉与视频共同作为需要预测的未来世界状态,联合去噪视频、触觉与动作序列。该模型将异构触觉数据映射到双手34区域模板,采用视觉、触觉、动作三专家架构与H-Bridge共享注意力,并借助自主式触觉数据引擎扩充仿真数据。实测中,RoboTwin成功率领先最强基线7.6个百分点,为机器人精细操控提供了新的底层模型。
【软盟观察】理想把触觉塞进世界模型,补上的是具身智能最容易被忽略、却最要命的一块短板——触觉。过去世界模型大多只预测“画面下一帧”,机器人只能靠视觉猜物体该握多紧、该怎么用力;ME-Dex让模型把触觉、视频、动作当成要联合预测的未来状态,等于给机器人装上了“预判手感”的能力。把异构触觉统一映射到双手34区域模板,再用视觉、触觉、动作三专家架构+共享注意力去融合,工程上相当扎实,RoboTwin成功率领先最强基线7.6个百分点,说明它不是概念玩具而是真能提升操控成功率。理想从车企跨界做触觉世界模型,看中的是它既能服务自家自动驾驶与机械臂场景,也能沉淀成通用具身智能底座。触觉世界模型让机器人从“看得见”进化到“摸得着”,这一步可能比想象中更接近机器人的iPhone时刻。