小米机器人还挺厉害,最近研究成果Xiaomi-Robotics-0刷新了多项SOTA成绩,触觉精密操作技术实现了完全无需视觉的毫米级抓取。
SOTA全名VLA SOTA Leaderboard,该榜单是目前覆盖模型最全(54+)、引用最广的VLA综合排行榜,基于模拟环境的标准化测试。
小米机器人榜单成绩超越了OpenVLA和PI。
OpenVLA就是OpenAI旗下的,一个开源的视觉-语言-动作模型,旨在为机器人提供“通才”式的操控能力。你可以把它理解为机器人的“通用大脑”——它能直接通过摄像头看到的画面和人类的语言指令,生成机器人的具体动作,公认的鲁棒性第一。
OpenVLA却被小米机器人全面超越了。
小米采用MoT混合架构:VLM大脑 + DiT小脑异步推理 + 流匹配
OpenVLA采用传统VLA:自回归/并行解码 + 离散/连续动作
小米存在代际领先。
小米用了更轻量的参数(47亿 VS 70亿),却取得了更优的成绩,学动作不变笨...
小米已攻克“柔性物体”,OpenVLA仍困在学术Benchmark,这都是让人意想不到的。
OpenVLA虽然鲁棒性仍旧第一,常规成功率、多任务、长程任务三个维度已被小米机器人全面接管,OpenVLA开源已超一年,小米居然能有后发优势。
这是2026年AI领域的又一惊喜啊。。。
#小米发布机器人基座模型##机器人春节大赏##过个有AI年#
发布于 湖北
