大蒜粒机研所
26-08-21 10:34 微博认证:AI博主

星动纪元陈建宇:以视频模型为底座,实现零样本任务泛化

关节扭矩400牛·米,看齐小米SU7,星动纪元在 WRC 2026 交出了具身智能「大脑与本体」协同进化的最新底牌。

在这场主题演讲中,星动纪元CEO陈建宇释放了三个核心技术信号:

1. 大脑底座换轨:从VLA(视觉-语言-动作)模型向「世界动作模型」演进。

传统VLA高度依赖模仿学习,遇到新场景极易失效;星动纪元改以视频模型为底座,让AI直接处理原始感知数据并理解物理常识(如重力规律),实现零样本任务泛化。其融合视频预测与动作预测的模型架构,比英伟达类似方案早发布近一年。

2. 本体死磕直驱:全栈自研硬件,双足人形机器人采用准直驱(QDD)路线,在60-70公斤自重下实现400N·m的高爆发扭矩。

末端执行器首创全直驱五指灵巧手(XHand),单手负载达24kg,且具备极高力反馈响应(1秒点击10次鼠标),解决了剥橘子、翻袜子等复杂手内精细操作难题。

3. 用通用打专用:拒绝纯Demo演示,依托统一的端到端大模型和全尺寸硬件,目前已在全国10余个城市的物流、工业场景开启常态化运作,通过场景数据反哺大脑,跑通了商业化飞轮。

当前业内如Figure的Helix或英伟达的GR00T,多以多模态大语言模型(VLM)为底座进行端到端训练。

相比之下,星动纪元避开了语言表征空间可能丢失物理细节的劣势,直接处理音视频流的技术路径在精细物理交互上具备原生优势。

具身智能的技术演进正在精准复刻高阶自动驾驶的路径。从早期的「感知-决策-控制」规则分层,到如今依靠「端到端+世界模型」直接吃下海量人类第一视角数据,智能汽车与人形机器人这两大“物理世界AI”的底层技术栈已走向全面收敛。

#wrc2026##具身智能##星动纪元#

发布于 四川