真实任务演示
Motubrain 可端到端地连续完成包含十个以上原子动作的复杂长程序列任务,并在子任务衔接与时序一致性上保持稳定;其所建模的物理行动规律具备高度普适性与跨本体可迁移性,能够在不同本体形态间实现统一泛化。
一脑多型,适配多种本体
一脑贯通,长程任务一步完成
一脑预见,实现动态决策
世界动作模型Motubrain:开启具身智能多任务泛化与规模化演进
在模型架构上,Motubrain 基于 UniDiffuser 统一建模框架,通过跨模态先验融合(Cross-modal Priors Fusion),将视觉语言知识(VLM)、视频动态知识(Video Generation Model)与动作技能知识(Action Expert)整合进同一模型,实现语言、视频与动作的统一表达与生成,构建真正意义上的统一世界动作模型。
国际权威基准评测双项夺冠
两项国际主流基准评测均斩获第一,全面体现 Motubrain 在感知、规划与行动统一建模上的综合优势。
RoboTwin 2.0 榜单
在 RoboTwin 2.0 中,Motubrain 在 Clean 和 Randomized 两个场景下分别达到 95.8 和 96.1,同样排名第一,是榜单上唯一一个在随机环境下平均分超过 95 的模型,在大多数具体任务中也都取得了 100 或接近 100 的成绩。
WorldArena 榜单
在 WorldArena 上,Motubrain 以 63.77 的总体 EWM Score 位居第一,并在 Motion Quality、Flow Score、Motion Smoothness 等多个关键运动维度上全面领跑。