Orca提出通用世界基础模型路线,以Next-State-Prediction替代孤立的下一词、下一帧或下一动作预测,在统一世界潜空间中学习多模态状态转移。模型使用125K小时视频与1.6亿事件标注,并通过文本生成、图像预测和具身动作三类轻量解码器验证潜空间能力。
最近 24 小时暂无可用热度快照。