GigaWorld-Policy-0.5提出以动作为中心的世界动作模型:训练阶段利用未来视觉动态提供密集监督,推理阶段仅解码动作,避免生成未来视频的开销。模型采用混合AC-WM与WAM预训练、Mixture-of-Transformers专家架构,并在本地RTX 4090上报告85毫秒推理延迟;同时用智能体式AutoResearch搜索训练配置。
最近 24 小时暂无可用热度快照。