OpenForgeRL 是一个开源端到端训练框架,通过代理模型调用的轻量代理层记录训练数据,并用 Kubernetes 为每次 rollout 启动独立容器,从而把 Claude Code、Codex、OpenClaw 等有状态 Harness 接入 veRL 等标准 RL 栈。摘要称其在 ClawEval、OSWorld-Verified 等任务上超过相近规模基线,但错误恢复仍较弱。
最近 24 小时暂无可用热度快照。