论文提出面向函数的Fill-in-the-Middle中期训练,通过程序依赖图和复杂度—可推断性双重标准选择待遮蔽函数,模拟编码智能体的“调用工具—接收观察—继续推理”循环。在2.6B令牌、968个GitHub仓库语料上训练Qwen2.5-Coder 7B/14B与Qwen3-8B,SWE-Bench-Verified提升2.8至3.2分,SWE-Bench-Lite提升3.7至5.4分,并缓解智能体后训练造成的通用能力退化。
最近 24 小时暂无可用热度快照。