SKILL-KD提出一种面向LLM智能体的对比式技能蒸馏框架:对比学生失败轨迹与教师在同一任务上的轨迹,将可执行差异提炼为技能补丁,再通过重跑学生和迭代修订验证效果。方法还用带轨迹链接的编辑历史进行漂移感知的技能整合,决定新增、修改、删除或跳过规则。论文称其在五个智能体基准、两种学生设置下,持续优于固定模型适应基线。
最近 24 小时暂无可用热度快照。