观察中研究观察中0 家独立报道0
负向自蒸馏:让大模型在规避思维缺陷中学会推理
首次出现 · 2026/9/10 04:00最近活动 · 2026/9/10 04:00
模型在自我提升时,模仿带有特权信息的标准解法往往会抑制表达不确定性与回溯试错的能力。研究团队提出负向自蒸馏框架,令模型自主生成“粗心推理”等负向解题轨迹并主动远离该分布。借助动态门控机制,算法将推理关键词与基础语言表达剥离,仅惩罚逻辑漏洞,实现无需外标答案的自主纠偏。
最近 24 小时事件热度
最近 24 小时共有 6 个真实快照;峰值 0,出现于 9/12 20:00;最新热度 0。
- 9/12 20:00,事件热度 0
- 9/12 23:00,事件热度 0
- 9/13 02:00,事件热度 0
- 9/13 05:00,事件热度 0
- 9/13 08:00,事件热度 0
- 9/13 11:00,事件热度 0