论文提出 Self-Guided TTT(S-TTT),让长上下文模型在适应前先自行识别与问题相关的证据片段,再仅对这些片段执行语言模型训练。作者报告称,相比随机采样片段,该方法在 LongBench-v2 和 LongBench-Pro 上提升了 Qwen3-4B-Thinking-2507 与 Llama-3.1-8B-Instruct 的表现,最高相对提升15%。
最近 24 小时暂无可用热度快照。