SemPIC 面向长上下文检索与智能体任务中反复复用、但顺序和指令不断变化的文档,使用带 LoRA 的 Writer 通过行为蒸馏离线编译原生逐层文档 KV,再由保持不变的 Reader 解码。论文还提出 KV 梯度检查点以降低训练峰值显存;在三种模型、四项任务上,平均 micro-F1 从 KV Packet 的 0.53 提升至 0.60,接近完全重算的 0.62。
最近 24 小时暂无可用热度快照。