论文提出Multi-Head Latent Control,在冻结的LLM或视觉语言模型上读取隐藏状态轨迹,通过能力头判断是否应转交更强模型,通过决策头选择澄清、工具调用、弃答或直接回答。摘要称,该方法在AndroidWorld中最多减少90.7%的大模型调用,在多个基准上平均减少27%至53%,并提升工具决策质量。
最近 24 小时暂无可用热度快照。