本文提出一种面向冻结LLM智能体的外部控制框架:不直接调整工具选择或模型参数,而是在线学习提示模板、示例、检索上下文规模及规划与验证次数。论文形式化内外策略分解,并讨论稳定性与控制器置信度校准。
最近 24 小时暂无可用热度快照。