论文研究小型开放权重模型能否用语言化置信度支持风险受控的人工转交,覆盖3个模型家族、11个模型、0.5B至14B参数,以及ARC-Challenge和TruthfulQA上的25,168次预测。作者给出校准与温度缩放的理论边界,并用Clopper-Pearson方法认证部署风险;Platt缩放虽将ECE降至0.02,20%风险预算下仅3个模型任务组合获得认证,10%预算下则没有。
最近 24 小时暂无可用热度快照。