该论文提出一种与模型无关的多轮心理健康安全治理架构,将上下文风险检测、基于推理的验证和协议引导的响应生成结合起来。在基于真实心理健康叙事构造的合成对话中,GPT-5-chat与Qwen3.5-27B达到0.92敏感度和0.85特异度,并使临床人员偏好的升级响应提高25.6至59.2个百分点。
最近 24 小时暂无可用热度快照。