论文提出MCLASH多语言道德决策基准、基于心理学与哲学理论的两步提示方法MET,以及无需外部标注的自蒸馏训练MET-D。在Qwen3-4B、Qwen3-8B和Gemma3-4B上,MET-D在MCLASH和MMoralExceptQA分别平均提升3.71和4.23个宏F1点,并显著增强原生语言推理。
最近 24 小时暂无可用热度快照。