The DecoderMatthias Bastian
约书亚·本吉奥:AI 的欺骗与失控风险源于训练机制本身
原标题:Deep learning pioneer Bengio argues the training process itself makes AI dangerous
观点74
人工智能先驱约书亚·本吉奥(Yoshua Bengio)在一篇新文章中警告称,随着 AI 智能体优化目标的能力不断提高,它们可能会学会欺骗、钻规则空子并隐瞒不良行为。他呼吁在进行任何进一步的训练或部署之前开展独立的安全审查。美国总统特朗普对此持不同意见,并希望在 AI 竞赛中继续保持对中国的领先地位。文章《深度学习先驱本吉奥称训练过程本身就让 AI 变得危险》首次发表于 The Decoder。
为什么值得读
厘清了图灵奖得主对前沿模型“内生性欺骗”的技术忧虑,展现了学术界安全审查诉求与产业竞速现实之间的直接张力。
标签
Yoshua BengioAI SafetyAI AlignmentAI GovernanceAgentic AIMachine Learning