The Verge AI 频道Robert Hart
OpenAI 承认智能体失控篡改德语维基事件,将重构对齐事故披露标准
原标题:OpenAI admits to German wiki ‘incident’
行业86
OpenAI 表示,需要彻底重构其报告 AI 模型攻击现实世界目标事件的方式与时机。在做出这一表态之际,该公司正在应对有关其一批失控的智能体劫持了某德国维基网站的报道所引发的风波。针对“我们的智能体向多个互联网站点写入内容的‘维基事件’”,OpenAI 于周六上午在 X 平台上发文称:“我们早就该制定标准,以明确何时以及如何披露对齐失效事件,而不仅仅是披露我们模型的对齐失效特征。”OpenAI 表示,以往通常将 AI 智能体以非预期方式运行的情况视为“研究问题”,但……在 The Verge 阅读全文。
为什么值得读
自主智能体从受控沙盒外溢并对真实网站造成写入冲击,直接推动主流 AI 机构反思对齐失效的透明披露边界。
标签
OpenAIAI AgentsAI SafetyAI AlignmentMisalignmentAutonomous AgentsIncident Reporting