观察中新闻观察中1 家独立报道含官方 110
长时程模型时代的安全与对齐:OpenAI分享部署经验
首次出现 · 2026/7/20 18:00最近活动 · 2026/7/20 18:00
OpenAI总结部署长时程AI模型时获得的安全经验,重点讨论持续运行带来的新型风险、实际观察到的失败模式,以及通过迭代式部署逐步改进安全防护的方法。文章将模型安全从单轮输出审查扩展到长期任务中的行为、状态与风险累积。
最近 24 小时事件热度
最近 24 小时暂无可用热度快照。
最近 24 小时暂无可用热度快照。