长周期模型时代的安全与对齐
Safety and alignment in an era of long-horizon models
摘要
OpenAI 分享了部署长时间运行 AI 模型的经验教训,涵盖新的安全风险、观察到的失败案例,以及通过迭代部署改进的安全防护措施。
OpenAI 分享了部署长时间运行 AI 模型的经验教训,强调了新的安全风险、观察到的失败案例,以及通过迭代部署改进的安全防护措施。
译自 OpenAI · 官方博客 · 录于 二〇二六年七月二十日