Simon Willison · 博客

Anthropic 撤回可能“破坏”使用 Claude 的 AI 研究人员的政策

Anthropic Walks Back Policy That Could Have ‘Sabotaged’ AI Researchers Using Claude

二〇二六年六月十一日 · 英文原文

Anthropic 修改了 Claude Fable/Mythos 系统卡中一项争议性政策,该政策会识别并限制针对前沿大语言模型开发的请求,且不通知用户。Anthropic 在给 WIRED 的声明中承认做出了错误权衡并道歉,表示正在修改安全措施使其可见。该政策此前由 WIRED 的 Maxwell Zeff 独家报道。

Anthropic 撤回可能“破坏”AI 研究者使用 Claude 的政策

Wired 的 Maxwell Zeff 独家报道:“我们正在修改 Fable 5 针对前沿大语言模型开发的安全措施,使其可见。”Anthropic 在给 WIRED 的声明中表示,“我们做出了错误的权衡,并为未能把握好平衡而道歉。”

此前,Anthropic 在其系统卡中隐藏了一项政策,即 Claude Fable/Mythos 会识别“针对前沿大语言模型开发的请求”并“限制其有效性”,且不通知用户。这一政策引发了巨大争议。他们现在放弃这一做法,是非常好的消息。

标签:ai, generative-ai, llms, anthropic, claude, ai-ethics, claude-mythos

译自 Simon Willison · 博客 · 录于 二〇二六年六月十一日