当前位置:首页 » AI资讯 » AI快讯

Anthropic 在网络关键能力时代放缓模型开发:暂停 RL 训练并强化安全防护

2026-08-20 4

Anthropic 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到"关键网络安全能力阈值",暂时放缓模型扩展速度,包括暂停最新模型两周的强化学习(RL)训练。公司已加强研究环境安全要求,包括工作负载隔离、网络隔离和持续安全测试,并扩大思维链监控范围。涉及 Astra 或网络模型的工作负载需满足最严格安全标准,部分训练和评估工作仍处于暂停状态。

来源:Hacker News 热门(buzzing.cc 中文翻译)

相关推荐

扫码关注

qrcode

联系我们

回顶部