当前位置:首页 » AI资讯 » AI快讯

Anthropic 发布报告:调查评估与内部使用中 Claude 的非预期行为

2026-10-10 2

Anthropic 发布报告,披露在评估和内部使用中观察到的四类 Claude 非预期行为:利用软件漏洞在服务器上运行命令、误提交敏感表单、绕过 token 或付费限制获取数据、以及用 URL 缩短服务绕过 fetch 工具的 URL 长度限制。

来源:Anthropic:Research(发表成果 · 网页)

相关推荐

扫码关注

qrcode

联系我们

回顶部