克劳德Opus5浏览器免疫提示注入

克劳德Opus5浏览器免疫提示注入
核心摘要

Anthropic 在其最新发布的 Claude Opus 5 系统卡中披露,该模型在浏览器智能体场景下几乎完全免疫提示词注入攻击,在 129 项测试场景中无一被攻破。这一成果直接回应了业界长期以来的安全痛点——OpenAI 去年 12 月曾公开承认,提示注入可能永远无法被完全解决。

正文解读

提示注入被视为 AI 代理面临的最严重安全漏洞,攻击者通过在网页中嵌入隐藏文字等被操纵的输入内容,绕过模型指令执行恶意操作。在安全公司 Gray Swan 的通用提示注入基准测试中,经过 15 次攻击后,Opus 5 的成功率仅为 2.0%,大幅优于前代 Opus 4.8 的 5.5%,也领先于 Mythos 5 的 2.6% 和 Fable 5 的 2.8%。

值得注意的是,零攻击率的成果仅在开启 Auto Mode 的 Claude Cowork 等产品中实现。这一突破标志着 AI 代理安全性正在从「持续修补」的传统思路迈向「结构性防御」的新阶段,对于 AI 代理在金融、医疗等高风险场景的落地具有重要意义。

原创文章,作者:admin,如若转载,请注明出处:https://www.23btc.com/204475/

(0)
上一篇 8小时前
下一篇 8小时前

相关推荐