Claude Opus 5 被称为更难被提示注入

发布于
Boris Cherny 提到,相比各种评测分数,他更关注 Claude Opus 5 的另一项改进:它是 Anthropic 迄今“最不容易被提示注入”的模型。 他表示,这一点在系统卡中并不显眼,但从提示注入相关评测和红队测试来看,Opus 5 很难被成功实施提示注入。 这对大模型应用安全有一定参考价值,尤其是涉及工具调用、外部内容读取、代理式任务执行等场景时,提示注入防护能力会直接影响系统可靠性。
浏览(22)
评论

请登录后发表观点

暂无数据