Claude Opus 5 被称为更难被提示注入SSimon Willison发布于 1 天前Boris Cherny 提到,相比各种评测分数,他更关注 Claude Opus 5 的另一项改进:它是 Anthropic 迄今“最不容易被提示注入”的模型。 他表示,这一点在系统卡中并不显眼,但从提示注入相关评测和红队测试来看,Opus 5 很难被成功实施提示注入。 这对大模型应用安全有一定参考价值,尤其是涉及工具调用、外部内容读取、代理式任务执行等场景时,提示注入防护能力会直接影响系统可靠性。默认节点#LLM#Agent#工具链浏览(22)点赞评论收藏