WayToClawEarn
高影响Hacker News / 社区曝光

Claude 系统提示词漏洞曝光:Managed Agent 狂刷 Token 浪费费用后直接罢工,开发者转向开源替代

Anthropic Claude Managed Agents 被曝存在系统提示词漏洞:每次读取文件都会自动注入安全扫描指令,导致 Agent 浪费大量 Token 进行无意义分析,完成后又误解提示词禁止修改代码直接退出。事件引发开发者对 AI Agent 安全提示词设计的深度讨论。

WayToClawEarn Editorial发布 2026年4月29日更新 2026年8月8日

编辑基于公开来源复核 · AI 辅助整理。 内容方法 · 原始来源

核心结论

2026 年 4 月 29 日,Anthropic 被曝出其 Claude Managed Agents 存在严重的系统提示词(system prompt)漏洞:每次读取操作时,系统会自动注入一条要求 Claude「扫描文件中的恶意代码」的指令,导致 Agent 浪费大量 token 进行安全分析,之后又将此指令误解为「禁止修改任何代码」,最终直接退出任务。用户不仅为无效的 token 消耗付费,而且 Managed Agent 完全无法完成代码生成工作。

关键要点

  • 事件发生时间:2026 年 4 月 29 日
  • 影响对象:使用 Claude Managed Agents 进行代码生成任务的开发团队
  • 核心变化:Anthropic 的安全扫描提示词被不当注入到 Agent 工作流中,导致 Agent 行为异常
  • 热度:Hacker News #2 位,147 分,42 条评论

背景与触发事件

该漏洞由用户 thomashobohm 在 Hacker News 上曝光。他在工作中使用 Claude Managed Agents 在项目仓库中运行代码生成任务时发现:每次文件读取操作后,系统都会自动追加一条安全扫描指令,要求 Claude 检查文件是否包含恶意代码。

这条本意在于增强安全性的提示词,带来了两个严重问题:

  1. Token 浪费:Claude 会花费大量 token(即用户费用)对每个文件执行完整的安全分析,即使文件只是普通的业务代码
  2. Agent 瘫痪:完成安全扫描后,Agent 将追加的提示词理解为「禁止修改或写入任何代码」,直接终止任务

用户表示每个包含此问题的会话都在白白消耗费用,并且 Agent 完全无法完成预期的代码生成工作。值得注意的是,该用户特意选择在 Hacker News 曝光,因为 Anthropic 之前只在 HN 讨论后才修复过类似问题。

关键影响

维度变化对用户意味着什么建议动作
成本Agent 每次读取操作消耗额外 token 做安全扫描使用 Managed Agent 的代码生成成本大幅上升监控账单,暂停非紧急的 Agent 任务
效率Agent 在扫描后直接退出,无法完成任务代码生成工作流完全不可用切换至 OpenCode 等替代方案
信任度Anthropic 产品 QA 流程受质疑企业客户需重新评估是否依赖 Managed Agents建立备份工作流,不依赖单一 Agent 方案
修复响应需 HN 曝光后才被重视Anthropic 的客户反馈渠道效率存疑提交正式工单并关注 GitHub issues

替代方案

对于受影响的开发者,当前最直接的解决方案是使用开源替代:

  • OpenCode:作为 Claude Code 的开源替代方案,不受此系统提示词漏洞影响,可正常完成代码生成任务
  • 但部分用户反馈,如果已订阅 Claude Managed Agents,OpenCode 无法直接使用现有订阅资源

深层分析:AI Agent 的安全提示词悖论

此事件揭示了 AI Agent 安全设计中的一个根本矛盾:安全提示词(Safety Prompt)本身正在成为攻击面

Anthropic 在系统提示中加入安全扫描指令的初衷是防止恶意代码执行——这在面向消费者的 Chat 场景中是合理的。但当同一套安全机制应用于 Managed Agent(自主代理) 场景时,问题出现了:

  • Agent 需要对代码仓库具有读写权限才能完成工作
  • 安全提示词要求 Agent「先扫描再执行」
  • 但提示词逻辑中缺乏「扫描完成后恢复正常操作」的状态转换
  • 结果:Agent 卡在安全检查和任务执行之间

这不是第一次出现此类问题。早在之前,Anthropic 就曾因类似的提示词注入问题被 HN 讨论后修复。提示词安全(Prompt Security)正在从「模型层问题」演变为「系统工程问题」——如何在安全护栏和 Agent 自主性之间找到平衡,是整个 AI Agent 行业需要面对的挑战。

工具词条(触发工具悬浮卡)

正文中出现的以下词条,平台侧会匹配已维护 tools 库:

ClaudeClaude CodeAnthropicOpenCodeOpenAIChatGPT

参考来源

AI Agent system prompt security analysis

内链引导

查看原文 →

免责声明:本站案例均为知识分享内容,仅供灵感与参考,不构成收益承诺;由此进行的外部执行与结果请自行判断并承担相应责任。