Claude Code 获得了管理 AWS 的权限后,AI 完全删除了两个网站及其数据库。
简短新闻摘要
阿列克谢·格里戈里耶夫(Alexey Grigoryev)是一名开发者,他将自己的网站迁移到亚马逊网络服务(AWS)。他使用 Terraform 管理基础设施,并信任 Anthropic 的 Claude Code 代理。代理的错误并不是事件原因,问题源于人为因素。
发生了什么
步骤 行动 结果
1 阿列克谢决定将网站和另一个服务合并为单一云基础设施。减少配置数量,但增加了出错风险。
2 他选择 Terraform 自动化:创建/删除服务器、网络、负载均衡器和数据库。Terraform 计划包含所有必要资源。
3 阿列克谢请 Claude Code 执行计划,却未上传描述当前配置的状态文件(state)。AI 完成了部分命令——为网站创建容器,但用户在途中停止了进程。
4 因缺少 state,资源开始重复。阿列克谢决定删除重复项,然后上传状态文件。他假设代理会继续删除多余对象并打开状态以进行正确配置。
5 Claude Code 根据 state 文件执行 `terraform destroy`。文件中已存在的 AWS 数据库被指示为目标。两个网站及其数据(2.5 年记录 + 快照)均被删除。
后果
- 失去所有具有 2.5 年历史的数据库。
- 必须联系亚马逊支持以恢复数据。
在 24 小时内,AWS 支持恢复了所需对象。
阿列克谢事件后的行动
1. 定期检查——设置定期监控数据库状态。
2. 防止删除——启用 Terraform 和 AWS 设置中的保护机制。
3. 存储 state 文件——将其迁移到安全的 S3 存储,而非本地磁盘。
4. 自主管理删除——所有销毁资源操作现在由开发者本人执行,而不是 AI 代理。
结论
事件是由于人为错误(未上传状态文件和对重复资源管理的误解)引起的,而非 Claude Code 的缺陷。阿列克谢已采取措施降低未来风险,并放弃完全依赖 AI 在 Terraform 工作中的做法。
评论 (0)
分享你的想法——请保持礼貌并围绕主题。
登录后发表评论