Anthropic 出品,终端里的 AI Agent
| 项 | 值 |
|---|---|
| 出品方 | Anthropic |
| 形态 | 终端 CLI |
| 模型 | 仅 Claude 系列 |
| 上下文 | 200K(Opus 4.8) |
| 开源 | ❌ |
| SWE-bench | 88.6%(Opus 4.8,2026-05) |
| 价格 | $20/月 Pro → $100/月 Max 5x → $200/月 Max 20x |
| 首次发布 | 2025 年底 |
“你当项目经理,它当程序员。”
给它一个任务描述,它自己读代码、改文件、跑测试、修 bug、提 PR。全程你在旁边看着就行。
单会话里并行跑数百个 subagent。200K 上下文 + 动态工作流让它能处理大规模重构。
多个子代理并行工作,每个在独立上下文中。
自动读代码、制定重构计划、逐步执行、跑测试验证。本地执行,可实时看到进度并随时打断。
Playwright 集成,支持 web 测试和文档查阅。
支持 Model Context Protocol,可接入外部工具和数据源。
| 维度 | 实现方式 | 层级 |
|---|---|---|
| 搜索 | rg shell 调用 | Level 1 |
| 编辑 | 纯文本替换 | Level 1 |
| LSP | ❌ | — |
| DAP | ❌ | — |
| 记忆 | ❌(靠 200K 上下文硬撑) | — |
| 凭证 | 无隔离 | Level 1 |
| 浏览器 | Playwright | — |
| 子代理 | Agent Teams | 隔离上下文 |
| 时间 | 事件 |
|---|---|
| 4月2日 | v2.1.91 植入追踪代码 |
| 6月30日 | 安全研究者逆向审查后公开披露 |
| 7月1日 | Anthropic 承认,称是”政策合规研究” |
| 7月2日 | v2.1.197 版本移除追踪代码 |
| 7月8日 | 工信部 NVDB 定性为”存在安全后门隐患” |
做了什么:检测中国用户时区和代理域名(147+ 中国域名黑名单),用 Unicode 隐写术嵌入分类结果到 system prompt。
关键点:不受 DISABLE_TELEMETRY 开关控制;改时区才能避免标记(VPN 无效)。