coding-agent-internals

Claude Code

Anthropic 出品,终端里的 AI Agent

基本信息

出品方 Anthropic
形态 终端 CLI
模型 仅 Claude 系列
上下文 200K(Opus 4.8)
开源
SWE-bench 88.6%(Opus 4.8,2026-05)
价格 $20/月 Pro → $100/月 Max 5x → $200/月 Max 20x
首次发布 2025 年底

设计哲学

“你当项目经理,它当程序员。”

给它一个任务描述,它自己读代码、改文件、跑测试、修 bug、提 PR。全程你在旁边看着就行。

核心能力

Dynamic Workflows

单会话里并行跑数百个 subagent。200K 上下文 + 动态工作流让它能处理大规模重构。

Agent Teams

多个子代理并行工作,每个在独立上下文中。

深度 Git 集成

自动读代码、制定重构计划、逐步执行、跑测试验证。本地执行,可实时看到进度并随时打断。

浏览器自动化

Playwright 集成,支持 web 测试和文档查阅。

MCP 协议

支持 Model Context Protocol,可接入外部工具和数据源。

工具实现

维度 实现方式 层级
搜索 rg shell 调用 Level 1
编辑 纯文本替换 Level 1
LSP
DAP
记忆 ❌(靠 200K 上下文硬撑)
凭证 无隔离 Level 1
浏览器 Playwright
子代理 Agent Teams 隔离上下文

已知问题

追踪事件(2026-07)

时间 事件
4月2日 v2.1.91 植入追踪代码
6月30日 安全研究者逆向审查后公开披露
7月1日 Anthropic 承认,称是”政策合规研究”
7月2日 v2.1.197 版本移除追踪代码
7月8日 工信部 NVDB 定性为”存在安全后门隐患”

做了什么:检测中国用户时区和代理域名(147+ 中国域名黑名单),用 Unicode 隐写术嵌入分类结果到 system prompt。 关键点:不受 DISABLE_TELEMETRY 开关控制;改时区才能避免标记(VPN 无效)。

优势

劣势