三方一句话定位
抛开技术细节,三种接入方式在你工作流里扮演的角色完全不同。先看大局。
Pro / Max
Anthropic Direct
第三方代理
能力差异 11 维 矩阵
同样的 Claude Code 客户端,背后接 3 种 backend,体验差异远超你的想象。
| 维度 | 官方订阅 (Max $200) | 官方 API | 中转 / 号池 |
|---|---|---|---|
| 计费方式 | 月费包干 + 5h/周双窗口 | 按 token,4 级 tier | 内部汇率折 token (¥2.4/$ 而非 ¥7/$) |
| Tool use | 稳定全功能 | 稳定全功能 | 高崩溃 11 类已知 bug |
| Prompt caching | 1h TTL 默认免费 | 5min 需 env 切换 1h | 多数失效 cache_control 不透传 |
| 1M context | Max 默认 Opus 1M | 2026-03 起 GA,标准价 | 多数停在 200K 或假支持静默截断 |
| Extended thinking | 可用,原生加密签名 | 可用,原生 | 第二轮必崩 JSON 重序列化打碎签名 |
| MCP 工具 | 默认启用 | 默认启用 | 默认禁用 非第一方主机自动关 |
| Computer use | 独占 macOS only | 不可用 必须订阅认证 | 不可用 |
| 新模型时差 | 同期 GA (Opus 4.7 同步) | 同期 GA | 滞后 1-7 天 |
| 模型质量 | 真模型 | 真模型 | 30%+ 中转有掺假记录 Haiku 顶 Sonnet / 国产顶 Claude |
| 系统提示注入 | 无 | 无 | 反代源自带 system prompt |
| 数据安全 | Anthropic 直收 | Anthropic 直收 | 明文过中转 部分有训练嫌疑 |
Tool use 在中转上的 11 类崩溃
2025 年的 6 类老坑 + 2026 年新出的 5 类隐坑。Claude Code 通过 ANTHROPIC_BASE_URL 切到中转后,工具调用为什么会随时崩——拆解到具体的 issue # 和错误现场。
Beta header 被拦截,触发工具调用立即 400
Claude Code 默认发 advisor-tool-2026-03-01、context-management-2025-06-27、advanced-tool-use-2025-11-20、oauth-2025-04-20 等实验头。OpenRouter / Bedrock / Vertex / LiteLLM / 自建反代基本 100% 拒收。聊天能跑,触发工具的那一刻立刻 400。
缓解:CLAUDE_CODE_DISABLE_EXPERIMENTAL_BETAS=1,但 v2.1.100 起 advisor-tool 不在抑制范围内,回归 bug。
tool_use_id 不匹配 / 孤儿 tool_result
多轮对话或 Task subagent 调用工具后 resume,第二次请求即报 unexpected tool_use_id found in tool_result blocks。中转的历史压缩/重写丢失 tool_use 块但保留 tool_result,ID 配对断裂。Claude Code 内置上下文压缩(>50 turn)也会触发同类问题。
Streaming input_json_delta 损坏
claude-code-router 这类协议转换器把 OpenAI 风格 reasoning 模型(Qwen3、DeepSeek)转 Anthropic streaming 时,input_json_delta 重复发送或 index 错移,工具参数 JSON 直接损坏。Qwen3-35B 开 reasoning 后实测 10/10 工具调用 malformed input。
content 字段被强行 string 化
Claude Code 发的 messages[n].content 是 array of blocks(每个 tool_use 是独立 block),OpenRouter 中转强转为单一 string,触发 Invalid input ... path: messages.3.content。tool use 路径强依赖 array 结构,立崩。
tool_choice / stop_reason 改写
中转层为统一处理强制 tool_choice=auto,覆盖客户端设的 any / required;stop_reason 被改写导致 Claude Code 误判工具调用是否完成 —— 表现为"Claude 不再调用工具,原地停止"或"明明该停却循环调用"。
MCP 工具被默认禁用
ANTHROPIC_BASE_URL 指向非第一方主机时,Claude Code 内置的 tool search 默认禁用,因为多数代理不转发 tool_reference 块。需手动 ENABLE_TOOL_SEARCH=1 覆盖。Cline / OpenCode 等 wrapper 连 PackyAPI 会触发环境检查直接封号。
Thinking 块的加密签名被 JSON 重序列化打碎 2026 新
第二轮对话直接 400 Invalid signature in thinking block,第一轮完全正常。Anthropic 2026 起对 thinking 块加了 session-scoped 加密签名校验,中转只要做一次 JSON re-serialize / 空白归一化 / 字符编码转换,签名 bit 就对不上。
会推理的模型走中转,第二条消息见生死。
MCP SSE 断了,Claude Code 不报错也不重连 2026 新
MCP 调用永久 "still running",每 30s 心跳一次,23 分钟也不超时,只能 Esc。SSE drop 324ms 内被诊断到,但 client 既不 fail 也不重连握手 —— 中转链路稍微抖一下就触发,配套 silent hang on tool_result。
MCP 不报错不等于活着 —— 挂 30 秒就该当死了。
1M 上下文版本号默默掉档 2026 新
升级到 v2.1.112 后,/context 从 1M 变 200K,自动压缩从 ~967K 提前到 ~167K,changelog 一字不提。model string 从 claude-opus-4-6[1m] 变成 claude-opus-4-6,[1m] 后缀丢了 = 静默回退。中转更糟:OAuth 接入会被硬编码 200K。
不看 model string 的 [1m] 后缀,1M 是空头支票。
风控转「行为画像」,干净 IP 也救不了 2026 新
买了 Cogent AS174 双 ISP 家宽,ipinfo 绿、ipapi.is 红,3 个月封 3 个号。风控从单维 IP 转到多维行为画像 —— WebRTC 泄漏、DNS 泄漏、时区/语言/IP 地理不一致、并发度、付款方式。2026-01-09 Anthropic 上线客户端指纹,2026-04-04 全面执行。
现在封的不是你的 IP,是你这个"人"长得不像开发者。
OAuth 订阅 token 出第一方应用即废 2026 新
2026-04-04 12:00 PT 起,凡是 Pro/Max 订阅 OAuth token 出了第一方 Claude Code 客户端,立刻被切走。Cline / Cursor / Windsurf / OpenCode 跑订阅认证模式当天断流,唯一合规路径是单独申请 API key 走 pay-as-you-go。订阅反代利润链断裂。
不止 tool use — 三个隐藏成本
表面 0.3 折,实际可能比官方更贵。三层暗扣叠加,让"便宜"变成"更贵"。
源码泄露揭穿的 5 道反池化防线
2026-03-30/31 Claude Code v2.1.88 源码意外随 .map 文件上线 npm,59.8 MB · 512,000+ 行 TypeScript · 1,906 个文件 · 44 个 feature flag · 20+ 未发布能力 —— Anthropic 内部反蒸馏机制第一次完整曝光。这是同一坑第二次踩。
There is NO force-OFF. This guards against model codename leaks.
(无法强制关闭,防止模型代号泄露。)
AI 时代的"陷阱街道(Trap Street)" —— 地图行业反盗版几百年的老招。
封禁机制做得越精巧,误伤越离谱。HN 1033 分上首页。
30 秒识破 真假 Claude · 10 个探针
视频结尾的可操作产出。每个探针都附带一句你能直接念给模型的 prompt + 真 Opus 应有的反应 + 假货的破绽。挑 2-3 个连环打,准确率接近 100%。
假货: 输出"太完美"、姓名多样流畅 = 露馅。核心反直觉:有乱码才是真 Opus。
假货: 保留原弯引号「」 = 不是真 Claude。
失效 1: 完全没有这俩字段 → 立刻换平台。
失效 2: 账单只显示 cache_creation 几乎不出现 cache_read → 假 caching,每次重写。
反代源(Kiro/Antigravity/Copilot): 泄露额外指令 — 那个不是 Claude 的,是中转加的。
假货: GPT-4o 50/50 均匀;国产 5 次全不一样、无免责。
假货: GPT-4o / Gemini / 国产大概率回"这是一个很好的问题"。
假货: GPT-4o 首字母大小写均匀分布。马尔可夫链都能 65% 准确率认出 provider。
假货: GPT-4o 答 2023-10;国产多答 2024 某月;Sonnet 4.6 答 August 2025(识破降智版替换)。
假货: OpenAI 模型 decode zero-width binary 不响应 Tags;国产模型对两种都不解码,正常答呼噜不带 emoji。
假货: GPT 系答镜子/管家/工具箱;国产套壳答"我是你的智能助手"破功。
五个反直觉 数据钩子
每一个都可以单独做开场。颠覆"中转便宜、订阅贵、API 万能"的直觉。
你该 选哪个?
按实际使用场景对号入座。最右侧是关键注意事项。
2025-2026 关键事件 时间线
从 Claude Code 研究预览到字符串扫描一刀切 —— 12 个改变中转生态的关键日期。
未来 6-12 月 预测
基于已观察到的趋势 + 源码泄露线索外推 —— 中转生态、Anthropic 反池化、用户应对策略。
- 6/15 Agent SDK credits 让"订阅反代当无限 API 用"彻底死亡,中文中转最大利润来源消失。
- 逆向中转转向国产模型:GLM-5、Kimi K2.6、MiniMax M2.7 编程能力进展明显(SWE-Bench 77-80%+)。
- 从"卖假 Claude"逐步变为"卖真国产模型 + 套 Anthropic API 协议"。
- ANTI_DISTILLATION_CC 假工具定义已在 v2.1.88 源码确认 — 注入污染训练数据。
- CONNECTOR_TEXT 对工具调用思维链做加密签名,反代只能拿摘要不能拿明文。
- 下一步:客户端硬件指纹(macOS Keychain / Windows TPM 绑定)、KYC + 信用卡国别匹配、cache 跨设备同步限制、行为画像 ML 模型上线。
- 重度用户:立刻锁 Max 20×,不要再观望中转。
- 已用中转:不充超过单月用量,新中转开业 < 3 个月不充超 ¥100。
- 自动化场景:6/15 后必须切到独立 API key,订阅反代彻底不可行。
- 数据敏感:完全避开中转,对话数据可能进训练池。
- 跑前自测:每月用 10 个探针抽 2-3 个验证,发现降智或假 caching 立刻迁移。
你还是你吗?
不要再相信"0.3 折"。便宜是用工具链稳定性、模型质量、caching 命中率换的。
真便宜的,是把 Claude Code 当主力工具的人,订一个 Max。