分组参数兼容性对比#
不知道选哪个?优先选 Claude-hybrid。 倍率 1.5x,兼容性较好,适合大多数日常对话、写作和编程辅助场景。
四大分组全面对比#
| 特性 | Claude-hybrid(1.5x) | AWS Claude(4x) | Max-high(3x) | 官方MAX(3.5x) | Claude官方直连Key(6x) |
|---|
| Anthropic 原生格式 | ✅ | ✅ | 以后台说明为准 | 以后台说明为准 | ✅ |
| OpenAI 兼容格式 | ✅ | 以后台说明为准 | 以后台说明为准 | 以后台说明为准 | 不建议作为默认 |
| cache_control | ✅ | ⚠️ 可能不兼容 | 以后台说明为准 | 以后台说明为准 | ✅ |
| 长上下文 / 1M 上下文 | 取决于模型与当前接口能力 | 取决于模型与当前接口能力 | 取决于模型与当前接口能力 | 取决于模型与当前接口能力 | 取决于模型与当前接口能力 |
| extended thinking | 取决于模型与客户端是否传参 | 取决于模型与客户端是否传参 | 取决于模型与客户端是否传参 | 取决于模型与客户端是否传参 | 取决于模型与客户端是否传参 |
| 倍率 | 1.5x | 4x | 3x | 3.5x | 6x |
| 适合场景 | 日常推荐 | 需要 AWS 通道时 | Max 相关场景 | Max 高可用场景 | 稳定性优先 |
参数兼容性详解#
✅ 都支持的#
❌ 有差异的(重点看这里)#
1. cache_control 参数#
AWS Claude 分组可能不兼容 cache_control
部分 AWS / Bedrock 通道对请求体字段更严格。如果客户端自动带上 cache_control,可能出现类似 Extra inputs are not permitted 的报错。
| 客户端 | 是否可能带 cache_control | 说明 |
|---|
| Claude Code | ✅ 常见 | 长上下文、缓存相关场景可能自动带 |
| Cursor | ⚠️ 取决于配置和版本 | 部分请求可能包含缓存相关字段 |
| Cherry Studio | ⚠️ 取决于模型/供应商配置 | 若走 Anthropic 格式或缓存功能,可能触发 |
| 自己写代码调 API | 看代码 | 不传就不会触发 |
{
"error": {
"message": "Extra inputs are not permitted",
"type": "invalid_request_error"
}
}
如果是自己写代码,移除请求体里的 cache_control
如果是客户端自动带参,尝试新开会话、关闭缓存相关选项,或更换分组
2. OpenAI 兼容格式#
Claude官 方直连Key 更适合 Anthropic 原生格式
后台标注的 Claude官方直连Key 更偏 Anthropic 原生调用方式。
如果你的客户端只能填写 OpenAI 兼容接口,也就是 /v1/chat/completions,优先选择 Claude-hybrid 等兼容性更好的分组。
| 客户端 | 常见默认格式 | 分组建议 |
|---|
| Cursor | OpenAI 兼容 | 优先 Claude-hybrid |
| Cherry Studio | 可选 OpenAI / Anthropic,取决于配置 | 不确定时先用 Claude-hybrid |
| Claude Code | Anthropic 原生 | 可用 Claude-hybrid 或 Claude官方直连Key |
| 自己写代码 | 看你选择的 SDK | OpenAI 格式用 /v1,Anthropic 格式用 /v1/messages |
3. 并发与限流#
不同分组的并发能力会受上游通道、模型负载、账号策略和平台风控影响。不要简单理解为“某个分组无限并发”。批量任务:控制并发,观察日志中的 429 / 529 / timeout
稳定性要求高:选择后台标注为高稳定性的分组,并设置重试和降级
多人共享 Key:不要无限并发,建议拆分 Key 或设置调用限额
按场景选分组#
🎯 快速决策流程图#
📋 场景推荐表#
| 使用场景 | 推荐分组 | 推荐模型 | 原因 |
|---|
| 日常对话 | Claude-hybrid(1.5x) | sonnet-5 | 性价比和能力均衡 |
| 编程开发 | Claude-hybrid(1.5x) | sonnet-5 | 日常代码任务优先选择 |
| 极致省钱 | 1x 分组,如 Code X / Qwen / default 等 | 按分组支持模型选择 | 预算优先,但需确认模型能力和兼容性 |
| 复杂推理 | Claude-hybrid(1.5x)或 官方MAX(3.5x) | sonnet-5 / opus 系列 | 复杂任务按能力选择 |
| 长文档 | Claude-hybrid 或 Claude官方直连Key | 支持长上下文的模型 | 取决于模型上下文上限和客户端参数 |
| Max 相关场景 | Max-high(3x)或 官方MAX(3.5x) | 后台支持的 Max 模型 | 需要 Max 分组时使用 |
| 稳定性优先 | Claude官方直连Key(6x) | sonnet-5 | 成本较高,适合高稳定性需求 |
各分组优缺点一句话总结#
| 分组 | ✅ 最大优点 | ⚠️ 注意点 |
|---|
| Claude-hybrid(1.5x) | 性价比高,兼容性较好 | 偶尔可能受调度波动影响 |
| AWS Claude(4x) | AWS 通道,适合特定场景 | 倍率不是最低,且可能对部分参数更严格 |
| Max-high(3x) | Max 相关分组,倍率低于官方MAX | 具体可用模型以后台为准 |
| 官方MAX(3.5x) | Max 高可用分组 | 成本高于 hybrid |
| Claude官方直连Key(6x) | 高稳定性场景可选 | 成本最高,不建议日常默认使用 |
90% 的用户 → claude-hybrid(1.5x)
什么都支持,价格适中,闭眼选就对了省钱党 → AWS Bedrock(1x)
最便宜,但用 Cherry Studio / Cursor 时注意 cache_control 报错稳定至上 → 官方直连(6x)
贵但稳,适合跑业务、不能中断的场景
常见问题#
Q:我用 Cherry Studio 报错 Extra inputs are not permitted 怎么办?#
你可能正在使用 AWS Claude / Bedrock 相关分组,且客户端请求里带了 cache_control 等该通道不兼容的字段。
解决:把分组从 AWS 切换到 claude-hybrid 即可
Q:官方直连为什么不支持 OpenAI 格式?#
因为官方直连走的是 Anthropic 原生 API,只接受 /v1/messages 格式。
而大部分第三方客户端(Cherry Studio、Cursor)默认用 OpenAI 的 /v1/chat/completions 格式。
换成 Max / AWS / Hybrid 分组(支持 OpenAI 格式)
或者在客户端里手动切换为 Anthropic 格式(如果支持)
Q:Hybrid 和 Max 都支持 cache_control,有什么区别?#
Max-high(3x)或 官方MAX(3.5x)
✅ 支持最新特性
❌ 受 Anthropic 封控影响,可能间歇不可用
💰 4 倍价格Hybrid(1.5x):
✅ 混合调度,兼顾兼容性与成本
✅ 便宜得多
❌ 偶尔波动
💰 1.5 倍价格
Q:我能不能不同场景用不同分组?#
日常聊天 → hybrid(省钱)
写重要代码 → hybrid 或 官方直连(稳定)
试新功能 → Max(支持最新特性)
跑批量任务 → AWS(最便宜,注意 cache_control)
只需要在客户端里把模型名切换到对应分组的名称即可。