TLDR
把 cc-switch 的默认模型设成 DeepSeek 后,你最该做的一件事不是「配通」——而是选对那个每天打交道最多的模型。DeepSeek 家族现在有四条线(V3 通用、V4 Flash 轻量、V4 Pro 旗舰、R1 推理),在编程场景下表现差异不是「略好略差」,而是该用对的时候用错,浪费的时间比省的钱多得多。这篇文章给你一个可操作的决策框架:日常编码用 V3.2 或 V4 Flash——快、够用、输出价格只有 V3 老版的 1/3;复杂重构和跨文件大改动上 V4 Pro;深度推理任务(算法设计、多步调试)切 R1 或直接切回 Claude。加上模型映射表把不同任务分派到不同模型,月花费能压到 $3 以内——同时不牺牲编码效率。
1. 先说清楚:cc-switch 语境下的「基础模型」到底是什么
cc-switch 官方文档没定义过「基础模型」——但它藏在两个地方:
Claude Code:
ANTHROPIC_MODEL 环境变量。 在你的 DeepSeek provider 编辑面板里打开 JSON Editor,这个变量指向的模型就是 Claude Code 每次对话默认调用的——你的日常交互 80% 走它。还有一个 ANTHROPIC_SMALL_FAST_MODEL 管后台轻量任务(自动补全之类)。Codex:Model Mapping Table。 本地路由开启后,这张表(存在
model_catalog_json 里)列出所有上游模型映射。表里你最常用的那条,就是 Codex 语境下的基础模型。为什么这件事重要: cc-switch 在 127.0.0.1:15721 做 Responses↔Chat Completions 协议转换,透明高效——但它不会替你判断「这个请求该走哪个模型」。基础模型选错了,连锁反应是系统性的:用 R1 做基础模型,每次「这个报错什么意思」都要等它推理——日积月累浪费的不只是钱。用 V3 处理深度推理,它会给你「看起来像答案」的东西但缺推演过程,你以为省了钱,实际上多花了好几轮才搞对——便宜模型省下的 API 费,三秒内在多轮对话里就烧回去了。
2. DeepSeek 家族速览:四条线,各干各的
别被 12 个模型的列表吓到。编程场景只需要关注四条线。
V3 系列:通用主力,牢记只有 V3.2 值得用
V3 对标 GPT-4o,关键是 V3.2 的输出价格跳水:
模型 | 输入 | 输出 | 上下文 |
V3(老版) | $0.257 | $1.03 | 164K |
V3.1 | $0.250 | $0.95 | 164K |
V3.2 | $0.269 | $0.400 | 164K |
V3.2 输出价只有老版 V3 的 40%。如果你还在用
deepseek-chat(即将弃用的老 V3 别名),赶紧切。HumanEval 约 78~82 区间,日常编码完全够用。V4 Flash:最快最省
输入 $0.140/1M、输出 $0.280/1M——输出是 V3 老版的 1/4。上下文 1M,整个代码仓一次喂进去。日常编码——写函数、修 bug、解释代码——这就是最经济的选择。快任务很快,复杂任务不够深。
V4 Pro:旗舰,留给你真正需要的时候
$0.435 输入 / $0.870 输出,是 Flash 的 3 倍。跨文件重构、长上下文理解时明显更强。别设为基础模型——每次「加个 console.log」都要付三倍钱。
R1:推理模型,利器但不是日常工具
$0.70 输入 / $2.50 输出,对标 o1。HumanEval 82.3(vs V3 78.9),SQL 生成 92.1%(vs V3 85.7%)。复杂 bug、算法设计、架构重构比 V3 强一个档次。
但别设为基础模型——慢(每次都要思维链推理)和贵(输出是 Flash 的 9 倍)。用来回答「这个报错什么意思」就是浪费。R1 Distill Llama 70B 更不用考虑——上下文 8K。
一张表讲清
场景 | 推荐模型 | 理由 |
日常编码(功能、bug、测试) | V4 Flash 或 V3.2 | 快、够准、便宜 |
复杂重构、跨文件改动 | V4 Pro | 长上下文理解强 |
算法设计、多步调试 | R1 或切回 Claude | 推理最关键,别省 |
代码解释、文档生成 | V4 Flash | 纯输出任务,最便宜就行 |
3. 选型铁律:别把「基础模型」当「唯一模型」
大部分人的直觉是「我就选一个最好的,所有任务都用它」。这个直觉在 DeepSeek 场景下是错的——因为 DeepSeek 的四条线互补远大于重叠。
正确的决策框架是两句话:
1. 基础模型选「高频低成本」的那个。 你每天 80% 的对话是简单任务——问报错、改一行、加个测试。这些场景用 V4 Flash 或 V3.2 就够好,用 V4 Pro 或 R1 属于过度消费。V4 Flash 输出 $0.28/1M,一个月哪怕消耗 15M tokens(其中约 4.5M 输出),也才 $1.26 输出费。加上输入,一个月总共不到 $3。
2. 用模型映射表把「低频高难度」任务分派到更强的模型。 cc-switch 支持两个级别的模型分派:
- Claude Code 下:
ANTHROPIC_MODEL设主力模型(如 V4 Flash),ANTHROPIC_SMALL_FAST_MODEL设一个更轻量的备选。
- Codex 下:Model Mapping Table 可以定义多行映射,每行指定上游模型 ID。你在 Codex 里用
/model切模型时,实际切的是这张表里的条目。这才是真正的「按任务分派」。
实际操作建议:基础模型设为 V4 Flash 或 V3.2,模型映射表里额外加一条 V4 Pro 和一条 R1。日常对话自然走基础模型,遇到复杂需求时手动切——或者在 Claude Code / Codex 的指令里显式指定 model。如果你想更自动化:Codex 的 model_catalog_json 支持按任务类型匹配模型(但这部分的高级配置目前还需要配合 Codex 自身的 routing 规则,不在 cc-switch 控制范围内)。
什么时候该切回 Claude? 当你用 R1 还是觉得推理不够深的时候——特别是涉及复杂业务逻辑追溯、多服务架构分析这类任务,Claude Sonnet 4.5 或 Opus 的理解深度仍然是 DeepSeek 目前追不上的。切回去不丢人——cc-switch 本来就是让你无缝切换的,不是让你「离开 Claude 就活不了」的宗教战争。
4. 实操:两步配好,别踩这几个坑
这部分不讲保姆步骤——网上一百篇。只讲配置中真正卡人的点。
两步配好
基础模型: provider 编辑面板 → JSON Editor →
ANTHROPIC_MODEL 填 deepseek-v4-flash 或 deepseek-v3.2 → 保存 → 重启 Claude Code/Codex(配置在启动时一次性读取,不热加载)。模型映射(Codex 必做): 开启本地路由(
设置 → 路由 → 本地路由,默认 127.0.0.1:15721)→ Model Mapping Table 至少加两条:主力 deepseek-v4-flash,重活 deepseek-v4-pro。想用 R1 再加 deepseek-reasoner,Reasoning Effort 选 high → 重启 Codex。五个坑
- 端口 15721 被占:EACCES 报错。去设置里换端口,cc-switch 自动更新 Codex 配置。
- 1M 模型名别加
[1m]后缀:GitHub issue #2337——本地路由模式下带后缀导致下游 API 失败。写deepseek-v4-pro,不写deepseek-v4-pro[1m]。
- Base URL 末尾别带斜杠:
https://api.deepseek.com对,https://api.deepseek.com/导致双斜杠//,直接 404。
- 换模型必须重启:改配置是实时的,但工具启动时一次性读配置——不重启不生效。
- R1 的 Reasoning Effort 真实有效,但设 high 后简单任务也强行推演,延迟大增。日常别用 high。
5. 到底能省多少:一个月花费估算
没有公开的「真实用户月用量数据」,坦诚说这是费用模型估算。
假设:全职开发者,每天用 Claude Code/Codex 4-6 小时,月消耗约 10M tokens(6M 输入 + 4M 输出)——对应每天 50-80 轮对话、中等规模代码文件。
方案 | 月费用(估算) |
Claude Code Pro(固定订阅) | $20 |
Claude Sonnet 4.5 API(同量 tokens) | ~$78($3 in / $15 out) |
DeepSeek V4 Flash 日常 + 偶尔 V4 Pro + R1 | $2~4 |
DeepSeek V3.2 日常 | $3~5 |
即使用量翻倍,DeepSeek 方案也很难超 $10——跟 $20 订阅价比,至少差 5 倍。
前提:你没把 R1 设为基础模型。如果 R1 做日常主力(输出 $2.50/1M),月费直接飙到 $15+——省下的订阅费全被「简单问题慢推理」吃掉了。另外,DeepSeek 对重复上下文有缓存命中折扣,仅收标准价的 10%。实际编码中反复改同一批文件的场景极多,真实花费往往比原始 token 估算还低。
总结:三个决策,现在就能做
- 基础模型选 V4 Flash 或 V3.2——别犹豫,先把
ANTHROPIC_MODEL改了。V3 老版输出价格是 V3.2 的 2.5 倍,没有任何理由继续用。
- 模型映射表里加三条:V4 Flash(日常)、V4 Pro(重活)、R1(推理)。不是为了「都用上」,是为了「该用的时候能秒切」。
- R1 不是基础模型——它是一个工具,和 Claude 一样,是你在遇到特定问题时才调用的武器。日常让它闲着。
cc-switch 让切换成本降到几乎为零。但零切换成本不等于零决策成本——选对基础模型,才是这套工具真正替你省钱的地方。
- 作者:www.airouter.me
- 链接:https://airouter.me/article/cc-switch-deepseek
- 声明:本文采用 CC BY-NC-SA 4.0 许可协议,转载请注明出处。
.webp?table=block&id=29d6498c-e5c2-81db-8e4b-e244bef7a08e&t=29d6498c-e5c2-81db-8e4b-e244bef7a08e)
.webp?table=block&id=29d6498c-e5c2-81c0-a99d-c7634656aeb1&t=29d6498c-e5c2-81c0-a99d-c7634656aeb1)
.webp?table=block&id=29d6498c-e5c2-8142-95cf-f25aa5bf7c3c&t=29d6498c-e5c2-8142-95cf-f25aa5bf7c3c)
.webp?table=block&id=29d6498c-e5c2-81a6-9769-d0a36aa56ae1&t=29d6498c-e5c2-81a6-9769-d0a36aa56ae1)
.webp?table=block&id=29d6498c-e5c2-81b9-9097-ca18dffbaf26&t=29d6498c-e5c2-81b9-9097-ca18dffbaf26)
.webp?table=block&id=29d6498c-e5c2-8179-a7cc-f3e9ba78174b&t=29d6498c-e5c2-8179-a7cc-f3e9ba78174b)