22 块钱跑通一个真活,DeepSeek V4 接进 Claude Code 实测
22 块 4 毛,一次会话从头跑到尾,产出 15 个文件、532 行 Python、一篇三千字文章、一组风格统一的配图。这是 DeepSeek V4 预览版发布当天,我在 Claude Code 里给它派真活跑出来的账单。
老雷把结论放在最前面。能跑通,交付物齐整,但离眼前一亮还有距离。有些地方做得聪明,有些地方还是预览版的毛糙,尤其是复杂 Skill 调用和既有项目约束这两块。这篇把接入步骤、实测过程和翻车记录一次交完,给准备上手的工程师省一遍踩坑时间。
先看模型成色和价格
发布的是预览版,官方标的 preview,生产稳定性还在迭代。两档旗舰,deepseek-v4-pro 和轻量的 deepseek-v4-flash,都标配 1M 上下文、384K 输出和思考模式。1M 上下文什么概念,《三体》三部曲 90 万字,一个对话窗口能装下大半部。
有两件事得先讲清楚。V4 是纯文本模型,图片音频视频的输入输出都不支持,要处理图片得让它调外部图像模型,GPT Image 2、Nano Banana 这类都行,这跟 GPT-5、Opus 4.6 那种原生多模态不是一个路数。另外 V4-Pro 总参数 1.6 万亿,是 V3.2 的 2.5 倍,能力涨了,token 价格也跟着涨。
价格按每百万 token 计。Flash 输入缓存命中 2 毛、未命中 1 块,输出 2 块。Pro 输入缓存命中 1 块、未命中 12 块,输出 24 块。换算成一次普通编程会话,5 万 token 输入加 1 万输出,Pro 不到 1 块钱,Flash 不到 1 毛。官方只保证计价方式,具体单价后续可能调整,以 DeepSeek 官方价格页为准。
这个价格结构值得多看一眼。海外模型的涨价是能力溢价,人家卖的是稀缺。国产模型的价格是被算力掐着的,芯片产能一起来,价格还会松。对使用者这是好事,同样一笔预算,能跑的活一年比一年多。
省钱姿势实测有效,主干用 Pro,轻活和子 Agent 换 Flash,输入成本差 12 倍,同一趟活能从 22 块压到 5 块以内。我这次为了看上限,全程没降档。

五步接入,避开三个坑
接入本身不难,按顺序五步。
第一步,去 DeepSeek 开放平台注册、充值、拿 API Key,sk- 开头那串。第二步,这台电脑之前登过 Claude 官方账号的,先清 OAuth 残留,这是第一大坑,很多人切完一直报 401,就是老凭据没清干净。第三步,把这一节末尾的参数模板抄进用户目录下 .claude 文件夹的 settings.json 的 env 区。第四步,对着三个坑自查一遍。第五步,新开终端问它你是什么模型,回答里出现 deepseek 就通了。
三个坑展开说。第三方 provider 一律用 ANTHROPICAUTHTOKEN 放密钥,错写成 ANTHROPICAPIKEY 就是不通。DeepSeek 只支持流式输出,CLAUDECODEDISABLENONSTREAMINGFALLBACK 必须设成 1 禁掉回退。超时默认 10 分钟,1M 上下文的场景要拉到 50 分钟,不然长任务跑到一半被掐断。
老雷的建议是,接入完成先派一个小任务试水,确认工具调用正常再上真活,别拿生产项目当试验田。
一个真活,三个阶段
任务只有一段人话。参考知识库里的配图 Skill 规范,新建一个使用 GPT Image 2 的配图 Skill,再用它给这篇文章配图,顺手把整个过程写成一篇文字。没给文件路径,没给代码框架,没给分步指令。
我以为它会立刻开干,结果它先跑了三个阶段。
阶段 A 读规则。它先钻进知识库把表达风格文件从头到尾读了一遍,读出了行文偏好和一份 24 个 AI 味词的禁用清单。读完风格又去读 GPT Image 2 的官方文档,三轮搜索、六次抓取、几万字啃完,才写第一行代码。先读再动手这个习惯值钱,能省掉后面调 bug 的三倍时间。不过得补一句,这个好习惯不是每次都出现,换个场景它也可能跳过确认直接开干,别拿一次表现当稳定水位。
阶段 B 挑教材。知识库里躺着两份它没见过的东西,一份是 17 个文件 3 万字的 Skill 开发规范,管命名、目录、步骤格式、脚本边界和错误分类,另一份是我之前自用的 Gemini 配图 Skill。它扫完做了件合理的事,没照抄。它判断 GPT Image 2 的中文字渲染是像素级的,纯文本提示词就够,把垫图机制砍了,风格系统改成视觉参数矩阵。它分得清哪些是基础设施,哪些是机制,云存储三模式和语言闸门原样保留。
阶段 C 产出。风格系统按内容分 7 个大领域,每个领域定义色彩、光照、构图、排版、质感 5 个维度的视觉参数,配一张 50 多个关键词的自动匹配表,核心是视觉签名机制,同一篇文章的所有配图共享同一组风格参数。两个脚本,generatefal.py 359 行调生图接口,uploadcos.py 173 行管上传,语法检查零错误。文章写完我手动顺了一遍句子,修改度大概四五成。
账单这一笔单独记。整个会话上下文占用 21%,API 账单 22 块,没断片、没触发压缩,剩下的上下文还能再接四个同等任务。

做对四处,翻车五处
先说做对的。一是主动补上下文,多数模型凭印象硬写,它先读风格、读规范、读官方文档。二是会做加减法,看到旧 Skill 不是拷贝改改就交,判断什么该留什么该升级。三是主动搭架构,交付的不是调接口的玩具脚本,是一套风格系统。四是知道自己的边界,它在 Skill 主文档末尾自己加了一句,本 Skill 已完成结构搭建与静态验证,实际生成质量需在真实文章上端到端测试后再评估。没人让它写,它清楚自己跑没跑过真实场景。
再说翻车的,这部分更值钱。最大的坑是复杂 Skill 调用识别偏弱,让它去服务器上查个东西,本地明明有对应的服务器 Skill,它有时会忘了调,得把关键词说得非常明确。接手带约束的现成项目,它会跳过全局搜索直接动手,一开干二十多分钟,约束经常性失效,同期 GLM-5.1 在这块明显更稳。其余四处,该输出中文的地方偶尔冒一句英文,一次会话两三处。编辑工具的字符串精确匹配偶尔漏个空格,改失败得重读再来,不卡死但多烧 token。写 359 行脚本时输出到七成停了将近一分钟,对要跑批的生产环境是隐患。表格空行、列表符号这类软约束经常不一致,得人工过一遍。另外跨文件深度推理的步骤里它比 Opus 慢半拍,这是模型差距,不是 bug。
得承认这次测试的场景对它偏友好,建新 Skill 的任务边界是它自己定的,没有旧约束要守。换成接手已有十个 Skill 的老项目加功能,按它暴露的问题看,大概率翻车。
测 AI 模型的难点不在它能做到什么,在它能稳定做到什么。
分场景怎么用,附接入模板
不是所有活都值得派给 V4,按场景拆。
长文档分析、长合同审阅、小说通读,这是 V4-Pro 真正的杀手锏,1M 上下文一次装下几十万字,同行里这是最明确的相对优势。知识库扫描、素材整理、翻译批量活,交给 V4-Flash,2 毛的缓存输入价扫一圈不心疼。代码开发主力先观望,等 Skill 调用和约束遵守这两个问题在正式版修好,之前这块还是更稳的组合顺手。深度推理和创意策划,Opus 4.6 那种一下接通的质感暂时无可替代。
国产模型的每一步都值得认真看,这话不是情怀。用海外模型的朋友这一年里被封号的、账号失效的、充值卡被拒的,见得不少,辛苦搭好的工作流一觉醒来跑不动。工具早就不是尝鲜玩具,是生产资料,生产资料断供影响的是吃饭。老雷的态度是海外模型照用,哪个顺手用哪个,但心里得清楚,那终究是别人家的水龙头,什么时候关不由你。国产模型每次跑分逼近第一梯队,都是未来几年你能稳定用 AI 的底气。
最后一个必须说透的前提。V4 这次能一把跑通,靠的是知识库里现成喂料的三样东西,手写的 Skill 开发规范、之前的配图 Skill、沉淀的身份风格层。把同一段提示词喂给裸的 V4,它最多给你一个能跑的骨架,你的命名习惯、风格偏好、禁用清单它一概不知。模型只是能力,知识库才是上下文。
模型是耗材,知识库才是资产。拉开差距的从来不是谁用上了更强的模型,是谁先认真沉淀自己的知识库。
文末照例留一份能照抄的接入模板。在用户目录 .claude 文件夹的 settings.json 的 env 区加上这组参数,密钥换成自己的。
"env": {
"ANTHROPIC_BASE_URL": "https://api.deepseek.com/anthropic",
"ANTHROPIC_AUTH_TOKEN": "sk-你的DeepSeek密钥",
"ANTHROPIC_MODEL": "deepseek-v4-pro[1m]",
"ANTHROPIC_DEFAULT_HAIKU_MODEL": "deepseek-v4-flash",
"ANTHROPIC_DEFAULT_SONNET_MODEL": "deepseek-v4-pro",
"ANTHROPIC_DEFAULT_OPUS_MODEL": "deepseek-v4-pro",
"CLAUDE_CODE_SUBAGENT_MODEL": "deepseek-v4-pro",
"CLAUDE_CODE_DISABLE_NONESSENTIAL_TRAFFIC": "1",
"CLAUDE_CODE_DISABLE_NONSTREAMING_FALLBACK": "1",
"API_TIMEOUT_MS": "3000000",
"CLAUDE_CODE_MAX_OUTPUT_TOKENS": "384000"
}
省钱版把 CLAUDECODESUBAGENT_MODEL 也换成 deepseek-v4-flash,轻活子任务全走低价档。密钥只放在本机配置文件里,别写进代码仓库和共享文档,这类低级泄露在真实事故里占比最高。正式版出来我会重点复测 Skill 调用那条硬伤修没修,届时结论可能更新。
