首页/新闻资讯/正文详情

DeepSeek-V4-Pro-0813 API 更新速览:官方参数、价格与 Codex 接入成本计算

发布时间:2026/9/26 11:47:13 来源:云帆数科 栏目:资讯中心
DeepSeek-V4-Pro-0813 API 更新速览:官方参数、价格与 Codex 接入成本计算
1. DeepSeek-V4-Pro-0813 更新后Codex 接入到底贵了多少DeepSeek-V4-Pro-0813 是 DeepSeek 官方 API 文档里deepseek-v4-pro当前对应的版本号模型名不用改但参数、价格和 Codex 侧的接入方式都有更新。如果你正在用 Codex CLI、VS Code 里的 Codex 插件或者准备把 Agent 工作流切到 V4 Pro这篇就是给你写的我会把官方参数、V4 Flash 与 V4 Pro 的价格差、Codex 的config.toml骨架、一次可复现的调用验证以及 Token 成本计算步骤全部走一遍。需要先说清楚一个边界截至写稿时DeepSeek 官方更新日志里并没有一篇独立的 V4 Pro 发布文章能核实的是官方 API 文档已经更新到 DeepSeek-V4-Pro-0813。所以本文只讨论 API 侧的变化不延伸成 App、Web 或开源权重同步发布。这个区分很重要因为很多“更新速览”会把文档更新写成产品发布实际接入时你会发现模型名没变、调用方式没变变的只是版本指向和价格表。对开发者来说真正影响决策的是三件事第一deepseek-v4-pro现在指向哪个版本、上下文和输出上限是多少第二V4 Pro 比 V4 Flash 贵多少贵在输入还是输出第三Codex 里怎么配才能稳定调通并且能算清一次任务大概花多少钱。下面按这个顺序展开。2. 官方文档确认的参数与价格变化2.1 模型名不变版本指向更新官方 API 文档里V4 Flash 和 V4 Pro 的模型名分别是deepseek-v4-flash和deepseek-v4-pro当前版本对应 DeepSeek-V4-Flash-0731 和 DeepSeek-V4-Pro-0813。已有项目不需要把模型名写成带日期的版本继续用deepseek-v4-pro就会调用最新版本。项目V4 FlashV4 ProAPI 模型名deepseek-v4-flashdeepseek-v4-pro当前版本DeepSeek-V4-Flash-0731DeepSeek-V4-Pro-0813上下文长度1M1M最大输出384K384KJSON Output支持支持Tool Calls支持支持Responses API支持支持Anthropic API支持支持FIM 补全仅非思考模式仅非思考模式一个最小请求体长这样注意thinking和reasoning_effort是分开控制的{ model: deepseek-v4-pro, messages: [ {role: user, content: 分析这个仓库中的测试失败原因} ], thinking: {type: enabled}, reasoning_effort: high }2.2 价格表Pro 贵在未命中输入和输出官方价格单位是人民币/百万 Token缓存命中和未命中分开计价模型缓存命中输入缓存未命中输入输出V4 Flash0.02 元1 元2 元V4 Pro0.025 元3 元6 元注意DeepSeek 在价格页同时提示API 服务价格计划近期整体上调正式使用前需要重新核对官方页面。本文所有计算都基于上面这张表如果官方调价把数字替换掉即可。从表里能直接看出Pro 的缓存命中输入只比 Flash 贵 0.005 元几乎可以忽略真正拉开差距的是未命中输入3 元 vs 1 元和输出6 元 vs 2 元。这意味着如果你的任务缓存命中率高Pro 和 Flash 的成本差会被压缩如果每次都是全新上下文差距会接近 3 倍。3. 用 TaoToken 统一 Key 和 API 通道如果你同时要接 DeepSeek、Claude、Codex 等多个模型逐个管理 Key 和 base_url 会很乱。我一般用 TaoToken 做统一通道一个 Key 走多个模型Codex 侧只改base_url和experimental_bearer_token不用在每个 provider 之间来回切。TaoToken 的 API 地址是https://taotoken.net/api官网是https://taotoken.net/?utm_sourcetaotoken_aicg_blog_endutm_mediumcsdnutm_campaignrewriteutm_content。接入前先去控制台建 Key路径是 console 和 api-keys控制台https://taotoken.net/console?utm_sourcetaotoken_aicg_blog_endutm_contentconsoleutm_campaignrewriteAPI Keyshttps://taotoken.net/api-keys?utm_sourcetaotoken_aicg_blog_endutm_contentapi-keysutm_campaignrewrite接入文档https://taotoken.net/doc?utm_sourcetaotoken_aicg_blog_endutm_contentdocutm_campaignrewrite注意不要把真实 API Key 提交到 Git 仓库、文章截图或公开配置文件。配置前先备份原来的~/.codex/config.toml。4. Codex 侧 config.toml 骨架与可复制配置Codex CLI、ChatGPT 桌面端和 VS Code Codex 插件共用~/.codex/config.toml。官方说明 DeepSeek API 原生支持 Responses API所以wire_api填responses。下面这份骨架可以直接改 Key 后用model deepseek-v4-pro model_provider taotoken preferred_auth_method apikey forced_login_method api model_reasoning_effort high model_catalog_json ~/.codex/models.json [model_providers.taotoken] name taotoken base_url https://taotoken.net/api wire_api responses experimental_bearer_token 你的 TaoToken API Key如果你只想直连 DeepSeek 官方把 provider 换成官方地址即可结构不变[model_providers.deepseek] name deepseek base_url https://api.deepseek.com/ wire_api responses experimental_bearer_token 你的 DeepSeek API Key配置完保存重启 Codex CLI 或重载 VS Code 窗口。model_reasoning_effort建议先设high跑一次复杂任务确认链路通了再按任务降级到medium因为 reasoning effort 会直接影响输出 Token 量也就直接影响成本。5. 一次可复现的调用验证配置好之后先用一个最小请求验证链路不要一上来就跑大仓库任务。用 curl 直接打 TaoToken 的 APIcurl https://taotoken.net/api/v1/chat/completions \ -H Authorization: Bearer $TAOTOKEN_API_KEY \ -H Content-Type: application/json \ -d { model: deepseek-v4-pro, messages: [ {role: user, content: 用一句话说明这个函数的作用def add(a,b): return ab} ], thinking: {type: enabled}, reasoning_effort: high }成功的话你会拿到一个标准 chat completion 响应choices[0].message.content里有模型输出usage字段里能看到prompt_tokens、completion_tokens和缓存相关字段。把usage记下来这就是你算成本的原始数据。如果返回 401检查 Key 是否带上了Bearer前缀如果返回 404检查base_url是不是写成了https://taotoken.net/api/v1之外的形式如果返回 400 且提示 model 不存在确认模型名是deepseek-v4-pro而不是带日期的版本号。6. Token 成本计算步骤6.1 计算公式把输入 Token 拆成缓存命中和未命中两部分公式如下function cost(prices, inputTokens, outputTokens, cacheRate) { const cached inputTokens * cacheRate; const uncached inputTokens - cached; return ( cached / 1_000_000 * prices.cached uncached / 1_000_000 * prices.input outputTokens / 1_000_000 * prices.output ); } const prices { flash: { cached: 0.02, input: 1, output: 2 }, pro: { cached: 0.025, input: 3, output: 6 } };6.2 常规多文件任务示例假设一次任务120,000 输入 Token18,000 输出 Token40% 缓存命中率。V4 Flash缓存输入 120000 × 40% × 0.02 / 1000000 0.00096 元未缓存输入 120000 × 60% × 1 / 1000000 0.072 元输出 18000 × 2 / 1000000 0.036 元合计约 0.11 元。V4 Pro缓存输入 120000 × 40% × 0.025 / 1000000 0.0012 元未缓存输入 120000 × 60% × 3 / 1000000 0.216 元输出 18000 × 6 / 1000000 0.108 元合计约 0.33 元。这个示例里 Pro 约为 Flash 的 2.98 倍绝对差额约 0.22 元。100 次同类任务分别约 10.90 元和 32.52 元。6.3 大型仓库任务示例换成 650,000 输入、80,000 输出、65% 缓存命中Flash 约 0.40 元/次Pro 约 1.17 元/次绝对差额约 0.78 元/次。这里必须区分“Token 成本”和“项目总成本”。如果较高能力模型能减少一次数十分钟的人工返工0.78 元的差价可能可以接受如果任务只是改一个字段默认用 Pro 就没必要。我没有付费调用两个模型执行同一任务所以不提供未经验证的质量和速度排名。6.4 按任务风险选模型任务类型建议原因单文件小修复、文案和类型调整Flash边界明确优先控制调用成本常规多文件功能先 Flash失败后 Pro先低成本完成通过测试决定是否升级大型仓库、长链路调试考虑 Pro一次返工的人工成本可能高于 Token 差价安全、支付、权限、数据迁移Pro 人工复核模型不能替代测试、审查和回滚7. 本篇常见错排查第一个坑是模型名写成deepseek-v4-pro-0813。官方文档明确说已有项目继续用deepseek-v4-pro带日期版本不是调用名写了会报 model not found。第二个坑是wire_api填成chat。DeepSeek 原生支持 Responses APICodex 侧要填responses填错会出现请求格式不匹配。第三个坑是 Key 泄露。experimental_bearer_token是明文写在config.toml里的别把这个文件提交到 Git也别在截图里露出完整 Key。用 TaoToken 的话可以在控制台随时轮换 Key比逐个 provider 改配置省事。第四个坑是忽略缓存命中率。很多人算成本只乘输入单价结果实际账单比预估低很多或高很多。缓存命中输入和未命中输入差 100 倍以上算之前先看usage里的缓存字段。第五个坑是 reasoning effort 拉满跑简单任务。high会显著增加输出 Token简单任务用medium或low就够成本能降一截。8. 接入与验证入口排障和接入配置问题直接看 API Keys 和接入文档API Keys 在 https://taotoken.net/api-keys?utm_sourcetaotoken_aicg_blog_endutm_contentapi-keysutm_campaignrewrite 接入文档在 https://taotoken.net/doc?utm_sourcetaotoken_aicg_blog_endutm_contentdocutm_campaignrewrite 。想先验证模型输出质量用模型对话页面跑几个真实 prompthttps://taotoken.net/chat?utm_sourcetaotoken_aicg_blog_endutm_contentmodel-chatutm_campaignrewrite 。如果你要把 Codex 长期挂在 Agent 工作流里跑Coding Plan 更适合按量控制https://taotoken.net/coding-plan?utm_sourcetaotoken_aicg_blog_endutm_contentcoding-planutm_campaignrewrite 。Claude Code 和 Anthropic 兼容接入的说明在 https://taotoken.net/claude-code?utm_sourcetaotoken_aicg_blog_endutm_contentclaudecodeutm_campaignrewrite 。最后给一个实操建议先把config.toml里的model设成deepseek-v4-flash跑通链路确认usage字段能正常返回再切到deepseek-v4-pro跑同一个任务对比两次的prompt_tokens、completion_tokens和缓存命中率。这样你手里就有真实数据而不是拿估算表拍脑袋决定用哪个模型。

相关推荐

Claude Code 免回车确认:permission-mode 与 dangerously-skip-permissions 配置指南
Claude Code 免回车确认:permission-mode 与 dangerously-skip-permissions 配置指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/26 11:47:13

Claude Code 的 /simplify 命令:当重构变成自动化流水线
Claude Code 的 /simplify 命令:当重构变成自动化流水线

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/26 11:47:13

支持 MCP 的金融行情数据源怎么选:TaoToken 统一 Key 下的实时行情、财务数据与交易 API 工程边界
支持 MCP 的金融行情数据源怎么选:TaoToken 统一 Key 下的实时行情、财务数据与交易 API 工程边界

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/26 11:47:13

美团式订餐系统源码跑通与改造:从数据库到小程序联调全指南
美团式订餐系统源码跑通与改造:从数据库到小程序联调全指南

简介:这是一套类似美团订餐系统的前后端分离完整项目,包含基于Web的系统管理后台与微信小程序移动端应用。后台面向餐饮企业内部员工,支持菜品、套餐、订单等管理维护;移动端面向消费者,实现在线浏览菜品、加入购物车、… · 2026/9/26 12:24:10

WLAN基础知识:从PHY/MAC层原理到信道干扰排障
WLAN基础知识:从PHY/MAC层原理到信道干扰排障

简介:本资源是一份面向网络初学者与IT运维人员的WLAN基础入门文档,系统梳理无线局域网核心概念与技术原理,助力读者建立清晰的知识框架并理解实际组网逻辑。文档以WLAN基本定义切入,横向对比PAN、MAN、WAN等七类网络的覆盖范围与典… · 2026/9/26 12:24:09

嵌入式MCU开发三板斧:编译、烧录、仿真原理与实战避坑指南
嵌入式MCU开发三板斧:编译、烧录、仿真原理与实战避坑指南

嵌入式MCU开发,说来说去就是编译、烧录、仿真三板斧。我见过太多新手甚至做了两三年的工程师,被"编译通过但烧录失败""仿真时变量看不到""程序跑飞不知道从哪查"这类问题卡住半天。其实这三步背后的原理搞清楚&#xff0c… · 2026/9/26 12:24:09

QEMU+智能体:零硬件搭建RISC-V AI芯片开发环境
QEMU+智能体:零硬件搭建RISC-V AI芯片开发环境

1. 这块“实验台”到底解决什么问题这两年AI芯片的迭代速度快到离谱,但真正想上手摸一摸新架构的人其实很少。原因很简单:芯片没量产、开发板价格离谱、文档零零散散,很多做算法和系统软件的人根本没有机会在真实硬件上验证自己的想法。我一直… · 2026/9/26 12:24:09

多相Buck的两条路线:服务器主板VRM与显卡GPU供电设计差异解析
多相Buck的两条路线:服务器主板VRM与显卡GPU供电设计差异解析

干硬件这行,经常能看到类似这种争论:某服务器主板堆了十几相供电,某张旗舰显卡公布了二十相VRM,评论区马上分成两派,一派说显卡供电猛,一派说服务器主板才是真家伙。我过去几年正好两边都有接触&#xff0c… · 2026/9/26 12:24:09

订餐系统源码实战:三端跑通与订单状态机改造指南
订餐系统源码实战:三端跑通与订单状态机改造指南

简介:这是一份类似美团订餐系统的完整源码包,包含系统管理后台(Web端)和移动端(微信小程序端)两部分。管理后台面向餐饮企业员工,支持菜品、套餐、订单的维护管理;移动端面向消费者&… · 2026/9/26 12:24:03

数据库课后习题答案别硬背:当测试用例集刷,效率翻倍
数据库课后习题答案别硬背:当测试用例集刷,效率翻倍

简介:万常选版《数据库原理与设计》课后习题答案资源,覆盖第2至6章及第9章,适合正在学习关系模型、数据库建模、关系数据理论与模式求精的本科生、自学者作为复习与自测材料。压缩包共7个文件,含3个doc参考答案、2个sql示例脚本、… · 2026/9/26 0:00:21

OpenClaw 替代品?Hermes Agent 踩坑实录:macOS 飞书接入 TaoToken 配置
OpenClaw 替代品?Hermes Agent 踩坑实录:macOS 飞书接入 TaoToken 配置

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/26 0:00:40

向下兼容与向上兼容:接口设计中的兼容性策略与工程实践
向下兼容与向上兼容:接口设计中的兼容性策略与工程实践

一次版本升级事故,是很多团队绕不过去的坎。线上环境里,服务端明明已经上线了新版接口,老的移动端还在照着旧文档传参数。请求一到网关,校验直接拒绝,用户操作失败,客服群炸了锅,开发群里开始互… · 2026/9/26 0:00:46

了解更多?预约专属演示

我们的顾问将为您一对一讲解产品与方案

企业微信二维码