AI产品库

产品情报 / 编程大模型与代码模型 API

DeepSeek Coder LogoDeepSeek Coder

从开源代码模型到编程接口

DeepSeek Coder 是深度求索的代码模型线:早期以开源权重发布 Coder 与 Coder-V2,把支持语言从 86 种扩到 338 种、上下文从 16K 提到 128K;如今编程场景主要由百万上下文的 V4 系列接口承担。

深度介绍

DeepSeek Coder详细介绍

🧭

两条线:开源权重与在线接口

理解这条产品线要分成两段历史。前一段是开放权重的代码模型:官方的代码模型仓库自述为「让代码自己写自己」,随后发布的第二代把门面打开到与闭源模型正面比代码能力。后一段是现在:编程场景主要由接口承担,官方接口文档里当前可用的模型名只有两个,上下文长度 100 万 token,并且把思考模式、工具调用、两种协议格式和上下文缓存都做成了标准能力。想自己部署就跑开源权重,想省事就直接调接口。

🧬

开源代码模型的两代积累

第一代 DeepSeek-Coder 是把代码语料单独做成训练主线,奠定「代码模型」这个独立品类。第二代 DeepSeek-Coder-V2 换成了专家混合架构,从更大的基础模型中间检查点继续预训练、追加了 6 万亿 token 的代码相关语料,官方给出的三项关键提升是:支持语言从 86 种扩展到 338 种,上下文长度从 16K 扩到 128K,参数量提供 16B 与 236B 两档(大档每 token 激活约 21B 参数)。权重以宽松许可发布,仓库核验时分别有约 2.43 万与 7,000 星标。

⚙️

当前接口的能力边界

官方接口文档把两个模型的规格列得很清楚:上下文长度 100 万 token,最大输出 384K token;默认开启思考模式,并可以按具体请求切换;JSON 输出、工具调用、两套主流协议格式、对话前缀续写(测试版)都支持;行内补全(FIM)功能只在非思考模式下可用。视觉输入是两者的分水岭——较便宜的 Flash 档可以读图,Pro 档不支持。并发上限按档位区分,Flash 档 2500、Pro 档 500。

🧠

Flash 档的架构:省在输入上

官方模型卡对 Flash 档的定位是「把 KV 缓存压缩推到极限」。它是一个多模态专家混合模型,主干 552B 参数,支持百万 token 上下文,用的是因果编码器加解码器的结构:40 层 Transformer 由 20 层因果编码器接 20 层解码器组成,解码器的全局 KV 缓存直接从编码器末层隐状态投影而来,而不是各自算各自的。这样做的结果是:预填充阶段每 token 只激活 8B 参数,解码阶段激活 16B。对输入远大于输出的编程与代理类负载,这正是成本大头所在。

🏆

Pro 档:偏向代理与真实工程

Pro 档官方说明是在预览版结构上加了推测解码模块,重点提升代理能力,并称在生产环境中的改善尤其明显。官方对比表里给出的几个数字值得记:终端任务基准 2.1 拿到 87.9 分,自然语言到仓库的基准 NL2Repo 为 61.5,网络安全对抗基准 Cybergym 为 83.3,综合知识基准 Humanity's Last Exam 在无工具与带工具两种口径下分别为 42.7 与 60.0。表中同时列出了若干闭源与开源的前沿模型作参照,具体型号此处不逐一列出。

💻

接进编程助手与工具链

官方文档单列了一节「接入代理工具」,说明主流 AI 编程助手可以直接把它的接口当后端模型用,不需要改代码——对已经有编程助手但想换模型的人来说,这通常只需要改一个服务地址和密钥。另外官方还提供面向代理框架开发者的预览版工具链,供做自动化编程流水线的人使用。接口侧配套能力包括上下文缓存(命中缓存的输入单价大幅降低)、文件接口与调用限流说明,方便把成本与并发都算清楚。

🖼

视觉输入与输入方式

Flash 档可以同时接收图片与文字,因此能用来描述图片、从截图里读文字、分析图表。官方支持 JPEG、PNG、GIF 与 WebP 四种格式,并特别说明格式是按文件实际内容判断的,不看文件名也不看声明的类型。提供图片有三种方式:把图片编码后内联进请求、给出图片地址、或通过文件接口传入;官方提示请求体上限为 48 MB,内联图片的编码数据也算在内。

💳

计费:按 token 分档且错峰半价

计费口径是按输入的百万 token 与输出的百万 token 分别计价,并且命中缓存的输入有单独的、低得多的价格。官方价格页给出的当前数字是:Flash 档命中缓存的输入在错峰时段每百万 token 0.003 美元、高峰 0.006 美元;未命中的输入错峰 0.15 美元、高峰 0.30 美元;输出错峰 0.60 美元、高峰 1.20 美元。Pro 档的三项分别是 0.022 与 0.044、0.66 与 1.32、1.98 与 3.96 美元。错峰价正好是高峰价的一半;高峰时段为协调世界时周一至周五的 01:00 到 04:00 与 06:00 到 10:00,不含中国法定节假日,其余时间均为错峰。

产品特点

核心功能与独有价值

01

两代开源代码模型可自己部署

第一代与第二代码模型的权重都以宽松许可发布,第二代还提供 16B 与 236B 两档参数、支持 338 种编程语言与 128K 上下文。对数据不能出内网、或想把推理成本固定的团队,这条路比按量付费更容易算账。

02

百万上下文配两种协议格式

当前接口的上下文长度为 100 万 token、最大输出 384K token,足以把整个中等规模仓库连同文档一起放进去;同时提供两套主流协议格式的接入地址,已有编程助手往往只改服务地址和密钥就能切换过来。

03

错峰半价让批处理更划算

高峰时段只覆盖协调世界时工作日早间的两个窗口,其余时间一律按半价计费;把批量重构、代码扫描这类不赶时间的任务排到错峰时段,等于直接省掉一半的 token 费用,再叠加缓存命中的更低输入单价。

04

补全与代理两种用法都有对应档位

行内补全(FIM)在非思考模式下可用,适合编辑器里的即时生成;代理类任务则更适合响应更快、输入更便宜的 Flash 档,或能力更强的 Pro 档。同一套接口按任务挑档位,不必为补全这种高频低价值调用付贵价钱。

最近动态

重要更新

九月:Flash 档更新到 V4.1

官方权重页在九月十日放出 Flash 档的新版本,定位是「把 KV 缓存压缩推到极限」:因果编码器加解码器结构、主干 552B 参数、百万 token 上下文,预填充阶段每 token 只激活 8B 参数、解码阶段 16B,并配套发布技术报告。接口文档同步把模型名统一成简短写法,同时说明旧的两个模型名仍然可用,但对应模型已退役,请求会由最新 Flash 档承接并按 Flash 档计价。

八月:Pro 档正式版强调代理能力

八月十三日发布的 Pro 档正式版取代了此前的预览版,结构上沿用预览版并加了推测解码模块。官方称这次更新「大幅增强代理能力」,在生产环境中的提升尤其明显,并在对比表里列出了终端任务、仓库生成、网络安全对抗等基准上的分数;官方同时表示该版本与当前最强的闭源模型相比整体处于同一竞争区间。

四月:V4 系列两档同时上线

四月下旬官方一次性放出 V4 系列的两个档位及其基础版本:面向高并发的 Flash 档与面向复杂任务的 Pro 档。这次发布确立了当前的双档格局——同一个接口、同一套能力矩阵,按任务复杂度与预算在快而便宜与强而较贵之间选择,价格页上的两列数字也从这时开始并列展示。

产品总结

DeepSeek Coder 是深度求索的代码模型线,理解它要分成两段。前一段是开放权重的代码模型:第一代把代码语料做成独立训练主线,第二代换成专家混合架构,从更大的基础模型中间检查点继续预训练并追加 6 万亿 token 代码相关语料,官方给出的关键提升是支持语言从 86 种扩到 338 种、上下文从 16K 扩到 128K、参数量提供 16B 与 236B 两档(大档每 token 激活约 21B),权重以宽松许可发布,两个仓库核验时分别约 2.43 万与 7,000 星标。后一段是现在:编程场景主要由接口承担。 官方接口文档里当前可用的模型名只有两个。规格上,上下文长度 100 万 token、最大输出 384K token,默认开启思考模式并可按请求切换,支持 JSON 输出、工具调用、两套主流协议格式与对话前缀续写(测试版);行内补全只在非思考模式下可用;较便宜的 Flash 档可以读图,Pro 档不支持;并发上限分别为 2500 与 500。Flash 档的官方定位是「把 KV 缓存压缩推到极限」:多模态专家混合模型、主干 552B 参数、40 层 Transformer 由 20 层因果编码器接 20 层解码器,解码器的全局 KV 缓存直接从编码器末层隐状态投影而来,因而预填充阶段每 token 只激活 8B 参数、解码阶段 16B。Pro 档正式版在预览版结构上加了推测解码模块,官方称大幅增强代理能力、生产环境提升尤其明显,对比表给出的终端任务基准 2.1 为 87.9 分、NL2Repo 为 61.5、Cybergym 为 83.3、综合知识基准在无工具与带工具口径下为 42.7 与 60.0。 视觉输入方面,Flash 档支持 JPEG、PNG、GIF 与 WebP,格式按文件实际内容判断,提供图片可内联编码、给地址或走文件接口三种方式,请求体上限 48 MB。工程侧还有上下文缓存、文件接口与限流说明;官方文档单列了「接入代理工具」一节,说明主流编程助手可以直接把它当后端模型,通常只需改服务地址与密钥,另有面向代理框架开发者的预览版工具链。计费按输入与输出的百万 token 分别计价,命中缓存的输入另有低价:Flash 档命中缓存输入错峰 0.003、高峰 0.006 美元,未命中输入错峰 0.15、高峰 0.30 美元,输出错峰 0.60、高峰 1.20 美元;Pro 档三项分别为 0.022 与 0.044、0.66 与 1.32、1.98 与 3.96 美元。错峰价是高峰价的一半,高峰时段为协调世界时工作日 01:00 至 04:00 与 06:00 至 10:00,不含中国法定节假日。

产品类型
编程大模型与代码模型 API
支持平台
开放权重(Hugging Face) / 云端接口(两种主流协议格式) / 网页对话与开放平台控制台 / 第三方编程助手后端模型 / 本地部署(开源社区推理方案)
资费模式
Flash 输入每百万 token 0.15 美元起、输出 0.6 美元起;Pro 输入 0.66 美元起、输出 1.98 美元起,错峰半价。

核验信息

参考文章与数据来源

本页事实来自官方渠道:官网与开放平台、接口文档的模型与价格页(两个模型名与规格、100 万上下文与 384K 最大输出、思考模式与工具调用与两套协议格式与对话前缀续写、行内补全限制、并发上限、分档 token 单价与错峰时段规则)、视觉输入说明(支持格式与判断方式、三种传图方式与请求体上限)、思考模式说明、第一代与第二代码模型的官方仓库(专家混合架构与继续预训练规模、支持语言与上下文与参数档位、许可与星标数),以及 Flash 与 Pro 两档的官方模型卡(多模态专家混合与因果编码器解码器结构与激活参数量、推测解码与代理能力提升、终端任务与仓库生成与网络安全与综合知识基准分数)。页内未列出官方对比表中出现的第三方模型名称。价格与状态核验于 2026 年 9 月 22 日。

  1. 官网DeepSeek 官网
  2. 其他开放平台控制台
  3. 官方文档接口文档首页
  4. 官方文档模型与价格
  5. 官方文档思考模式说明
  6. 其他DeepSeek-Coder 开源仓库
  7. 其他DeepSeek-Coder-V2 开源仓库
  8. 其他官方权重组织页(Hugging Face)

用户体验调查

DeepSeek Coder介绍页面对您是否有帮助?