6
里程碑
22
重要更新
6
常规动态
DeepSeek 实施周末低谷价及明确余额扣费规则
DeepSeek 调整计费规则,自 2026 年 8 月 23 日起实施周末(周六、周日北京时间)全天低谷价格,鼓励开发者在周末进行大规模批量推理等任务以平滑算力需求。同时明确扣费规则,费用将优先从赠送余额中扣除,充值余额保留,降低用户对资金锁定的顾虑。
DeepSeek API 引入峰谷计费模式,价格大幅调整
DeepSeek 宣布 API 服务改为峰谷计费机制,非高峰时段价格为高峰时段的一半。高峰时段为 UTC 01:00-04:00 和 06:00-10:00,新价格于 2026 年 8 月 16 日生效。以 deepseek-v4-flash 为例,谷时输入 $0.22/M、输出 $0.66/M;峰时输入 $0.44/M、输出 $1.32/M,峰时价格涨幅显著。
DeepSeek V4 系列模型规格与 API 兼容性说明
DeepSeek 官方定价页面详细公布了 V4 系列模型的规格与功能特性。上下文窗口统一扩展至 1M tokens,最大输出提升至 384K;新增 FIM(Fill-in-the-Middle)补全和 Chat Prefix Completion Beta 功能,增强代码助手场景竞争力;同时支持 Anthropic API 格式调用及 Tool Calls,大幅降低从 Claude 生态迁移的切换成本。
DeepSeek V4 系列模型升级、支持 Responses API 及并发限制调整
DeepSeek 对 V4 系列模型进行多项重要更新:DeepSeek-V4-Pro 模型版本升级至 0813 版,完成新一轮迭代升级;V4-Pro 新增支持 Responses API,使开发者可在更强模型上构建复杂的 Agent 应用;此外,官方重新标注了 V4-Flash 和 V4-Pro 的并发限制数据,V4-Flash 保持 2500,V4-Pro 保持 500,并移除了 Responses API 相关的旧脚注。这一系列更新提升了模型推理基线,并进一步完善了 Agent 开发生态。
DeepSeek V4-Pro 和 V4-Flash 新增三级思考力度控制
DeepSeek V4-Pro 和 V4-Flash 模型现支持 low、high、max 三级思考力度控制,允许用户根据任务复杂度灵活选择推理深度,以平衡响应速度与思考质量。
DeepSeek 发布实验性多模态视觉模型 V4-Flash-Vision-Exp
DeepSeek 推出实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,已通过 API 平台开放。该模型在纯文本能力上与 DeepSeek-V4-Flash 持平,但在视觉理解的 Agent 基准测试中显著提升,多模态 Agent 能力接近 Opus-4.8。这是 DeepSeek 首次在 V4 系列中引入多模态视觉能力,以实验性形式发布旨在快速收集反馈。具体定价、速率限制及正式版发布时间尚未明确。
DeepSeek 推出 Harness 开发者预览版
DeepSeek 推出 DeepSeek Harness 的开发者预览版(developer preview),面向全球的 agent harness 开发者。该产品旨在帮助开发者更好地将 DeepSeek 模型整合到 Agent 框架中,标志着 DeepSeek 正在构建自己的 Agent 中间件/框架层,从纯模型提供商向 Agent 平台方向演进。
DeepSeek 推出 Agent 工具集成指南
DeepSeek API 文档新增“Integrate with Agent Tools”章节,提供 Agent 工具集成指南。开发者可将 DeepSeek 作为后端模型直接接入 Claude Code、GitHub Copilot、OpenCode 等流行的 AI Agent 和编程助手工具,无需编写代码。此举降低了开发者将 DeepSeek 模型嵌入现有 AI 工具链的门槛,加速其在 Agent 和编程助手生态中的采用。
DeepSeek 移除公开定价页面
DeepSeek 官方 API 文档的定价页面(/quick_start/pricing)已被替换为“Your First API Call”快速入门指南。原页面上 deepseek-v4-flash 和 deepseek-v4-pro 的详细定价信息(包括峰谷价格、缓存命中/未命中价格、并发限制)不再在文档中公开展示。定价透明度的降低可能影响开发者选型决策,或预示其价格策略的调整。
DeepSeek-V3.1-Base 模型从 Hugging Face 列表中移除
DeepSeek 在 Hugging Face 平台上移除了 deepseek-ai/DeepSeek-V3.1-Base 模型仓库。该基础版本模型此前与 DeepSeek-V3.1 并列展示,主要面向研究者和二次开发者。目前该条目已从列表中消失,仅保留 DeepSeek-V3.1。此举可能意味着 DeepSeek 不再单独维护该基础分支,或将其合并到主模型中,对依赖该 Base 模型进行微调或研究的开发者有一定影响。
DeepSeek API 取消峰谷计费改为固定分层定价并上调价格
DeepSeek 于 2026 年 8 月 17 日调整了 V4 Flash 和 V4 Pro 的 API 定价策略。此前预告的按时段动态峰谷计费模式被取消,改为固定的 peak/off-peak 分层定价体系,其中 off-peak 价格为 peak 价格的一半。同时,新的 off-peak 价格相比旧版单一价格有显著上涨(如 Flash 输入缓存命中价格从 $0.0028 涨至 $0.007)。这一调整简化了定价结构,提高了开发者预算的可预测性,但也意味着整体 API 使用成本的上升。
DeepSeek 预告即将大幅上调 API 整体定价
DeepSeek 在定价页面声明计划近期大幅上调 API 服务整体定价,建议用户提前规划用量,具体方案以官方通知为准。此举将直接改变当前 API 市场的价格预期。
DeepSeek API 原生支持 OpenAI Responses API 格式
DeepSeek API 现在原生支持 OpenAI Responses API 格式,并专门适配了 Codex,提供一键配置脚本,大幅降低了开发者从 OpenAI 迁移至 DeepSeek 的成本。
DeepSeek-V4-Pro 正式发布,Agent 能力大幅增强
DeepSeek-V4-Pro 在 APP、Web 和 API 上正式 GA。该版本显著增强了 Agent 能力,在 Terminal Bench 2.1 (87.9)、DeepSWE (62.7) 和 DSBench-FullStack (71.1) 等多项 Agent 基准测试中表现出色。
DeepSeek V4 系列模型发布及多项核心能力升级
DeepSeek 正式上线 V4 系列模型,包括 DeepSeek-V4-Flash(轻量版)和 DeepSeek-V4-Pro(专业版)。两款模型均支持 1M 上下文、Tool Calls,并以 Beta 形式提供 FIM Completion(代码补全)和 Chat Prefix Completion 能力。此外,V4 系列原生支持 Anthropic API 格式,Flash 版新增 Responses API 支持(Pro 版计划 8 月跟进)以及 Thinking 思考模式以增强推理能力。此次发布全面对标主流代码与 Agent 开发范式。
DeepSeek-V4-Flash 公测及 Agent 能力大幅增强
DeepSeek-V4-Flash API 进入公测阶段,Agent 能力显著增强,多项基准测试远超 V4-Pro-Preview(如 Terminal Bench 2.1 达 82.7)。原生支持 Responses API 格式并专门适配 Codex,在 Agent 编码赛道持续发力。
DeepSeek 发布 dspark 与 dflash 系列蒸馏模型
DeepSeek 于 2026 年 6 月 28 日在 HuggingFace 一次性发布 8 个蒸馏/衍生模型,涵盖 dspark 与 dflash 两个系列,基座模型分别来自 Qwen3(4B/8B/14B)和 Gemma4(12B),每个系列均标注 block7。同日还发布了 DeepSeek-V4-Pro-DSpark 和 DeepSeek-V4-Flash-DSpark 两个文本生成模型。此次大规模发布基于第三方基座模型的蒸馏版本,表明 DeepSeek 在模型蒸馏技术和多架构生态适配上持续扩展,可能推动开源社区蒸馏模型的标准化进程。dspark/dflash 的具体含义、block7 技术细节、蒸馏方法以及性能基准均未披露。
DeepSeek-V4 发布及旧版 API 弃用公告
DeepSeek API 现支持 V4-Pro 和 V4-Flash 新一代旗舰模型,兼容 OpenAI 及 Anthropic 接口标准。旧模型名 deepseek-chat/reasoner 将于三个月后(2026-07-24)停用,强制推动 API 标准化迁移。
DeepSeek 发布 OCR-2 多模态识别模型
DeepSeek 发布 DeepSeek-OCR-2 多模态模型,作为 DeepSeek-OCR 的继任版本。这表明 DeepSeek 在 OCR 垂直方向持续战略投入,面向文档识别和图像文字提取场景。相比第一代的具体改进、精度基准及模型规模等核心信息尚未披露。
DeepSeek-V3.2-Speciale 临时端点上线
DeepSeek-V3.2-Speciale 通过临时端点提供服务,价格同 V3.2,不支持工具调用,有效期至 2025-12-15,为短期实验性端点且功能受限。
DeepSeek-V3.2 正式升级上线
deepseek-chat 和 deepseek-reasoner 均升级至 DeepSeek-V3.2,分别对应非思考和思考模式,推理基线全面提升,成为竞品主力模型的最新迭代版本。
DeepSeek 发布 Math-V2 数学推理模型
DeepSeek 发布 DeepSeek-Math-V2 文本生成模型,为数学推理专用模型的第二代版本。此举强化了 DeepSeek 在 STEM 推理领域的布局,面向教育、科研、工程等需要高精度数学推理的用户。相比第一代的性能提升、评测基准及模型规模尚未披露。
DeepSeek 发布首个 OCR 多模态模型
DeepSeek 发布 DeepSeek-OCR 多模态 OCR 模型,这是其在该领域的首个公开发布,拓展了多模态能力版图。该模型面向需要文档数字化和图像文字识别能力的开发者和企业用户,与智谱、阿里等厂商形成新竞争维度。模型架构、精度基准及支持语言等细节未披露。
DeepSeek-V3.2-Exp 实验版升级
deepseek-chat 和 deepseek-reasoner 升级至 DeepSeek-V3.2-Exp 实验版,为 V3.2 正式版做前期测试和验证。
DeepSeek-V3.1-Terminus 优化 Agent 与多语言体验
DeepSeek 升级至 V3.1-Terminus 版本,修复中英文混杂问题并优化 Code Agent 和 Search Agent 性能,针对 Agent 场景进行专项调优。
DeepSeek-V3.1 引入混合推理架构
DeepSeek-V3.1 引入混合推理架构,单模型同时支持思考/非思考模式,Agent 能力增强(SWE-bench Verified 66.0),推理效率显著提升,混合推理架构成为行业新标配。
deepseek-reasoner 升级至 R1-0528 支持 FC
deepseek-reasoner 升级至 R1-0528,基准显著提升(AIME 2025 达 87.5),减少幻觉,优化前端生成,新增 JSON 输出和 Function Calling 支持,补齐推理模型在 Agent 场景的关键能力。
deepseek-chat 升级至 V3-0324 版本
deepseek-chat 升级至 V3-0324,推理能力增强(MMLU-Pro 达 81.2),优化前端开发和中文写作能力,改进搜索能力和 Function Calling 准确性,提升 Agent 场景可用性。
DeepSeek-R1 推理模型首发
DeepSeek 发布 deepseek-reasoner 模型(DeepSeek-R1),通过 model='deepseek-reasoner' 调用。R1 是行业级推理模型里程碑,在数学、代码和科学推理等任务上表现突出。
DeepSeek-V3 首发上线
deepseek-chat 正式升级至 DeepSeek-V3,API 接口保持不变。V3 是 DeepSeek 当前生态的基石模型,标志着其在通用大模型领域的重大跃升。
deepseek-chat 升级至 V2.5-1210 版本
deepseek-chat 升级至 V2.5-1210 版本,数学和编码基准有所提升,同时优化了文件上传和网页摘要的用户体验。
DeepSeek V2.5 模型合并发布
DeepSeek 将 V2 Chat 与 Coder V2 合并为 V2.5 统一模型,通用能力和代码能力全面提升,指令遵循和对齐效果优化。
DeepSeek API 上线磁盘上下文缓存技术大幅降价
DeepSeek API 采用硬盘缓存技术实现上下文缓存,将长文本处理成本降低一个数量级,为长文本 Agent 场景提供极具竞争力的价格优势。
DeepSeek API 新增 JSON Mode、Function Calling 及 FIM 特性
DeepSeek API 新增 JSON Mode、Function Calling、Chat Prefix Completion(Beta)、8K max_tokens(Beta)及 FIM Completion(Beta)等多项能力,补齐 Agent 与 Coding 场景所需的基础 API 特性。