6
里程碑
22
重要更新
6
常规动态
DeepSeek 实施周末低谷价及明确余额扣费规则
DeepSeek 调整计费规则,自 2026 年 8 月 23 日起实施周末(周六、周日北京时间)全天低谷价格,鼓励开发者在周末进行大规模批量推理等任务以平滑算力需求。同时明确扣费规则,费用将优先从赠送余额中扣除,充值余额保留,降低用户对资金锁定的顾虑。
DeepSeek API 引入峰谷计费模式,价格大幅调整
DeepSeek 宣布 API 服务改为峰谷计费机制,非高峰时段价格为高峰时段的一半。高峰时段为 UTC 01:00-04:00 和 06:00-10:00,新价格于 2026 年 8 月 16 日生效。以 deepseek-v4-flash 为例,谷时输入 $0.22/M、输出 $0.66/M;峰时输入 $0.44/M、输出 $1.32/M,峰时价格涨幅显著。
DeepSeek V4 系列模型规格与 API 兼容性说明
DeepSeek 官方定价页面详细公布了 V4 系列模型的规格与功能特性。上下文窗口统一扩展至 1M tokens,最大输出提升至 384K;新增 FIM(Fill-in-the-Middle)补全和 Chat Prefix Completion Beta 功能,增强代码助手场景竞争力;同时支持 Anthropic API 格式调用及 Tool Calls,大幅降低从 Claude 生态迁移的切换成本。
DeepSeek V4 系列模型升级、支持 Responses API 及并发限制调整
DeepSeek 对 V4 系列模型进行多项重要更新:DeepSeek-V4-Pro 模型版本升级至 0813 版,完成新一轮迭代升级;V4-Pro 新增支持 Responses API,使开发者可在更强模型上构建复杂的 Agent 应用;此外,官方重新标注了 V4-Flash 和 V4-Pro 的并发限制数据,V4-Flash 保持 2500,V4-Pro 保持 500,并移除了 Responses API 相关的旧脚注。这一系列更新提升了模型推理基线,并进一步完善了 Agent 开发生态。
DeepSeek V4-Pro 和 V4-Flash 新增三级思考力度控制
DeepSeek V4-Pro 和 V4-Flash 模型现支持 low、high、max 三级思考力度控制,允许用户根据任务复杂度灵活选择推理深度,以平衡响应速度与思考质量。
DeepSeek 发布实验性多模态视觉模型 V4-Flash-Vision-Exp
DeepSeek 推出实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,已通过 API 平台开放。该模型在纯文本能力上与 DeepSeek-V4-Flash 持平,但在视觉理解的 Agent 基准测试中显著提升,多模态 Agent 能力接近 Opus-4.8。这是 DeepSeek 首次在 V4 系列中引入多模态视觉能力,以实验性形式发布旨在快速收集反馈。具体定价、速率限制及正式版发布时间尚未明确。
DeepSeek 推出 Harness 开发者预览版
DeepSeek 推出 DeepSeek Harness 的开发者预览版(developer preview),面向全球的 agent harness 开发者。该产品旨在帮助开发者更好地将 DeepSeek 模型整合到 Agent 框架中,标志着 DeepSeek 正在构建自己的 Agent 中间件/框架层,从纯模型提供商向 Agent 平台方向演进。
DeepSeek 推出 Agent 工具集成指南
DeepSeek API 文档新增“Integrate with Agent Tools”章节,提供 Agent 工具集成指南。开发者可将 DeepSeek 作为后端模型直接接入 Claude Code、GitHub Copilot、OpenCode 等流行的 AI Agent 和编程助手工具,无需编写代码。此举降低了开发者将 DeepSeek 模型嵌入现有 AI 工具链的门槛,加速其在 Agent 和编程助手生态中的采用。
DeepSeek 移除公开定价页面
DeepSeek 官方 API 文档的定价页面(/quick_start/pricing)已被替换为“Your First API Call”快速入门指南。原页面上 deepseek-v4-flash 和 deepseek-v4-pro 的详细定价信息(包括峰谷价格、缓存命中/未命中价格、并发限制)不再在文档中公开展示。定价透明度的降低可能影响开发者选型决策,或预示其价格策略的调整。
DeepSeek-V3.1-Base 模型从 Hugging Face 列表中移除
DeepSeek 在 Hugging Face 平台上移除了 deepseek-ai/DeepSeek-V3.1-Base 模型仓库。该基础版本模型此前与 DeepSeek-V3.1 并列展示,主要面向研究者和二次开发者。目前该条目已从列表中消失,仅保留 DeepSeek-V3.1。此举可能意味着 DeepSeek 不再单独维护该基础分支,或将其合并到主模型中,对依赖该 Base 模型进行微调或研究的开发者有一定影响。
DeepSeek API 取消峰谷计费改为固定分层定价并上调价格
DeepSeek 于 2026 年 8 月 17 日调整了 V4 Flash 和 V4 Pro 的 API 定价策略。此前预告的按时段动态峰谷计费模式被取消,改为固定的 peak/off-peak 分层定价体系,其中 off-peak 价格为 peak 价格的一半。同时,新的 off-peak 价格相比旧版单一价格有显著上涨(如 Flash 输入缓存命中价格从 $0.0028 涨至 $0.007)。这一调整简化了定价结构,提高了开发者预算的可预测性,但也意味着整体 API 使用成本的上升。
DeepSeek 预告即将大幅上调 API 整体定价
DeepSeek 在定价页面声明计划近期大幅上调 API 服务整体定价,建议用户提前规划用量,具体方案以官方通知为准。此举将直接改变当前 API 市场的价格预期。
DeepSeek API 原生支持 OpenAI Responses API 格式
DeepSeek API 现在原生支持 OpenAI Responses API 格式,并专门适配了 Codex,提供一键配置脚本,大幅降低了开发者从 OpenAI 迁移至 DeepSeek 的成本。
DeepSeek-V4-Pro 正式发布,Agent 能力大幅增强
DeepSeek-V4-Pro 在 APP、Web 和 API 上正式 GA。该版本显著增强了 Agent 能力,在 Terminal Bench 2.1 (87.9)、DeepSWE (62.7) 和 DSBench-FullStack (71.1) 等多项 Agent 基准测试中表现出色。
DeepSeek V4 系列模型发布及多项核心能力升级
DeepSeek 正式上线 V4 系列模型,包括 DeepSeek-V4-Flash(轻量版)和 DeepSeek-V4-Pro(专业版)。两款模型均支持 1M 上下文、Tool Calls,并以 Beta 形式提供 FIM Completion(代码补全)和 Chat Prefix Completion 能力。此外,V4 系列原生支持 Anthropic API 格式,Flash 版新增 Responses API 支持(Pro 版计划 8 月跟进)以及 Thinking 思考模式以增强推理能力。此次发布全面对标主流代码与 Agent 开发范式。
DeepSeek-V4-Flash 公测及 Agent 能力大幅增强
DeepSeek-V4-Flash API 进入公测阶段,Agent 能力显著增强,多项基准测试远超 V4-Pro-Preview(如 Terminal Bench 2.1 达 82.7)。原生支持 Responses API 格式并专门适配 Codex,在 Agent 编码赛道持续发力。
DeepSeek 发布 dspark 与 dflash 系列蒸馏模型
DeepSeek 于 2026 年 6 月 28 日在 HuggingFace 一次性发布 8 个蒸馏/衍生模型,涵盖 dspark 与 dflash 两个系列,基座模型分别来自 Qwen3(4B/8B/14B)和 Gemma4(12B),每个系列均标注 block7。同日还发布了 DeepSeek-V4-Pro-DSpark 和 DeepSeek-V4-Flash-DSpark 两个文本生成模型。此次大规模发布基于第三方基座模型的蒸馏版本,表明 DeepSeek 在模型蒸馏技术和多架构生态适配上持续扩展,可能推动开源社区蒸馏模型的标准化进程。dspark/dflash 的具体含义、block7 技术细节、蒸馏方法以及性能基准均未披露。