2026-08-23 周报 AI 行业竞争情报
执行摘要
本周 AI 行业竞争焦点集中在长上下文旗舰模型发布、多协议生态兼容以及定价策略的精细化调整。智谱发布 GLM-5.3 与 GLM-5V-Turbo,DeepSeek 升级 V4 系列至 1M 上下文并兼容 Anthropic 协议,MiniMax 推出 M3 与 H3 全模态模型。阿里百炼在全球五个区域大规模上线第三方模型与全模态矩阵。OpenAI 对 GPT-5.6 Sol 实施限时降价,并扩展欧洲广告业务。平台级竞争正从单一模型能力比拼,转向 Agent 工具链集成、双协议栈兼容与分层定价体系的综合较量。
关键事件
- 智谱 BigModel:发布 GLM-5.3 旗舰模型(1M 上下文,编程能力提升 50%,强制启用思考模式)与 GLM-5V-Turbo 多模态 Agent 基座模型。GLM-5.3 API 正式上线,支持 OpenAI 与 Anthropic 双协议。推出独立计费的搜索工具服务,旗舰模型区全线限时免费,Coding Plan 采用非高峰时段半价积分制。
- 阿里百炼(DashScope):上线 qwen3.5-omni-plus 全模态模型及 Qwen3.8-2.4T-A95B 超大 MoE 开源模型。在全球五个区域部署 DeepSeek V4、Kimi K3、智谱 GLM-5.2/5.3、MiniMax M3 等第三方模型,并补齐语音、视频(HappyHorse)与 3D 生成(Tripo)能力矩阵。
- DeepSeek Platform:V4 系列上下文扩展至 1M tokens,最大输出 384K,新增 Anthropic API 格式、Responses API、FIM 补全及思考模式支持。发布 DeepSeek Harness 开发者预览版及 Agent 工具集成指南。定价策略取消按时段峰谷计费,改为 peak/off-peak 固定分层定价。
- MiniMax Platform:发布 M3 模型(1M 上下文,MSA 稀疏注意力架构,原生多模态)与 H3 全模态生成模型(支持 2K 音视频生成)。推出开放权重的 Music 3.0 音乐生成模型。
- OpenAI Platform:GPT-5.6 Sol 全模式降价约 20%(促销至 2026 年 11 月)。API 新增按请求级别的区域处理选择,发布 Prompt Caching 仪表盘。ChatGPT 广告业务扩展至欧洲 31 个市场,推出 ChatGPT for Teens。
- Microsoft Azure AI Foundry:为托管的 Claude 模型新增结构化输出、网络搜索、MCP 连接器等五项 Agent 能力,强化生产级智能体平台定位。
主要趋势
- 国产大模型全面兼容 OpenAI 与 Anthropic 双协议栈,降低生态迁移门槛 智谱 GLM-5.3 API 同时支持 OpenAI Chat/Response 和 Anthropic Message 协议;DeepSeek V4 系列新增 Anthropic API 格式与 Responses API 支持;阿里百炼全球部署的 Qwen 及第三方模型均提供 OpenAI、Anthropic 和原生三种 API 模式。这表明中国头部模型厂商正通过全面兼容主流闭源生态的接口标准,直接降低开发者从 Claude 或 GPT 迁移的切换成本,加速对现有闭源生态的替代。
- 1M+ 长上下文与原生多模态成为新一代旗舰模型标配 智谱 GLM-5.3、DeepSeek V4 系列、MiniMax M3 均将上下文窗口扩展至 1M tokens,DeepSeek 最大输出达 384K。同时,阿里 qwen3.5-omni-plus、MiniMax H3、智谱 GLM-5V-Turbo 均定位为全模态或多模态 Agent 基座。长文本处理与跨模态统一理解已从差异化卖点转变为旗舰模型的基础能力标准。
- API 定价策略从“绝对低价”向“精细化、分层化与促销化”演进 DeepSeek 放弃了此前预告的按时段动态峰谷计费,改为 peak/off-peak 固定分层定价体系,且 off-peak 价格较历史单一低价有所上涨;智谱推出搜索工具独立计费、Coding Plan 非高峰半价及旗舰模型限时免费;OpenAI 对 GPT-5.6 Sol 降价 20% 但明确标注为限时促销。厂商正通过更复杂的定价结构平衡算力成本与用户留存,单纯的绝对低价策略正在减少。
- 模型平台向“Agent 运行时与工具链枢纽”演进 DeepSeek 发布 Harness 开发者预览版并提供 Claude Code、GitHub Copilot 等工具的免代码集成指南;Azure Foundry 为 Claude 模型增加 MCP 连接器和工具搜索等五项 Agent 能力;智谱将搜索工具作为独立 SKU 售卖并推出 AutoGLM 智能体模型。平台竞争正从提供单一模型端点,转向提供包含中间件、工具链和外部服务集成的完整 Agent 运行环境。
用户与市场影响
- 开发者与企业 IT 团队:双协议栈兼容和 Agent 工具链集成(如 DeepSeek Harness、Azure MCP 连接器)大幅降低了系统重构和迁移成本。1M 上下文和 FIM 补全等功能直接提升了大规模代码库理解和 IDE 插件开发的效率。但 DeepSeek 和智谱的定价结构调整要求开发者重新评估 API 调用成本与调度策略。
- 内容创作者与设计行业:MiniMax H3 的 2K 音视频生成、阿里百炼的 HappyHorse 视频与 Tripo 3D 生成、以及 OpenAI gpt-image-2 的透明背景支持,为多媒体制作、电商和 UI 设计提供了一站式 API 工作流,减少了跨工具拼接和后处理的时间。
- 安全与合规决策者:OpenAI 新增按请求级别的区域处理选择,Azure 语义治理策略新增内置监控指标,智谱 GLM-5.3 在网络安全基准(CyberGym)上展现涌现能力并发现真实漏洞。这些进展为金融、医疗等受监管行业采用大模型提供了更细粒度的数据驻留控制和可量化的安全治理手段。
证据与不确定性
- 证据:模型发布与能力参数来自各厂商官方定价页、API 文档、Changelog 及 HuggingFace 模型元数据(如 Qwen3.8-2.4T-A95B、Kimi-K3 的创建记录)。定价调整与促销信息直接提取自 OpenAI 和 DeepSeek 的官方定价页面 Diff 记录。
- 不确定性:
- DeepSeek V4 系列、Kimi K3、Qwen3.8-2.4T-A95B 等模型的具体性能基准得分、训练数据截止日期及开源许可协议尚未披露。
- DeepSeek 定价从单一低价转为固定分层定价的具体原因(如算力成本压力或需求调控)未公开说明,且 peak/off-peak 标签是否仍与特定时间绑定存在文档表述上的模糊。
- 智谱旗舰模型“限时免费”的具体截止日期、额度限制,以及 DeepSeek Harness 预览版的正式 GA 时间均未明确。
- 阿里百炼上线的部分第三方模型(如 Tripo、HappyHorse)的具体生成质量、延迟指标及跨区域可用性计划缺失。
数据来源
- 智谱 BigModel 官方定价页与 API 文档 (bigmodel.cn, docs.bigmodel.cn)
- 阿里百炼(DashScope)官方更新日志与帮助文档 (help.aliyun.com)
- DeepSeek Platform 官方 API 文档与定价页 (api-docs.deepseek.com)
- MiniMax Platform 官方博客 (minimaxi.com)
- OpenAI Platform 开发者 Changelog、定价页与官方新闻 RSS (developers.openai.com, openai.com)
- Gemini Enterprise Agent Platform 官方发布说明 (docs.cloud.google.com)
- Microsoft Azure AI Foundry 官方博客 (devblogs.microsoft.com)
- HuggingFace 模型 API 元数据 (huggingface.co)
本期采集口径:窗口内另有 81 条记录属于此前已报告过的事件(来源页会持续包含同一条目,因此会被反复采集到),未在本期重复展示。