2026-08-28 AI 行业竞争情报管理层简报
执行摘要
本日情报核心聚焦多模态视频生成的 API 商业化定价、AI Agent 基础设施的资源级模块化计费,以及平台 API 范式向统一交互协议收敛。Google 与火山方舟在视频生成与多模态能力上推进 API 落地与价格调整,Vertex AI 确立了基于 vCPU 和内存的 Agent 运行环境计费标准,反映出行业正从技术预览转向可预测成本的生产就绪阶段。
关键变化
- 视频与多模态 API 商业化:Google 正式发布 gemini-omni-1.1-flash GA 版本,支持视频扩展与最高 4K 输出。输入定价 $1.50/百万 Token,视频输出 $17.50/百万 Token(约 $0.10/秒 720p),预览版端点将于 2026 年 9 月 30 日弃用。火山方舟在产品简介页新增视觉定位、3D 生成、MCP 云部署及 GUI Agent 入口,快速入门代码更新至 doubao-seed-2-1-pro-260628 模型并引入 Responses API。
- Agent 基础设施资源计量:Vertex AI Agent Platform 确立按资源消耗计费模式,Compute 定价 $0.085/vCPU-h,Memory 定价 $0.009/GiB-h,包含每月 50 小时 Compute 免费额度。Agent Gateway、Memory Bank、Sessions 及 Skill Registry 等核心组件明确了具体计费生效日期。
- 模型定价调整与分发:火山方舟将 deepseek-v4-pro 和 deepseek-v4-flash 预览版价格上调(Pro 输入 9 元/输出 27 元,Flash 输入 3 元/输出 9 元/百万 Token),正式版与调价后的预览版价格对齐,标志预览期优惠结束。Z.ai 的 GLM 5.2 模型(支持 100 万 Token 上下文)以 MaaS 形式在 Vertex AI Model Garden 上线公开预览。
用户与市场影响
- 内容创作者与开发者:Gemini Omni Flash 的 GA 级 SLA 保障与 4K 输出,结合火山方舟新增的 3D 生成和视觉定位能力,为游戏、影视和电商行业提供了新的资产制作选项。开发者需对比基于 Token 的视频生成成本与现有专业工具链的性价比。
- 企业 Agent 架构师:Vertex AI 将 Agent 运行环境拆解为独立计费单元,要求开发者重新核算长时运行、有状态 Agent 的总拥有成本,特别是 Memory Bank 和 Gateway 的隐性开销。火山方舟引入的 MCP 和 GUI Agent 能力为构建跨系统自动化和垂直领域集成提供了底层支持。
- 教育市场:OpenAI 将 ChatGPT for Teachers 扩展至 55 个美国学区,覆盖超 10 万名教育工作者,并发布了 AI 辅助学习实证研究,这将加速 AI 工具在基础教育系统的规范化采购与部署。
证据与不确定性
- 证据:Google AI Changelog 与 Vertex AI 定价页面证实了 Gemini Omni Flash 的 GA 状态、功能列表及 Agent 组件单价;火山方舟官方文档与定价 Diff 记录了新增能力入口、Responses API 代码示例及 DeepSeek V4 系列价格调整;OpenAI 官方博客证实了教育版扩展范围。
- 不确定性:Gemini Omni Flash 视频扩展的最长时长、4K 上采样实际质量及 API 速率限制未披露;Vertex AI 未说明 15,000 请求/vCPU-h 的 Gateway 换算基准是否随模型复杂度动态调整;火山方舟新增的视觉定位、3D 生成、MCP 和 GUI Agent 入口目前仅有简要描述,底层模型名称、API 格式、精度基准及具体计费方式数据不足,尚未公开;DeepSeek V4 预览版与正式版并存且价格相同的后续下线计划尚不明确。