3
里程碑
19
重要更新
10
常规动态
Google Gemini 定价页面元数据日期戳更新
Gemini 官方定价页面 (ai.google.dev/pricing) 的「最后更新」日期从 2026-08-27 UTC 变更为 2026-08-28 UTC。除了日期戳的刷新之外,页面 diff 中未检测到任何关于定价、模型版本或速率限制的可见变化。
Google 发布 Gemini Omni 1.1 Flash 正式版并公布定价,同时宣布弃用预览版
Google DeepMind 正式推出 Gemini Omni 1.1 Flash(gemini-omni-1.1-flash),为开发者提供更强的构建控制能力,并在 API 付费层正式商用。输入价格为每百万 token 1.50 美元,文本输出 9.00 美元,视频输出 17.50 美元,无免费额度。同时,官方宣布现有的 gemini-omni-flash-preview 端点将于 2026 年 9 月 30 日弃用,要求用户迁移至新版。
Gemini Omni Flash Preview 描述更新并移除付费限制说明
Gemini Omni Flash Preview 的描述从“available to developers on the paid tier”改为仅保留“OUR next-generation video generation and editing model”,移除了付费层级限制的说明。这可能意味着该模型免费层可用性有所变化,但实际限制需验证。
Gemini 多款模型描述由最高级营销语言改为中性描述
Google 对多个 Gemini 模型的描述进行了调整,将“最智能”、“世界最佳”等最高级营销语言改为中性描述(如“A Flash model built for speed”)。这反映了 Google 在 AI 模型营销上的合规考量,对实际产品能力无影响,但可能暗示部分预览模型已趋于稳定。
Google Gemini 定价页面移除多款旧版及预览模型
Google Gemini 定价页面移除了多款旧版及预览模型的定价条目,包括 Veo 2、Veo 3(Standard/Fast)、Imagen 4(Fast/Standard/Ultra)以及 Gemini 2.5 Flash-Lite Preview。这表明 Google 正在清理旧版视频与图像生成模型(如统一至 Veo 3.1),并进行正常的预览版模型生命周期管理。使用旧版 API 的开发者需迁移至新版或替代方案。
Google 正式发布 Gemini 3.5 Transcribe 语音转文字模型
Google 正式发布两款基于 Gemini 音频理解的专用语音转文字模型:Gemini 3.5 Transcribe 和 Gemini 3.5 Transcribe Live。支持 85+ 语言的语句级语言检测、说话人分离、词级时间戳和自定义词汇偏置。流式转录 Live API 进一步瞄准实时会议、客服等场景,标志着 Gemini 正式进入语音转文字市场,与 Whisper 等专业 ASR 服务竞争。
Gemini API 文档移除 Semantic Retriever 功能
Google 在 2026年8月24日的 Gemini API 文档更新中移除了此前列为 Beta 功能的 Semantic Retriever。该变更可能意味着该功能已被取消、合并到其他能力中,或不再作为独立功能提供。对依赖该功能的开发者有一定影响,但整体市场影响较小。
Gemini 3.5 Flash 上线 Computer Use 工具公开预览
Google 在 Gemini 3.5 Flash 上发布 Computer Use 工具公开预览,支持简化意图操作,内置浏览器、移动端和桌面环境支持,并提供可配置安全策略和高级提示注入检测功能。该功能使开发者可直接在 Gemini API 中实现自动化 UI 操作,无需额外搭建基础设施。Computer Use 已成为 AI Agent 平台的关键差异化能力,Google 此举与 Anthropic Computer Use、OpenAI Operator 等形成直接竞争,降低了企业自动化和 RPA 场景的使用门槛。但具体延迟、成功率基准及正式 GA 时间尚未披露。
Gemini Omni Flash 视频生成预览发布及 Flash Lite Image GA
Google 发布 gemini-omni-flash-preview 高性能多模态模型,支持高速视频生成和对话式视频编辑。通过 Interactions API,用户可从文本描述生成 3-10 秒 720p 视频或动画化静态图像,并支持对话式编辑和优化。同时 gemini-3.1-flash-lite-image(Nano Banana 2 Lite)正式 GA,定位超低延迟经济型图像生成与编辑。Omni Flash 标志着 Google 以新模型进入视频生成赛道,与 Sora、Veo、Kling 等竞品形成直接竞争,对话式编辑能力是差异化亮点,可能推动视频生成从单次生成向交互式工作流演进。具体延迟、定价及与 Veo 产品线的定位关系尚未明确。
AI Studio 控制台上线 Interactions API 开发者日志
Google AI Studio 控制台现已支持查看 Interactions API 调用的开发者日志。该功能改善了开发者调试体验,使用 Interactions API 的开发者可直接在 AI Studio 中查看调用日志,提升调试效率。此更新属于平台开发者体验(DX)能力的常规增强,对市场竞争格局影响有限。日志保留时长、支持的 API 调用范围及是否支持导出等细节尚未披露。
Gemini Flash 系列 3.7/3.6/3.5-Lite 三模型同步 GA
Google 于 2026 年 8 月 15 日同步发布 Gemini Flash 系列三款模型的 GA 版本。Gemini 3.7 Flash(gemini-3.7-flash)定位最智能工作型模型,在软件工程、网页开发和智能体工作流方面有实质性提升,2026 年底前提供入门价格。Gemini 3.6 Flash(gemini-3.6-flash)提升 token 效率与代码/智能体规划能力,价格低于 3.5 Flash,解决输出冗长问题。Gemini 3.5 Flash-Lite(gemini-3.5-flash-lite)定位低延迟、高性价比子智能体选项,适合高吞吐量自动化场景。此次发布同时废弃 temperature、top_p、top_k 采样参数,推动 API 使用范式统一。整体通过分层产品矩阵覆盖从高端工作型到轻量自动化全场景,以限时入门价和降价策略强化在开发者工具链中的竞争力。
Gemini Robotics ER 2 具身推理模型公开预览发布
Google 于 2026 年 8 月 15 日发布 Gemini Robotics ER 2 系列两个具身推理模型端点的公开预览。gemini-robotics-er-2-preview 支持高级空间推理、智能体代码执行、多步骤工具编排、视频时刻定位、进度分类及多机器人协调。gemini-robotics-er-2-streaming-preview 通过 Live API 实现低延迟文本流式输出,支持双向音视频输入。同时宣布 gemini-robotics-er-1.6-preview 将于 2026 年 8 月 31 日下线,用户需在此日期前完成迁移。此次发布显示 Google 在具身智能与机器人领域持续加码,推出多机器人协调等高级能力。
Gemini Enterprise Agent Platform 免费层提供完整 token 但限制高级功能及数据使用
Gemini Enterprise Agent Platform 定价策略显示,免费层提供免费输入输出 token 及 AI Studio 访问权限,但在模型种类上有所限制,排除缓存和 Batch API 等高级功能,且用户生成内容将被用于改进产品。付费层则移除数据训练用途并解锁全部高级功能。该策略延续了'免费换数据'的行业惯例,通过功能分层引导生产环境用户付费转化,同时维持开发者漏斗顶端流量。
Gemini 3.x 上下文缓存存储定价统一为 $0.50-$1.00/百万 token/小时
Gemini Enterprise Agent Platform 将所有 Gemini 3.x 模型的上下文缓存存储定价统一为 2026 年底前 $0.50/百万 token/小时,2027 年起上调至 $1.00/百万 token/小时。该价格不区分具体模型或服务层级。统一缓存存储费率简化了长会话和大文档应用的成本模型,但 2027 年价格翻倍预示长期持有缓存的成本压力将显著增加,依赖持久化缓存的 Agent 或 RAG 系统需提前规划缓存策略。
Google 发布 Gemini 3.1/3.5 系列多模态 Preview 模型,覆盖语音、翻译与图像生成
2026年8月15日,Google 在 Gemini Enterprise Agent Platform 上同步发布多款多模态 Preview 模型,全面扩展语音、翻译与图像生成能力。Gemini 3.1 Flash Image(代号 Nano Banana 2)及其 Lite 版引入原生图像生成并采用按 token 计费模式,标准输出 $60/百万 token(约 $0.067/张),Lite 版 $30/百万 token,Batch 模式再享五折,挑战传统按张计费的图像 API 模式。Gemini 3.1 Flash Live Preview 是低延迟音频对话模型,首次在付费层支持 Google Search Grounding,音频输入定价 $3.00/百万 token。Gemini 3.1 Flash TTS Preview 提供可控语音生成,标准输出 $20/百万音频 token(25 token/秒),Batch 模式 $10。Gemini 3.5 Live Translate Preview 支持 70+ 语言的实时语音翻译,输入 $3.50/百万 token、输出 $21.00/百万 token。此次发布将语音交互、语音合成、实时翻译与图像生成统一纳入 token 计费体系,完善了语音 Agent 工具链,但所有模型均处于 Preview 状态,存在速率限制与稳定性风险,尚未适合大规模生产部署。
Gemini Enterprise Agent Platform 推出 Enterprise 层,含预置吞吐与批量折扣
Google 在 Gemini Enterprise Agent Platform 中推出 Enterprise 层,在 Paid 层基础上增加专属支持、高级安全合规、预置吞吐(provisioned throughput)、基于用量的批量折扣(volume-based discounts)以及 MLOps/Model Garden 等企业级能力。报价需联系销售获取。此举完善了企业级 Agent 部署的商业化闭环,通过预置吞吐和合规能力争夺大型客户,与 AWS Bedrock 企业级服务及 Azure AI 企业方案直接对标。大规模 Agent 部署企业可获得 SLA 保障和定制支持,但需通过销售流程获取定价,透明度低于自助层级。
Gemini Interactions API 正式 GA,成为平台推荐主要接入方式
Google 宣布 Gemini Interactions API 正式 GA,并推荐开发者使用该 API 访问所有最新功能和模型,作为 Gemini 平台的主要接口。统一 API 入口有助于简化开发者集成路径,减少多端点维护负担,可能加速生态向新范式迁移。开发者应优先采用 Interactions API 以确保获取最新模型和功能;旧版 API 用户需评估迁移计划。此举标志着 Google 在 Agent 平台层面推进接口标准化,降低多模型、多能力调用的集成复杂度。
Gemini 3.x 统一 Search/Maps Grounding 定价:月 5000 次免费,超额 $14/千次
Google 对所有 Gemini 3.x 模型实施统一的 Grounding 计费策略:每月 5000 次免费 Google Search/Maps 请求额度(跨模型共享),超出后按 $14/千次计费。免费层不可使用 Grounding 功能,但可在 AI Studio 中测试。此举简化了多模型混用时的成本预测,$14/千次的定价为检索增强生成(RAG)设立了透明基准。使用 Search/Maps Grounding 的开发者需跨模型合并计算免费额度,高频检索应用需将超额费率纳入单位经济模型。
Gemini 3.5 Flash-Lite 正式 GA,主打高频 Agent 低成本场景
Google 宣布 Gemini 3.5 Flash-Lite 模型正式 GA,定位为 Gemini 系列中最高性价比的 GA 模型,专为高频 Agent 任务、翻译和简单数据处理场景优化。标准输入定价为 $0.30/百万 token(全模态统一),Batch/Flex 模式低至 $0.15/百万 token。该模型以极低单价切入高频轻量级 Agent 市场,对现有低成本模型形成直接价格压力,推动 Agent 规模化部署的经济可行性。大规模 Agent 编排、翻译管道及数据清洗场景可显著降低推理成本。
Google Gemini API 2026年8月产品与定价全面更新
Google 于 2026 年 8 月 15 日对 Gemini API 进行了一次综合性产品与定价更新,涵盖多个模型和能力维度。首先,正式发布 Gemini 3.7 Flash,定位为面向智能体工作流和多模态推理的新一代 Flash 模型,付费层促销价为输入 $0.75 / 输出 $3.75 每百万 token(2026 年底前),2027 年起翻倍。其次,Gemini 3.1 Pro Preview 引入基于上下文长度的分级定价机制:≤20 万 token 时输入 $2.00 / 输出 $12.00,超过 20 万 token 时分别升至 $4.00 / $18.00。第三,Gemini Omni Flash Preview 新增原生视频生成 API 能力,视频输出定价 $17.50 / 百万 token(720p 约 $0.10/秒),文本输出 $9.00 / 百万 token。最后,整个 Gemini 3.x 系列实行限时促销价策略,2026 年 12 月 31 日前享受约 50% 折扣,2027 年 1 月 1 日起恢复标准价。此次更新同时推进了新模型发布、多模态能力扩展和定价结构重塑三条主线。