3
里程碑
19
重要更新
10
常规动态
Google Gemini 定价页面元数据日期戳更新
Gemini 官方定价页面 (ai.google.dev/pricing) 的「最后更新」日期从 2026-08-27 UTC 变更为 2026-08-28 UTC。除了日期戳的刷新之外,页面 diff 中未检测到任何关于定价、模型版本或速率限制的可见变化。
Google 发布 Gemini Omni 1.1 Flash 正式版并公布定价,同时宣布弃用预览版
Google DeepMind 正式推出 Gemini Omni 1.1 Flash(gemini-omni-1.1-flash),为开发者提供更强的构建控制能力,并在 API 付费层正式商用。输入价格为每百万 token 1.50 美元,文本输出 9.00 美元,视频输出 17.50 美元,无免费额度。同时,官方宣布现有的 gemini-omni-flash-preview 端点将于 2026 年 9 月 30 日弃用,要求用户迁移至新版。
Gemini Omni Flash Preview 描述更新并移除付费限制说明
Gemini Omni Flash Preview 的描述从“available to developers on the paid tier”改为仅保留“OUR next-generation video generation and editing model”,移除了付费层级限制的说明。这可能意味着该模型免费层可用性有所变化,但实际限制需验证。
Gemini 多款模型描述由最高级营销语言改为中性描述
Google 对多个 Gemini 模型的描述进行了调整,将“最智能”、“世界最佳”等最高级营销语言改为中性描述(如“A Flash model built for speed”)。这反映了 Google 在 AI 模型营销上的合规考量,对实际产品能力无影响,但可能暗示部分预览模型已趋于稳定。
Google Gemini 定价页面移除多款旧版及预览模型
Google Gemini 定价页面移除了多款旧版及预览模型的定价条目,包括 Veo 2、Veo 3(Standard/Fast)、Imagen 4(Fast/Standard/Ultra)以及 Gemini 2.5 Flash-Lite Preview。这表明 Google 正在清理旧版视频与图像生成模型(如统一至 Veo 3.1),并进行正常的预览版模型生命周期管理。使用旧版 API 的开发者需迁移至新版或替代方案。
Google 正式发布 Gemini 3.5 Transcribe 语音转文字模型
Google 正式发布两款基于 Gemini 音频理解的专用语音转文字模型:Gemini 3.5 Transcribe 和 Gemini 3.5 Transcribe Live。支持 85+ 语言的语句级语言检测、说话人分离、词级时间戳和自定义词汇偏置。流式转录 Live API 进一步瞄准实时会议、客服等场景,标志着 Gemini 正式进入语音转文字市场,与 Whisper 等专业 ASR 服务竞争。
Gemini API 文档移除 Semantic Retriever 功能
Google 在 2026年8月24日的 Gemini API 文档更新中移除了此前列为 Beta 功能的 Semantic Retriever。该变更可能意味着该功能已被取消、合并到其他能力中,或不再作为独立功能提供。对依赖该功能的开发者有一定影响,但整体市场影响较小。
Gemini 3.5 Flash 上线 Computer Use 工具公开预览
Google 在 Gemini 3.5 Flash 上发布 Computer Use 工具公开预览,支持简化意图操作,内置浏览器、移动端和桌面环境支持,并提供可配置安全策略和高级提示注入检测功能。该功能使开发者可直接在 Gemini API 中实现自动化 UI 操作,无需额外搭建基础设施。Computer Use 已成为 AI Agent 平台的关键差异化能力,Google 此举与 Anthropic Computer Use、OpenAI Operator 等形成直接竞争,降低了企业自动化和 RPA 场景的使用门槛。但具体延迟、成功率基准及正式 GA 时间尚未披露。
Gemini Omni Flash 视频生成预览发布及 Flash Lite Image GA
Google 发布 gemini-omni-flash-preview 高性能多模态模型,支持高速视频生成和对话式视频编辑。通过 Interactions API,用户可从文本描述生成 3-10 秒 720p 视频或动画化静态图像,并支持对话式编辑和优化。同时 gemini-3.1-flash-lite-image(Nano Banana 2 Lite)正式 GA,定位超低延迟经济型图像生成与编辑。Omni Flash 标志着 Google 以新模型进入视频生成赛道,与 Sora、Veo、Kling 等竞品形成直接竞争,对话式编辑能力是差异化亮点,可能推动视频生成从单次生成向交互式工作流演进。具体延迟、定价及与 Veo 产品线的定位关系尚未明确。
AI Studio 控制台上线 Interactions API 开发者日志
Google AI Studio 控制台现已支持查看 Interactions API 调用的开发者日志。该功能改善了开发者调试体验,使用 Interactions API 的开发者可直接在 AI Studio 中查看调用日志,提升调试效率。此更新属于平台开发者体验(DX)能力的常规增强,对市场竞争格局影响有限。日志保留时长、支持的 API 调用范围及是否支持导出等细节尚未披露。
Gemini Flash 系列 3.7/3.6/3.5-Lite 三模型同步 GA
Google 于 2026 年 8 月 15 日同步发布 Gemini Flash 系列三款模型的 GA 版本。Gemini 3.7 Flash(gemini-3.7-flash)定位最智能工作型模型,在软件工程、网页开发和智能体工作流方面有实质性提升,2026 年底前提供入门价格。Gemini 3.6 Flash(gemini-3.6-flash)提升 token 效率与代码/智能体规划能力,价格低于 3.5 Flash,解决输出冗长问题。Gemini 3.5 Flash-Lite(gemini-3.5-flash-lite)定位低延迟、高性价比子智能体选项,适合高吞吐量自动化场景。此次发布同时废弃 temperature、top_p、top_k 采样参数,推动 API 使用范式统一。整体通过分层产品矩阵覆盖从高端工作型到轻量自动化全场景,以限时入门价和降价策略强化在开发者工具链中的竞争力。
Gemini Robotics ER 2 具身推理模型公开预览发布
Google 于 2026 年 8 月 15 日发布 Gemini Robotics ER 2 系列两个具身推理模型端点的公开预览。gemini-robotics-er-2-preview 支持高级空间推理、智能体代码执行、多步骤工具编排、视频时刻定位、进度分类及多机器人协调。gemini-robotics-er-2-streaming-preview 通过 Live API 实现低延迟文本流式输出,支持双向音视频输入。同时宣布 gemini-robotics-er-1.6-preview 将于 2026 年 8 月 31 日下线,用户需在此日期前完成迁移。此次发布显示 Google 在具身智能与机器人领域持续加码,推出多机器人协调等高级能力。
Gemini Enterprise Agent Platform 免费层提供完整 token 但限制高级功能及数据使用
Gemini Enterprise Agent Platform 定价策略显示,免费层提供免费输入输出 token 及 AI Studio 访问权限,但在模型种类上有所限制,排除缓存和 Batch API 等高级功能,且用户生成内容将被用于改进产品。付费层则移除数据训练用途并解锁全部高级功能。该策略延续了'免费换数据'的行业惯例,通过功能分层引导生产环境用户付费转化,同时维持开发者漏斗顶端流量。
Gemini 3.x 上下文缓存存储定价统一为 $0.50-$1.00/百万 token/小时
Gemini Enterprise Agent Platform 将所有 Gemini 3.x 模型的上下文缓存存储定价统一为 2026 年底前 $0.50/百万 token/小时,2027 年起上调至 $1.00/百万 token/小时。该价格不区分具体模型或服务层级。统一缓存存储费率简化了长会话和大文档应用的成本模型,但 2027 年价格翻倍预示长期持有缓存的成本压力将显著增加,依赖持久化缓存的 Agent 或 RAG 系统需提前规划缓存策略。
Google 发布 Gemini 3.1/3.5 系列多模态 Preview 模型,覆盖语音、翻译与图像生成
2026年8月15日,Google 在 Gemini Enterprise Agent Platform 上同步发布多款多模态 Preview 模型,全面扩展语音、翻译与图像生成能力。Gemini 3.1 Flash Image(代号 Nano Banana 2)及其 Lite 版引入原生图像生成并采用按 token 计费模式,标准输出 $60/百万 token(约 $0.067/张),Lite 版 $30/百万 token,Batch 模式再享五折,挑战传统按张计费的图像 API 模式。Gemini 3.1 Flash Live Preview 是低延迟音频对话模型,首次在付费层支持 Google Search Grounding,音频输入定价 $3.00/百万 token。Gemini 3.1 Flash TTS Preview 提供可控语音生成,标准输出 $20/百万音频 token(25 token/秒),Batch 模式 $10。Gemini 3.5 Live Translate Preview 支持 70+ 语言的实时语音翻译,输入 $3.50/百万 token、输出 $21.00/百万 token。此次发布将语音交互、语音合成、实时翻译与图像生成统一纳入 token 计费体系,完善了语音 Agent 工具链,但所有模型均处于 Preview 状态,存在速率限制与稳定性风险,尚未适合大规模生产部署。
Gemini Enterprise Agent Platform 推出 Enterprise 层,含预置吞吐与批量折扣
Google 在 Gemini Enterprise Agent Platform 中推出 Enterprise 层,在 Paid 层基础上增加专属支持、高级安全合规、预置吞吐(provisioned throughput)、基于用量的批量折扣(volume-based discounts)以及 MLOps/Model Garden 等企业级能力。报价需联系销售获取。此举完善了企业级 Agent 部署的商业化闭环,通过预置吞吐和合规能力争夺大型客户,与 AWS Bedrock 企业级服务及 Azure AI 企业方案直接对标。大规模 Agent 部署企业可获得 SLA 保障和定制支持,但需通过销售流程获取定价,透明度低于自助层级。
Gemini Interactions API 正式 GA,成为平台推荐主要接入方式
Google 宣布 Gemini Interactions API 正式 GA,并推荐开发者使用该 API 访问所有最新功能和模型,作为 Gemini 平台的主要接口。统一 API 入口有助于简化开发者集成路径,减少多端点维护负担,可能加速生态向新范式迁移。开发者应优先采用 Interactions API 以确保获取最新模型和功能;旧版 API 用户需评估迁移计划。此举标志着 Google 在 Agent 平台层面推进接口标准化,降低多模型、多能力调用的集成复杂度。
Gemini 3.x 统一 Search/Maps Grounding 定价:月 5000 次免费,超额 $14/千次
Google 对所有 Gemini 3.x 模型实施统一的 Grounding 计费策略:每月 5000 次免费 Google Search/Maps 请求额度(跨模型共享),超出后按 $14/千次计费。免费层不可使用 Grounding 功能,但可在 AI Studio 中测试。此举简化了多模型混用时的成本预测,$14/千次的定价为检索增强生成(RAG)设立了透明基准。使用 Search/Maps Grounding 的开发者需跨模型合并计算免费额度,高频检索应用需将超额费率纳入单位经济模型。
Gemini 3.5 Flash-Lite 正式 GA,主打高频 Agent 低成本场景
Google 宣布 Gemini 3.5 Flash-Lite 模型正式 GA,定位为 Gemini 系列中最高性价比的 GA 模型,专为高频 Agent 任务、翻译和简单数据处理场景优化。标准输入定价为 $0.30/百万 token(全模态统一),Batch/Flex 模式低至 $0.15/百万 token。该模型以极低单价切入高频轻量级 Agent 市场,对现有低成本模型形成直接价格压力,推动 Agent 规模化部署的经济可行性。大规模 Agent 编排、翻译管道及数据清洗场景可显著降低推理成本。
Google Gemini API 2026年8月产品与定价全面更新
Google 于 2026 年 8 月 15 日对 Gemini API 进行了一次综合性产品与定价更新,涵盖多个模型和能力维度。首先,正式发布 Gemini 3.7 Flash,定位为面向智能体工作流和多模态推理的新一代 Flash 模型,付费层促销价为输入 $0.75 / 输出 $3.75 每百万 token(2026 年底前),2027 年起翻倍。其次,Gemini 3.1 Pro Preview 引入基于上下文长度的分级定价机制:≤20 万 token 时输入 $2.00 / 输出 $12.00,超过 20 万 token 时分别升至 $4.00 / $18.00。第三,Gemini Omni Flash Preview 新增原生视频生成 API 能力,视频输出定价 $17.50 / 百万 token(720p 约 $0.10/秒),文本输出 $9.00 / 百万 token。最后,整个 Gemini 3.x 系列实行限时促销价策略,2026 年 12 月 31 日前享受约 50% 折扣,2027 年 1 月 1 日起恢复标准价。此次更新同时推进了新模型发布、多模态能力扩展和定价结构重塑三条主线。
Gemini API 托管代理新增 3.6 Flash 模型与 hooks 机制支持
Google 宣布 Gemini API 托管代理(Managed Agents)新增多项能力,主要包括对最新的 Gemini 3.6 Flash 模型的支持以及引入 hooks 机制。3.6 Flash 模型的集成使开发者能够将更高性能、更低延迟的模型应用于生产级代理中;hooks 机制则为代理的执行流程提供了更多自定义控制点和干预能力。此次迭代进一步提升了 Gemini 托管代理的灵活性和企业级适用性,与 OpenAI、Anthropic 的 Agent 产品形成更直接的对标。
Gemini API 托管代理新增后台任务与远程 MCP 支持
Google 宣布 Gemini API 托管代理(Managed Agents)新增后台任务和远程 MCP(Model Context Protocol)支持等关键能力。后台任务功能使代理能够异步执行长时间操作,增强了自主运行能力;远程 MCP 支持则使 Gemini 代理能接入更广泛的工具和数据源生态。这些更新直接对标 Anthropic 的 MCP 生态和 OpenAI 的后台代理能力,助力开发者构建更可靠、更具扩展性的生产级 AI 代理。
Google Gemini Interactions API 正式发布
Google 宣布 Interactions API 正式 GA(General Availability),作为与 Gemini 模型和代理(Agents)交互的统一接口。该 API 旨在简化开发者体验,降低在模型调用和代理管理之间的切换成本。这一发布标志着 Google 在 AI 平台架构整合方面迈出重要一步,与 OpenAI 的 Responses API 和 Anthropic 的 Messages API 形成架构层面的直接竞争,为构建复杂的 Gemini 原生应用提供了更标准化的基础。
Gemini 3.1 Flash TTS 模型支持流式语音生成
Google 宣布 gemini-3.1-flash-tts-preview 模型现已支持流式语音生成输出。开发者可通过 streamGenerateContent 方法以及 Interactions API 中的 stream: true 参数实现流式 TTS 调用。该能力显著降低语音生成的端到端延迟,对实时语音助手、对话式 AI 和直播等需要低延迟语音输出的场景具有直接影响。此举增强了 Gemini API 在语音合成领域的竞争力,但流式 TTS 的具体延迟指标、并发限制及首次字节时间(TTFB)等性能数据尚未披露。
Veo 2.0 和 Veo 3.0 视频生成模型弃用,将于 6 月 30 日关闭
Google 宣布弃用 Veo 2.0 和 3.0 系列视频生成模型(veo-2.0-generate-001、veo-3.0-generate-001、veo-3.0-fast-generate-001),并将于 2026 年 6 月 30 日正式关闭。使用上述模型的开发者需迁移至 Veo 3.1 预览版或通过 Gemini Enterprise Agent Platform 使用 GA 版本。此次快速退役显示 Google 在视频生成领域加速产品迭代,Veo 3.1 已成为主力模型。
Imagen 4 和 Gemini 3 图像模型弃用,将于 8 月 17 日关闭
Google 宣布弃用 Imagen 4.0 系列图像生成模型(imagen-4.0-generate-001、imagen-4.0-ultra-generate-001、imagen-4.0-fast-generate-001),并将于 2026 年 8 月 17 日正式关闭。使用上述模型的开发者需迁移至更新的稳定版或预览版端点。此次退役标志着 Google 图像生成产品的快速迭代节奏,Gemini 3.1 系列已成为 Google 图像生成的主线产品。
Gemini 2.0 Flash 和 Flash-Lite 系列模型正式关闭
Google 于 2026 年 6 月 1 日正式关闭 Gemini 2.0 Flash、Flash-001、Flash-Lite、Flash-Lite-001 四个模型端点,标志着 Gemini 2.0 Flash 系列全面完成退役。仍在使用上述模型的开发者需迁移至 gemini-3.5-flash 或 gemini-3.1-flash-lite,否则服务将中断。此举表明 Google 已完成从 2.0 到 3.x 代际的全面切换,加速推动开发者向新一代模型迁移。
Google 发布使用 AI Studio 进行 vibe coding 构建问答游戏案例
Google 发布了一篇博客文章,展示如何使用 Google AI Studio 以 vibe coding 的方式快速构建一个关于 I/O 2026 公告的问答游戏。这是一篇产品能力展示类内容,通过实际案例直观呈现了 AI Studio 在低代码/无代码快速原型构建方面的能力。虽然对市场格局无实质性影响,但有助于强化 Google 在 AI 开发工具领域的品牌认知,并为开发者提供了 vibe coding 的实践参考。
Google AI Studio 氛围编码打造的 I/O 2026 问答测验上线
Google 发布了一个使用 Google AI Studio 氛围编码(vibe coding)功能构建的 I/O 2026 问答测验,展示了该工具创建交互式网页体验的能力。作为官方产品能力展示,间接向开发者传递了 AI 辅助开发工具的易用性和产品化程度,吸引开发者尝试该工具。
Gemini 3.1 Flash Image 和 3 Pro Image 正式发布,新增视频转图像功能
Google 正式发布 gemini-3.1-flash-image(Nano Banana 2)和 gemini-3-pro-image(Nano Banana Pro)两款原生视觉图像生成模型。其中 gemini-3.1-flash-image 新增视频转图像生成能力,支持传入视频文件或 YouTube URL 自动生成缩略图、电影海报或信息图,实现跨模态内容创作。该功能目前仅限 gemini-3.1-flash-image 模型使用。此次发布进一步巩固了 Google 在多模态生成领域的技术领先地位。
Gemini 3.5 Flash GA,Managed Agents 与 Antigravity Agent 公开预览
Google 于 2026 年 5 月 19 日发布多项重大更新。Gemini 3.5 Flash 正式 GA,成为 gemini-flash-latest 的底层模型,所有依赖 flash-latest 的用户自动获得升级。Managed Agents 在 Gemini API 中进入公开预览,支持在 Google 托管的 Linux 沙箱中构建自主有状态代理,将 Agent 运行时管理交由 Google 基础设施承担。同时发布 Antigravity Agent(antigravity-preview-05-2026)公开预览版,具备自主规划、推理、编写和执行代码、管理文件等全栈自主能力。此次发布标志着 Google 在 Agent 平台化方面迈出重要一步,将自主代理能力作为 API 产品直接提供。
Google I/O 2026 发布开发者工具与 AI Studio 重大更新
Google 在 I/O 2026 大会上集中发布了一系列面向开发者的重大更新。在 AI Studio 方面,推出了原生 Android vibe coding 支持、Google Workspace 深度集成以及 AI Studio 移动应用,使其从 Web 端工具扩展为跨平台、与企业办公套件绑定的 AI 开发平台。同时,大会还展示了 Google Antigravity 更新和增强版 Gemini API,提供从提示到生产就绪应用的原生工具链。这些更新覆盖了从快速原型构建到生产部署的全流程,显著降低了 AI 应用的开发门槛,强化了 Google 在端到端 AI 开发平台领域的竞争力。