信号图谱

Gemini

全球 · 模型厂商

访问官方网站 ↗

3

里程碑

19

重要更新

10

常规动态

INTELLIGENCE TIMELINE

情报时间线 (20)

2026-08-28其他常规

Google Gemini 定价页面元数据日期戳更新

Gemini 官方定价页面 (ai.google.dev/pricing) 的「最后更新」日期从 2026-08-27 UTC 变更为 2026-08-28 UTC。除了日期戳的刷新之外,页面 diff 中未检测到任何关于定价、模型版本或速率限制的可见变化。

2026-08-27新发布重要3 个来源印证

Google 发布 Gemini Omni 1.1 Flash 正式版并公布定价,同时宣布弃用预览版

Google DeepMind 正式推出 Gemini Omni 1.1 Flash(gemini-omni-1.1-flash),为开发者提供更强的构建控制能力,并在 API 付费层正式商用。输入价格为每百万 token 1.50 美元,文本输出 9.00 美元,视频输出 17.50 美元,无免费额度。同时,官方宣布现有的 gemini-omni-flash-preview 端点将于 2026 年 9 月 30 日弃用,要求用户迁移至新版。

2026-08-26其他常规

Gemini Omni Flash Preview 描述更新并移除付费限制说明

Gemini Omni Flash Preview 的描述从“available to developers on the paid tier”改为仅保留“OUR next-generation video generation and editing model”,移除了付费层级限制的说明。这可能意味着该模型免费层可用性有所变化,但实际限制需验证。

2026-08-26其他常规

Gemini 多款模型描述由最高级营销语言改为中性描述

Google 对多个 Gemini 模型的描述进行了调整,将“最智能”、“世界最佳”等最高级营销语言改为中性描述(如“A Flash model built for speed”)。这反映了 Google 在 AI 模型营销上的合规考量,对实际产品能力无影响,但可能暗示部分预览模型已趋于稳定。

2026-08-26弃用重要6 条记录

Google Gemini 定价页面移除多款旧版及预览模型

Google Gemini 定价页面移除了多款旧版及预览模型的定价条目,包括 Veo 2、Veo 3(Standard/Fast)、Imagen 4(Fast/Standard/Ultra)以及 Gemini 2.5 Flash-Lite Preview。这表明 Google 正在清理旧版视频与图像生成模型(如统一至 Veo 3.1),并进行正常的预览版模型生命周期管理。使用旧版 API 的开发者需迁移至新版或替代方案。

2026-08-26新发布重要3 个来源印证

Google 正式发布 Gemini 3.5 Transcribe 语音转文字模型

Google 正式发布两款基于 Gemini 音频理解的专用语音转文字模型:Gemini 3.5 Transcribe 和 Gemini 3.5 Transcribe Live。支持 85+ 语言的语句级语言检测、说话人分离、词级时间戳和自定义词汇偏置。流式转录 Live API 进一步瞄准实时会议、客服等场景,标志着 Gemini 正式进入语音转文字市场,与 Whisper 等专业 ASR 服务竞争。

2026-08-24弃用常规

Gemini API 文档移除 Semantic Retriever 功能

Google 在 2026年8月24日的 Gemini API 文档更新中移除了此前列为 Beta 功能的 Semantic Retriever。该变更可能意味着该功能已被取消、合并到其他能力中,或不再作为独立功能提供。对依赖该功能的开发者有一定影响,但整体市场影响较小。

2026-08-15新发布重要2 个来源印证

Gemini 3.5 Flash 上线 Computer Use 工具公开预览

Google 在 Gemini 3.5 Flash 上发布 Computer Use 工具公开预览,支持简化意图操作,内置浏览器、移动端和桌面环境支持,并提供可配置安全策略和高级提示注入检测功能。该功能使开发者可直接在 Gemini API 中实现自动化 UI 操作,无需额外搭建基础设施。Computer Use 已成为 AI Agent 平台的关键差异化能力,Google 此举与 Anthropic Computer Use、OpenAI Operator 等形成直接竞争,降低了企业自动化和 RPA 场景的使用门槛。但具体延迟、成功率基准及正式 GA 时间尚未披露。

2026-08-15新发布重要2 条记录

Gemini Omni Flash 视频生成预览发布及 Flash Lite Image GA

Google 发布 gemini-omni-flash-preview 高性能多模态模型,支持高速视频生成和对话式视频编辑。通过 Interactions API,用户可从文本描述生成 3-10 秒 720p 视频或动画化静态图像,并支持对话式编辑和优化。同时 gemini-3.1-flash-lite-image(Nano Banana 2 Lite)正式 GA,定位超低延迟经济型图像生成与编辑。Omni Flash 标志着 Google 以新模型进入视频生成赛道,与 Sora、Veo、Kling 等竞品形成直接竞争,对话式编辑能力是差异化亮点,可能推动视频生成从单次生成向交互式工作流演进。具体延迟、定价及与 Veo 产品线的定位关系尚未明确。

2026-08-15能力增强常规

AI Studio 控制台上线 Interactions API 开发者日志

Google AI Studio 控制台现已支持查看 Interactions API 调用的开发者日志。该功能改善了开发者调试体验,使用 Interactions API 的开发者可直接在 AI Studio 中查看调用日志,提升调试效率。此更新属于平台开发者体验(DX)能力的常规增强,对市场竞争格局影响有限。日志保留时长、支持的 API 调用范围及是否支持导出等细节尚未披露。

2026-08-15新发布里程碑2 条记录

Gemini Flash 系列 3.7/3.6/3.5-Lite 三模型同步 GA

Google 于 2026 年 8 月 15 日同步发布 Gemini Flash 系列三款模型的 GA 版本。Gemini 3.7 Flash(gemini-3.7-flash)定位最智能工作型模型,在软件工程、网页开发和智能体工作流方面有实质性提升,2026 年底前提供入门价格。Gemini 3.6 Flash(gemini-3.6-flash)提升 token 效率与代码/智能体规划能力,价格低于 3.5 Flash,解决输出冗长问题。Gemini 3.5 Flash-Lite(gemini-3.5-flash-lite)定位低延迟、高性价比子智能体选项,适合高吞吐量自动化场景。此次发布同时废弃 temperature、top_p、top_k 采样参数,推动 API 使用范式统一。整体通过分层产品矩阵覆盖从高端工作型到轻量自动化全场景,以限时入门价和降价策略强化在开发者工具链中的竞争力。

2026-08-15新发布重要

Gemini Robotics ER 2 具身推理模型公开预览发布

Google 于 2026 年 8 月 15 日发布 Gemini Robotics ER 2 系列两个具身推理模型端点的公开预览。gemini-robotics-er-2-preview 支持高级空间推理、智能体代码执行、多步骤工具编排、视频时刻定位、进度分类及多机器人协调。gemini-robotics-er-2-streaming-preview 通过 Live API 实现低延迟文本流式输出,支持双向音视频输入。同时宣布 gemini-robotics-er-1.6-preview 将于 2026 年 8 月 31 日下线,用户需在此日期前完成迁移。此次发布显示 Google 在具身智能与机器人领域持续加码,推出多机器人协调等高级能力。

2026-08-15其他常规

Gemini Enterprise Agent Platform 免费层提供完整 token 但限制高级功能及数据使用

Gemini Enterprise Agent Platform 定价策略显示,免费层提供免费输入输出 token 及 AI Studio 访问权限,但在模型种类上有所限制,排除缓存和 Batch API 等高级功能,且用户生成内容将被用于改进产品。付费层则移除数据训练用途并解锁全部高级功能。该策略延续了'免费换数据'的行业惯例,通过功能分层引导生产环境用户付费转化,同时维持开发者漏斗顶端流量。

2026-08-15价格变动常规

Gemini 3.x 上下文缓存存储定价统一为 $0.50-$1.00/百万 token/小时

Gemini Enterprise Agent Platform 将所有 Gemini 3.x 模型的上下文缓存存储定价统一为 2026 年底前 $0.50/百万 token/小时,2027 年起上调至 $1.00/百万 token/小时。该价格不区分具体模型或服务层级。统一缓存存储费率简化了长会话和大文档应用的成本模型,但 2027 年价格翻倍预示长期持有缓存的成本压力将显著增加,依赖持久化缓存的 Agent 或 RAG 系统需提前规划缓存策略。

2026-08-15新发布重要4 条记录

Google 发布 Gemini 3.1/3.5 系列多模态 Preview 模型,覆盖语音、翻译与图像生成

2026年8月15日,Google 在 Gemini Enterprise Agent Platform 上同步发布多款多模态 Preview 模型,全面扩展语音、翻译与图像生成能力。Gemini 3.1 Flash Image(代号 Nano Banana 2)及其 Lite 版引入原生图像生成并采用按 token 计费模式,标准输出 $60/百万 token(约 $0.067/张),Lite 版 $30/百万 token,Batch 模式再享五折,挑战传统按张计费的图像 API 模式。Gemini 3.1 Flash Live Preview 是低延迟音频对话模型,首次在付费层支持 Google Search Grounding,音频输入定价 $3.00/百万 token。Gemini 3.1 Flash TTS Preview 提供可控语音生成,标准输出 $20/百万音频 token(25 token/秒),Batch 模式 $10。Gemini 3.5 Live Translate Preview 支持 70+ 语言的实时语音翻译,输入 $3.50/百万 token、输出 $21.00/百万 token。此次发布将语音交互、语音合成、实时翻译与图像生成统一纳入 token 计费体系,完善了语音 Agent 工具链,但所有模型均处于 Preview 状态,存在速率限制与稳定性风险,尚未适合大规模生产部署。

2026-08-15能力增强重要

Gemini Enterprise Agent Platform 推出 Enterprise 层,含预置吞吐与批量折扣

Google 在 Gemini Enterprise Agent Platform 中推出 Enterprise 层,在 Paid 层基础上增加专属支持、高级安全合规、预置吞吐(provisioned throughput)、基于用量的批量折扣(volume-based discounts)以及 MLOps/Model Garden 等企业级能力。报价需联系销售获取。此举完善了企业级 Agent 部署的商业化闭环,通过预置吞吐和合规能力争夺大型客户,与 AWS Bedrock 企业级服务及 Azure AI 企业方案直接对标。大规模 Agent 部署企业可获得 SLA 保障和定制支持,但需通过销售流程获取定价,透明度低于自助层级。

2026-08-15能力增强重要

Gemini Interactions API 正式 GA,成为平台推荐主要接入方式

Google 宣布 Gemini Interactions API 正式 GA,并推荐开发者使用该 API 访问所有最新功能和模型,作为 Gemini 平台的主要接口。统一 API 入口有助于简化开发者集成路径,减少多端点维护负担,可能加速生态向新范式迁移。开发者应优先采用 Interactions API 以确保获取最新模型和功能;旧版 API 用户需评估迁移计划。此举标志着 Google 在 Agent 平台层面推进接口标准化,降低多模型、多能力调用的集成复杂度。

2026-08-15价格变动常规

Gemini 3.x 统一 Search/Maps Grounding 定价:月 5000 次免费,超额 $14/千次

Google 对所有 Gemini 3.x 模型实施统一的 Grounding 计费策略:每月 5000 次免费 Google Search/Maps 请求额度(跨模型共享),超出后按 $14/千次计费。免费层不可使用 Grounding 功能,但可在 AI Studio 中测试。此举简化了多模型混用时的成本预测,$14/千次的定价为检索增强生成(RAG)设立了透明基准。使用 Search/Maps Grounding 的开发者需跨模型合并计算免费额度,高频检索应用需将超额费率纳入单位经济模型。

2026-08-15新发布重要2 个来源印证

Gemini 3.5 Flash-Lite 正式 GA,主打高频 Agent 低成本场景

Google 宣布 Gemini 3.5 Flash-Lite 模型正式 GA,定位为 Gemini 系列中最高性价比的 GA 模型,专为高频 Agent 任务、翻译和简单数据处理场景优化。标准输入定价为 $0.30/百万 token(全模态统一),Batch/Flex 模式低至 $0.15/百万 token。该模型以极低单价切入高频轻量级 Agent 市场,对现有低成本模型形成直接价格压力,推动 Agent 规模化部署的经济可行性。大规模 Agent 编排、翻译管道及数据清洗场景可显著降低推理成本。

2026-08-15新发布重要4 条记录

Google Gemini API 2026年8月产品与定价全面更新

Google 于 2026 年 8 月 15 日对 Gemini API 进行了一次综合性产品与定价更新,涵盖多个模型和能力维度。首先,正式发布 Gemini 3.7 Flash,定位为面向智能体工作流和多模态推理的新一代 Flash 模型,付费层促销价为输入 $0.75 / 输出 $3.75 每百万 token(2026 年底前),2027 年起翻倍。其次,Gemini 3.1 Pro Preview 引入基于上下文长度的分级定价机制:≤20 万 token 时输入 $2.00 / 输出 $12.00,超过 20 万 token 时分别升至 $4.00 / $18.00。第三,Gemini Omni Flash Preview 新增原生视频生成 API 能力,视频输出定价 $17.50 / 百万 token(720p 约 $0.10/秒),文本输出 $9.00 / 百万 token。最后,整个 Gemini 3.x 系列实行限时促销价策略,2026 年 12 月 31 日前享受约 50% 折扣,2027 年 1 月 1 日起恢复标准价。此次更新同时推进了新模型发布、多模态能力扩展和定价结构重塑三条主线。