信号图谱

Gemini

全球 · 模型厂商

访问官方网站 ↗

3

里程碑

19

重要更新

10

常规动态

INTELLIGENCE TIMELINE

情报时间线 (32)

2026-08-28其他常规

Google Gemini 定价页面元数据日期戳更新

Gemini 官方定价页面 (ai.google.dev/pricing) 的「最后更新」日期从 2026-08-27 UTC 变更为 2026-08-28 UTC。除了日期戳的刷新之外,页面 diff 中未检测到任何关于定价、模型版本或速率限制的可见变化。

2026-08-27新发布重要3 个来源印证

Google 发布 Gemini Omni 1.1 Flash 正式版并公布定价,同时宣布弃用预览版

Google DeepMind 正式推出 Gemini Omni 1.1 Flash(gemini-omni-1.1-flash),为开发者提供更强的构建控制能力,并在 API 付费层正式商用。输入价格为每百万 token 1.50 美元,文本输出 9.00 美元,视频输出 17.50 美元,无免费额度。同时,官方宣布现有的 gemini-omni-flash-preview 端点将于 2026 年 9 月 30 日弃用,要求用户迁移至新版。

2026-08-26其他常规

Gemini Omni Flash Preview 描述更新并移除付费限制说明

Gemini Omni Flash Preview 的描述从“available to developers on the paid tier”改为仅保留“OUR next-generation video generation and editing model”,移除了付费层级限制的说明。这可能意味着该模型免费层可用性有所变化,但实际限制需验证。

2026-08-26其他常规

Gemini 多款模型描述由最高级营销语言改为中性描述

Google 对多个 Gemini 模型的描述进行了调整,将“最智能”、“世界最佳”等最高级营销语言改为中性描述(如“A Flash model built for speed”)。这反映了 Google 在 AI 模型营销上的合规考量,对实际产品能力无影响,但可能暗示部分预览模型已趋于稳定。

2026-08-26弃用重要6 条记录

Google Gemini 定价页面移除多款旧版及预览模型

Google Gemini 定价页面移除了多款旧版及预览模型的定价条目,包括 Veo 2、Veo 3(Standard/Fast)、Imagen 4(Fast/Standard/Ultra)以及 Gemini 2.5 Flash-Lite Preview。这表明 Google 正在清理旧版视频与图像生成模型(如统一至 Veo 3.1),并进行正常的预览版模型生命周期管理。使用旧版 API 的开发者需迁移至新版或替代方案。

2026-08-26新发布重要3 个来源印证

Google 正式发布 Gemini 3.5 Transcribe 语音转文字模型

Google 正式发布两款基于 Gemini 音频理解的专用语音转文字模型:Gemini 3.5 Transcribe 和 Gemini 3.5 Transcribe Live。支持 85+ 语言的语句级语言检测、说话人分离、词级时间戳和自定义词汇偏置。流式转录 Live API 进一步瞄准实时会议、客服等场景,标志着 Gemini 正式进入语音转文字市场,与 Whisper 等专业 ASR 服务竞争。

2026-08-24弃用常规

Gemini API 文档移除 Semantic Retriever 功能

Google 在 2026年8月24日的 Gemini API 文档更新中移除了此前列为 Beta 功能的 Semantic Retriever。该变更可能意味着该功能已被取消、合并到其他能力中,或不再作为独立功能提供。对依赖该功能的开发者有一定影响,但整体市场影响较小。

2026-08-15新发布重要2 个来源印证

Gemini 3.5 Flash 上线 Computer Use 工具公开预览

Google 在 Gemini 3.5 Flash 上发布 Computer Use 工具公开预览,支持简化意图操作,内置浏览器、移动端和桌面环境支持,并提供可配置安全策略和高级提示注入检测功能。该功能使开发者可直接在 Gemini API 中实现自动化 UI 操作,无需额外搭建基础设施。Computer Use 已成为 AI Agent 平台的关键差异化能力,Google 此举与 Anthropic Computer Use、OpenAI Operator 等形成直接竞争,降低了企业自动化和 RPA 场景的使用门槛。但具体延迟、成功率基准及正式 GA 时间尚未披露。

2026-08-15新发布重要2 条记录

Gemini Omni Flash 视频生成预览发布及 Flash Lite Image GA

Google 发布 gemini-omni-flash-preview 高性能多模态模型,支持高速视频生成和对话式视频编辑。通过 Interactions API,用户可从文本描述生成 3-10 秒 720p 视频或动画化静态图像,并支持对话式编辑和优化。同时 gemini-3.1-flash-lite-image(Nano Banana 2 Lite)正式 GA,定位超低延迟经济型图像生成与编辑。Omni Flash 标志着 Google 以新模型进入视频生成赛道,与 Sora、Veo、Kling 等竞品形成直接竞争,对话式编辑能力是差异化亮点,可能推动视频生成从单次生成向交互式工作流演进。具体延迟、定价及与 Veo 产品线的定位关系尚未明确。

2026-08-15能力增强常规

AI Studio 控制台上线 Interactions API 开发者日志

Google AI Studio 控制台现已支持查看 Interactions API 调用的开发者日志。该功能改善了开发者调试体验,使用 Interactions API 的开发者可直接在 AI Studio 中查看调用日志,提升调试效率。此更新属于平台开发者体验(DX)能力的常规增强,对市场竞争格局影响有限。日志保留时长、支持的 API 调用范围及是否支持导出等细节尚未披露。

2026-08-15新发布里程碑2 条记录

Gemini Flash 系列 3.7/3.6/3.5-Lite 三模型同步 GA

Google 于 2026 年 8 月 15 日同步发布 Gemini Flash 系列三款模型的 GA 版本。Gemini 3.7 Flash(gemini-3.7-flash)定位最智能工作型模型,在软件工程、网页开发和智能体工作流方面有实质性提升,2026 年底前提供入门价格。Gemini 3.6 Flash(gemini-3.6-flash)提升 token 效率与代码/智能体规划能力,价格低于 3.5 Flash,解决输出冗长问题。Gemini 3.5 Flash-Lite(gemini-3.5-flash-lite)定位低延迟、高性价比子智能体选项,适合高吞吐量自动化场景。此次发布同时废弃 temperature、top_p、top_k 采样参数,推动 API 使用范式统一。整体通过分层产品矩阵覆盖从高端工作型到轻量自动化全场景,以限时入门价和降价策略强化在开发者工具链中的竞争力。

2026-08-15新发布重要

Gemini Robotics ER 2 具身推理模型公开预览发布

Google 于 2026 年 8 月 15 日发布 Gemini Robotics ER 2 系列两个具身推理模型端点的公开预览。gemini-robotics-er-2-preview 支持高级空间推理、智能体代码执行、多步骤工具编排、视频时刻定位、进度分类及多机器人协调。gemini-robotics-er-2-streaming-preview 通过 Live API 实现低延迟文本流式输出,支持双向音视频输入。同时宣布 gemini-robotics-er-1.6-preview 将于 2026 年 8 月 31 日下线,用户需在此日期前完成迁移。此次发布显示 Google 在具身智能与机器人领域持续加码,推出多机器人协调等高级能力。

2026-08-15其他常规

Gemini Enterprise Agent Platform 免费层提供完整 token 但限制高级功能及数据使用

Gemini Enterprise Agent Platform 定价策略显示,免费层提供免费输入输出 token 及 AI Studio 访问权限,但在模型种类上有所限制,排除缓存和 Batch API 等高级功能,且用户生成内容将被用于改进产品。付费层则移除数据训练用途并解锁全部高级功能。该策略延续了'免费换数据'的行业惯例,通过功能分层引导生产环境用户付费转化,同时维持开发者漏斗顶端流量。

2026-08-15价格变动常规

Gemini 3.x 上下文缓存存储定价统一为 $0.50-$1.00/百万 token/小时

Gemini Enterprise Agent Platform 将所有 Gemini 3.x 模型的上下文缓存存储定价统一为 2026 年底前 $0.50/百万 token/小时,2027 年起上调至 $1.00/百万 token/小时。该价格不区分具体模型或服务层级。统一缓存存储费率简化了长会话和大文档应用的成本模型,但 2027 年价格翻倍预示长期持有缓存的成本压力将显著增加,依赖持久化缓存的 Agent 或 RAG 系统需提前规划缓存策略。

2026-08-15新发布重要4 条记录

Google 发布 Gemini 3.1/3.5 系列多模态 Preview 模型,覆盖语音、翻译与图像生成

2026年8月15日,Google 在 Gemini Enterprise Agent Platform 上同步发布多款多模态 Preview 模型,全面扩展语音、翻译与图像生成能力。Gemini 3.1 Flash Image(代号 Nano Banana 2)及其 Lite 版引入原生图像生成并采用按 token 计费模式,标准输出 $60/百万 token(约 $0.067/张),Lite 版 $30/百万 token,Batch 模式再享五折,挑战传统按张计费的图像 API 模式。Gemini 3.1 Flash Live Preview 是低延迟音频对话模型,首次在付费层支持 Google Search Grounding,音频输入定价 $3.00/百万 token。Gemini 3.1 Flash TTS Preview 提供可控语音生成,标准输出 $20/百万音频 token(25 token/秒),Batch 模式 $10。Gemini 3.5 Live Translate Preview 支持 70+ 语言的实时语音翻译,输入 $3.50/百万 token、输出 $21.00/百万 token。此次发布将语音交互、语音合成、实时翻译与图像生成统一纳入 token 计费体系,完善了语音 Agent 工具链,但所有模型均处于 Preview 状态,存在速率限制与稳定性风险,尚未适合大规模生产部署。

2026-08-15能力增强重要

Gemini Enterprise Agent Platform 推出 Enterprise 层,含预置吞吐与批量折扣

Google 在 Gemini Enterprise Agent Platform 中推出 Enterprise 层,在 Paid 层基础上增加专属支持、高级安全合规、预置吞吐(provisioned throughput)、基于用量的批量折扣(volume-based discounts)以及 MLOps/Model Garden 等企业级能力。报价需联系销售获取。此举完善了企业级 Agent 部署的商业化闭环,通过预置吞吐和合规能力争夺大型客户,与 AWS Bedrock 企业级服务及 Azure AI 企业方案直接对标。大规模 Agent 部署企业可获得 SLA 保障和定制支持,但需通过销售流程获取定价,透明度低于自助层级。

2026-08-15能力增强重要

Gemini Interactions API 正式 GA,成为平台推荐主要接入方式

Google 宣布 Gemini Interactions API 正式 GA,并推荐开发者使用该 API 访问所有最新功能和模型,作为 Gemini 平台的主要接口。统一 API 入口有助于简化开发者集成路径,减少多端点维护负担,可能加速生态向新范式迁移。开发者应优先采用 Interactions API 以确保获取最新模型和功能;旧版 API 用户需评估迁移计划。此举标志着 Google 在 Agent 平台层面推进接口标准化,降低多模型、多能力调用的集成复杂度。

2026-08-15价格变动常规

Gemini 3.x 统一 Search/Maps Grounding 定价:月 5000 次免费,超额 $14/千次

Google 对所有 Gemini 3.x 模型实施统一的 Grounding 计费策略:每月 5000 次免费 Google Search/Maps 请求额度(跨模型共享),超出后按 $14/千次计费。免费层不可使用 Grounding 功能,但可在 AI Studio 中测试。此举简化了多模型混用时的成本预测,$14/千次的定价为检索增强生成(RAG)设立了透明基准。使用 Search/Maps Grounding 的开发者需跨模型合并计算免费额度,高频检索应用需将超额费率纳入单位经济模型。

2026-08-15新发布重要2 个来源印证

Gemini 3.5 Flash-Lite 正式 GA,主打高频 Agent 低成本场景

Google 宣布 Gemini 3.5 Flash-Lite 模型正式 GA,定位为 Gemini 系列中最高性价比的 GA 模型,专为高频 Agent 任务、翻译和简单数据处理场景优化。标准输入定价为 $0.30/百万 token(全模态统一),Batch/Flex 模式低至 $0.15/百万 token。该模型以极低单价切入高频轻量级 Agent 市场,对现有低成本模型形成直接价格压力,推动 Agent 规模化部署的经济可行性。大规模 Agent 编排、翻译管道及数据清洗场景可显著降低推理成本。

2026-08-15新发布重要4 条记录

Google Gemini API 2026年8月产品与定价全面更新

Google 于 2026 年 8 月 15 日对 Gemini API 进行了一次综合性产品与定价更新,涵盖多个模型和能力维度。首先,正式发布 Gemini 3.7 Flash,定位为面向智能体工作流和多模态推理的新一代 Flash 模型,付费层促销价为输入 $0.75 / 输出 $3.75 每百万 token(2026 年底前),2027 年起翻倍。其次,Gemini 3.1 Pro Preview 引入基于上下文长度的分级定价机制:≤20 万 token 时输入 $2.00 / 输出 $12.00,超过 20 万 token 时分别升至 $4.00 / $18.00。第三,Gemini Omni Flash Preview 新增原生视频生成 API 能力,视频输出定价 $17.50 / 百万 token(720p 约 $0.10/秒),文本输出 $9.00 / 百万 token。最后,整个 Gemini 3.x 系列实行限时促销价策略,2026 年 12 月 31 日前享受约 50% 折扣,2027 年 1 月 1 日起恢复标准价。此次更新同时推进了新模型发布、多模态能力扩展和定价结构重塑三条主线。

2026-07-28能力增强重要

Gemini API 托管代理新增 3.6 Flash 模型与 hooks 机制支持

Google 宣布 Gemini API 托管代理(Managed Agents)新增多项能力,主要包括对最新的 Gemini 3.6 Flash 模型的支持以及引入 hooks 机制。3.6 Flash 模型的集成使开发者能够将更高性能、更低延迟的模型应用于生产级代理中;hooks 机制则为代理的执行流程提供了更多自定义控制点和干预能力。此次迭代进一步提升了 Gemini 托管代理的灵活性和企业级适用性,与 OpenAI、Anthropic 的 Agent 产品形成更直接的对标。

2026-07-07能力增强重要

Gemini API 托管代理新增后台任务与远程 MCP 支持

Google 宣布 Gemini API 托管代理(Managed Agents)新增后台任务和远程 MCP(Model Context Protocol)支持等关键能力。后台任务功能使代理能够异步执行长时间操作,增强了自主运行能力;远程 MCP 支持则使 Gemini 代理能接入更广泛的工具和数据源生态。这些更新直接对标 Anthropic 的 MCP 生态和 OpenAI 的后台代理能力,助力开发者构建更可靠、更具扩展性的生产级 AI 代理。

2026-06-22新发布重要2 条记录

Google Gemini Interactions API 正式发布

Google 宣布 Interactions API 正式 GA(General Availability),作为与 Gemini 模型和代理(Agents)交互的统一接口。该 API 旨在简化开发者体验,降低在模型调用和代理管理之间的切换成本。这一发布标志着 Google 在 AI 平台架构整合方面迈出重要一步,与 OpenAI 的 Responses API 和 Anthropic 的 Messages API 形成架构层面的直接竞争,为构建复杂的 Gemini 原生应用提供了更标准化的基础。

2026-06-17能力增强重要

Gemini 3.1 Flash TTS 模型支持流式语音生成

Google 宣布 gemini-3.1-flash-tts-preview 模型现已支持流式语音生成输出。开发者可通过 streamGenerateContent 方法以及 Interactions API 中的 stream: true 参数实现流式 TTS 调用。该能力显著降低语音生成的端到端延迟,对实时语音助手、对话式 AI 和直播等需要低延迟语音输出的场景具有直接影响。此举增强了 Gemini API 在语音合成领域的竞争力,但流式 TTS 的具体延迟指标、并发限制及首次字节时间(TTFB)等性能数据尚未披露。

2026-06-15弃用重要

Veo 2.0 和 Veo 3.0 视频生成模型弃用,将于 6 月 30 日关闭

Google 宣布弃用 Veo 2.0 和 3.0 系列视频生成模型(veo-2.0-generate-001、veo-3.0-generate-001、veo-3.0-fast-generate-001),并将于 2026 年 6 月 30 日正式关闭。使用上述模型的开发者需迁移至 Veo 3.1 预览版或通过 Gemini Enterprise Agent Platform 使用 GA 版本。此次快速退役显示 Google 在视频生成领域加速产品迭代,Veo 3.1 已成为主力模型。

2026-06-15弃用重要

Imagen 4 和 Gemini 3 图像模型弃用,将于 8 月 17 日关闭

Google 宣布弃用 Imagen 4.0 系列图像生成模型(imagen-4.0-generate-001、imagen-4.0-ultra-generate-001、imagen-4.0-fast-generate-001),并将于 2026 年 8 月 17 日正式关闭。使用上述模型的开发者需迁移至更新的稳定版或预览版端点。此次退役标志着 Google 图像生成产品的快速迭代节奏,Gemini 3.1 系列已成为 Google 图像生成的主线产品。

2026-06-01弃用重要2 个来源印证

Gemini 2.0 Flash 和 Flash-Lite 系列模型正式关闭

Google 于 2026 年 6 月 1 日正式关闭 Gemini 2.0 Flash、Flash-001、Flash-Lite、Flash-Lite-001 四个模型端点,标志着 Gemini 2.0 Flash 系列全面完成退役。仍在使用上述模型的开发者需迁移至 gemini-3.5-flash 或 gemini-3.1-flash-lite,否则服务将中断。此举表明 Google 已完成从 2.0 到 3.x 代际的全面切换,加速推动开发者向新一代模型迁移。

2026-05-29其他常规

Google 发布使用 AI Studio 进行 vibe coding 构建问答游戏案例

Google 发布了一篇博客文章,展示如何使用 Google AI Studio 以 vibe coding 的方式快速构建一个关于 I/O 2026 公告的问答游戏。这是一篇产品能力展示类内容,通过实际案例直观呈现了 AI Studio 在低代码/无代码快速原型构建方面的能力。虽然对市场格局无实质性影响,但有助于强化 Google 在 AI 开发工具领域的品牌认知,并为开发者提供了 vibe coding 的实践参考。

2026-05-29其他常规

Google AI Studio 氛围编码打造的 I/O 2026 问答测验上线

Google 发布了一个使用 Google AI Studio 氛围编码(vibe coding)功能构建的 I/O 2026 问答测验,展示了该工具创建交互式网页体验的能力。作为官方产品能力展示,间接向开发者传递了 AI 辅助开发工具的易用性和产品化程度,吸引开发者尝试该工具。

2026-05-28新发布里程碑2 个来源印证

Gemini 3.1 Flash Image 和 3 Pro Image 正式发布,新增视频转图像功能

Google 正式发布 gemini-3.1-flash-image(Nano Banana 2)和 gemini-3-pro-image(Nano Banana Pro)两款原生视觉图像生成模型。其中 gemini-3.1-flash-image 新增视频转图像生成能力,支持传入视频文件或 YouTube URL 自动生成缩略图、电影海报或信息图,实现跨模态内容创作。该功能目前仅限 gemini-3.1-flash-image 模型使用。此次发布进一步巩固了 Google 在多模态生成领域的技术领先地位。

2026-05-19新发布里程碑2 个来源印证

Gemini 3.5 Flash GA,Managed Agents 与 Antigravity Agent 公开预览

Google 于 2026 年 5 月 19 日发布多项重大更新。Gemini 3.5 Flash 正式 GA,成为 gemini-flash-latest 的底层模型,所有依赖 flash-latest 的用户自动获得升级。Managed Agents 在 Gemini API 中进入公开预览,支持在 Google 托管的 Linux 沙箱中构建自主有状态代理,将 Agent 运行时管理交由 Google 基础设施承担。同时发布 Antigravity Agent(antigravity-preview-05-2026)公开预览版,具备自主规划、推理、编写和执行代码、管理文件等全栈自主能力。此次发布标志着 Google 在 Agent 平台化方面迈出重要一步,将自主代理能力作为 API 产品直接提供。

2026-05-19能力增强重要2 条记录

Google I/O 2026 发布开发者工具与 AI Studio 重大更新

Google 在 I/O 2026 大会上集中发布了一系列面向开发者的重大更新。在 AI Studio 方面,推出了原生 Android vibe coding 支持、Google Workspace 深度集成以及 AI Studio 移动应用,使其从 Web 端工具扩展为跨平台、与企业办公套件绑定的 AI 开发平台。同时,大会还展示了 Google Antigravity 更新和增强版 Gemini API,提供从提示到生产就绪应用的原生工具链。这些更新覆盖了从快速原型构建到生产部署的全流程,显著降低了 AI 应用的开发门槛,强化了 Google 在端到端 AI 开发平台领域的竞争力。