信号图谱

智谱 BigModel

中国 · 模型厂商

访问官方网站 ↗

4

里程碑

32

重要更新

6

常规动态

INTELLIGENCE TIMELINE

情报时间线 (20)

2026-08-21新发布重要

智谱新增搜索工具服务产品线及定价

智谱 BigModel 平台新增“搜索工具服务”独立产品线,提供 Search-Std(0.01元/次)、Search-Pro(0.03元/次)、Search-Pro-Sogou(0.05元/次)和 Search-Pro-Quark(0.05元/次)四种搜索工具,并推出新品限时 4 折体验包。此举将搜索能力与模型解耦,形成“模型+搜索插件”的产品组合,是国内模型厂商首次将搜索工具独立定价。

2026-08-21价格变动重要

智谱旗舰模型区全线限时免费

智谱 BigModel 定价页面显示,旗舰模型区所有模型(包括 GLM-5.3/5.2/5.1/5-Turbo/5/4.7/4.5-Air/4.7-FlashX/5V-Turbo/4.6V/4.6V-FlashX/4.5V 等)均标注“限时免费”,并同时列出了限时免费结束后的正常价格。这是激进的市场获客策略,旨在降低开发者试错和迁移成本,短期内可能改变国内模型 API 市场的付费格局。

2026-08-21价格变动重要

智谱 GLM-4.6V-Flash 视觉模型免费开放

智谱 BigModel 定价页面显示,GLM-4.6V-Flash 视觉理解模型输入输出均标注为完全免费,支持图片、视频文件和文本输入。免费多模态视觉模型的开放进一步降低了 AI 视觉应用的门槛,适合图像和视频理解的原型开发,与 Google Gemini Flash 的免费策略形成对标。

2026-08-21新发布重要

智谱 GLM-4.7-FlashX 新增 200K 上下文版本

智谱 BigModel 上架 GLM-4.7-FlashX 的 200K 上下文版本,定价为输入 0.5元/百万 tokens、输出 3元/百万 tokens,限时免费结束后价格为 0.1元/百万 tokens。FlashX 系列以极低价格提供 200K 长上下文能力,在低价长上下文赛道形成竞争压力,适合大规模文档处理和长对话等预算有限的场景。

2026-08-21价格变动常规

智谱 GLM-4.5-Air 新增按输出长度分档定价

智谱 BigModel 为 GLM-4.5-Air 模型新增按输入和输出长度双重分档的定价策略。在输入 [0,32) 且输出 [0,0.2) 的短输出场景下,价格降至 0.8元/2元(限时免费后 0.16元/百万 tokens),相比长输出场景的 6 元降幅达 67%。此举进一步强化了 Air 模型的高性价比定位,大幅降低了短输出场景的 API 调用成本。

2026-08-21价格变动常规4 条记录

智谱 GLM-4.7/5/5.1/5-Turbo 新增长度分档定价

智谱BigModel平台对旗下多款模型更新定价策略,新增按输入/输出长度分档计费。GLM-5.1、GLM-5-Turbo、GLM-5新增输入长度分档定价(以32K为界),短输入场景价格更优;GLM-4.7新增输入与输出长度双重分档定价,短输出场景成本显著降低。此举旨在优化长文本推理成本结构,并引导开发者在Agent等场景中控制输出长度。

2026-08-18新发布里程碑2 个来源印证

智谱发布旗舰模型 GLM-5.3 及配套 API、Coding Plan 与安全能力

智谱正式发布旗舰模型 GLM-5.3,基于纯后训练提升,在编程、长程任务和网络安全能力上达到开源 SOTA 并展现涌现能力(如 CyberGym 超越 GPT-5.6 Sol)。GLM-5.3 强制启用思考功能(low/high/max),支持 1M 上下文、Function Calling 及多协议 API。同时推出基于积分的 Coding Plan 非高峰半价策略,建立 Z.ai 安全漏洞披露台账,并在真实项目中发掘 2436 个漏洞。

2026-08-21其他常规

智谱提供注册即享2000万tokens免费试用额度

智谱BigModel平台推出新用户注册即享2000万tokens免费试用额度的活动,旨在降低开发者评估模型和进行原型开发的门槛,吸引开发者入驻。该额度与行业主流免费试用规模处于同一量级。

2026-08-21能力增强重要

智谱MaaS平台提供全模态模型服务与全流程开发套件

智谱MaaS平台整合了全模态大模型API服务(含GLM-5.2、GLM-5V-Turbo等)、快速模型微调、AI搜索工具、通用翻译及多种智能体应用,提供从模型到应用的一体化全流程开发套件,以降低AI应用开发门槛并提升开发者粘性。

2026-08-21新发布重要

智谱推出AutoGLM智能体模型

智谱推出AutoGLM智能体模型,具备自主规划、推理与执行能力,并支持持续自我改进。该模型致力于解决任务规划、数据稀缺和策略优化等核心难题,将Agent能力从工具调用提升至自主规划与认知层面,适用于复杂多步骤任务的自动化。

2026-08-21新发布重要

智谱推出专为Agent场景打造的GLM-5-Turbo基座模型

智谱推出GLM-5-Turbo基座模型,从训练层深度优化Agent核心能力,大幅提升工具调用与长链路执行能力。这表明Agent能力优化正从应用层下沉至模型训练层,为开发者提供更可靠的专用基座模型。

2026-08-12新发布里程碑2 个来源印证

智谱发布旗舰模型 GLM-5.2,支持 1M 上下文并限时免费

智谱推出面向长任务时代的旗舰文本模型 GLM-5.2,支持真正可用的 1M 上下文窗口,可承载项目级工程上下文。该模型输入价格 8 元/百万 tokens,输出 28 元/百万 tokens,当前处于限时免费阶段(折扣后约 2 元/百万 tokens)。

2026-08-15其他重要2 条记录

智谱 BigModel 开放平台 API 文档发布与开发生态集成

智谱大模型开放平台 bigmodel.cn 于 2026 年 8 月 15 日发布完整 API 服务文档,涵盖文本、视觉、图像、视频及音频模型的调用、专属资源部署、微调、评测、联网搜索及知识库检索等一站式 MaaS 能力。平台同时明确支持标准 RESTful API、官方 Python/Java SDK,并特别强调兼容 OpenAI SDK 以及集成 LangChain 框架,以降低开发者迁移成本和构建复杂 Agent 应用的门槛。兼容 OpenAI SDK 已成为国内模型厂商争夺存量开发者的标配策略,LangChain 集成则表明平台正积极适配主流 Agent 开发范式,争夺 AI 应用层生态位。Java SDK 的高并发支持利好企业级后端集成场景。

2026-08-12新发布重要

智谱 GLM-5/5.1/5-Turbo 系列模型上线并按上下文分段计费

除 GLM-5.2 外,智谱同步上线 GLM-5、GLM-5.1、GLM-5-Turbo 三款新模型,均采用上下文长度分段计费:32K 以下输入 4-6 元/百万 tokens,32K 以上 6-8 元/百万 tokens。所有新模型当前均有限时免费优惠。

2026-08-12价格变动常规

智谱推出云端私有化年套餐,GLM-4.5 年费 110 万元

针对长期稳定私有化部署客户,智谱推出云端私有化年套餐:GLM-4.5 套餐含 5840 算力单元/年 + 10 亿 tokens 训练额度,售价 110 万元/年;GLM-4.5-Air 套餐同规格售价 50 万元/年。增购算力单元 60-70 元/天,增购训练额度另计。

2026-08-12新发布常规

智谱上线搜索工具服务 API,含自研及搜狗/夸克聚合

智谱推出 Search-Std(0.01 元/次)、Search-Pro(0.03 元/次)自研搜索 API,并聚合搜狗搜索与夸克搜索(均为 0.05 元/次),为 Agent 提供标准化联网检索能力。新品上线限时 4 折体验包。

2026-08-12价格变动重要2 条记录

智谱 GLM-4.7-Flash 200K 模型永久免费开放

智谱将 GLM-4.7-Flash 200K 版本设为永久免费,支持 200K 上下文窗口,输入输出均不收费。此前 Flash 系列已有免费策略,此次扩展至 200K 长上下文版本。

2026-08-12新发布重要2 个来源印证

智谱发布首个多模态 Agent 基座模型 GLM-5V-Turbo

GLM-5V-Turbo 定位为多模态 Agent 基座,支持图像、视频、文本与文件等多模态输入,强化视觉理解、长程规划与动作执行能力,旨在融入 Agent 工作流完成「感知→规划→执行」闭环。输入价格 5-7 元/百万 tokens,限时优惠至 1.2-1.8 元。

2026-06-16新发布重要

智谱发布 GLM-5.2 文本生成模型

智谱在 HuggingFace 发布 GLM-5.2 文本生成模型,作为 GLM-5 系列的最新迭代版本。这表明智谱在持续迭代其旗舰文本模型,保持与大模型竞争节奏同步,面向开发者提供最新的文本生成能力。具体参数量、基准评测成绩及架构变化等细节尚未披露。

2026-06-09新发布重要

智谱发布 SCAIL-2 图生视频模型

智谱在 HuggingFace 发布 SCAIL-2 图像到视频生成模型,为 SCAIL 系列第二代产品。该模型进一步巩固了智谱在多模态视频生成领域的布局,面向内容创作者和视频制作者提供静态图像生成动态视频的能力。视频时长上限、分辨率及与上一代差异等技术参数尚未说明。