4
里程碑
32
重要更新
6
常规动态
智谱新增搜索工具服务产品线及定价
智谱 BigModel 平台新增“搜索工具服务”独立产品线,提供 Search-Std(0.01元/次)、Search-Pro(0.03元/次)、Search-Pro-Sogou(0.05元/次)和 Search-Pro-Quark(0.05元/次)四种搜索工具,并推出新品限时 4 折体验包。此举将搜索能力与模型解耦,形成“模型+搜索插件”的产品组合,是国内模型厂商首次将搜索工具独立定价。
智谱旗舰模型区全线限时免费
智谱 BigModel 定价页面显示,旗舰模型区所有模型(包括 GLM-5.3/5.2/5.1/5-Turbo/5/4.7/4.5-Air/4.7-FlashX/5V-Turbo/4.6V/4.6V-FlashX/4.5V 等)均标注“限时免费”,并同时列出了限时免费结束后的正常价格。这是激进的市场获客策略,旨在降低开发者试错和迁移成本,短期内可能改变国内模型 API 市场的付费格局。
智谱 GLM-4.6V-Flash 视觉模型免费开放
智谱 BigModel 定价页面显示,GLM-4.6V-Flash 视觉理解模型输入输出均标注为完全免费,支持图片、视频文件和文本输入。免费多模态视觉模型的开放进一步降低了 AI 视觉应用的门槛,适合图像和视频理解的原型开发,与 Google Gemini Flash 的免费策略形成对标。
智谱 GLM-4.7-FlashX 新增 200K 上下文版本
智谱 BigModel 上架 GLM-4.7-FlashX 的 200K 上下文版本,定价为输入 0.5元/百万 tokens、输出 3元/百万 tokens,限时免费结束后价格为 0.1元/百万 tokens。FlashX 系列以极低价格提供 200K 长上下文能力,在低价长上下文赛道形成竞争压力,适合大规模文档处理和长对话等预算有限的场景。
智谱 GLM-4.5-Air 新增按输出长度分档定价
智谱 BigModel 为 GLM-4.5-Air 模型新增按输入和输出长度双重分档的定价策略。在输入 [0,32) 且输出 [0,0.2) 的短输出场景下,价格降至 0.8元/2元(限时免费后 0.16元/百万 tokens),相比长输出场景的 6 元降幅达 67%。此举进一步强化了 Air 模型的高性价比定位,大幅降低了短输出场景的 API 调用成本。
智谱 GLM-4.7/5/5.1/5-Turbo 新增长度分档定价
智谱BigModel平台对旗下多款模型更新定价策略,新增按输入/输出长度分档计费。GLM-5.1、GLM-5-Turbo、GLM-5新增输入长度分档定价(以32K为界),短输入场景价格更优;GLM-4.7新增输入与输出长度双重分档定价,短输出场景成本显著降低。此举旨在优化长文本推理成本结构,并引导开发者在Agent等场景中控制输出长度。
智谱发布旗舰模型 GLM-5.3 及配套 API、Coding Plan 与安全能力
智谱正式发布旗舰模型 GLM-5.3,基于纯后训练提升,在编程、长程任务和网络安全能力上达到开源 SOTA 并展现涌现能力(如 CyberGym 超越 GPT-5.6 Sol)。GLM-5.3 强制启用思考功能(low/high/max),支持 1M 上下文、Function Calling 及多协议 API。同时推出基于积分的 Coding Plan 非高峰半价策略,建立 Z.ai 安全漏洞披露台账,并在真实项目中发掘 2436 个漏洞。
智谱提供注册即享2000万tokens免费试用额度
智谱BigModel平台推出新用户注册即享2000万tokens免费试用额度的活动,旨在降低开发者评估模型和进行原型开发的门槛,吸引开发者入驻。该额度与行业主流免费试用规模处于同一量级。
智谱MaaS平台提供全模态模型服务与全流程开发套件
智谱MaaS平台整合了全模态大模型API服务(含GLM-5.2、GLM-5V-Turbo等)、快速模型微调、AI搜索工具、通用翻译及多种智能体应用,提供从模型到应用的一体化全流程开发套件,以降低AI应用开发门槛并提升开发者粘性。
智谱推出AutoGLM智能体模型
智谱推出AutoGLM智能体模型,具备自主规划、推理与执行能力,并支持持续自我改进。该模型致力于解决任务规划、数据稀缺和策略优化等核心难题,将Agent能力从工具调用提升至自主规划与认知层面,适用于复杂多步骤任务的自动化。
智谱推出专为Agent场景打造的GLM-5-Turbo基座模型
智谱推出GLM-5-Turbo基座模型,从训练层深度优化Agent核心能力,大幅提升工具调用与长链路执行能力。这表明Agent能力优化正从应用层下沉至模型训练层,为开发者提供更可靠的专用基座模型。
智谱发布旗舰模型 GLM-5.2,支持 1M 上下文并限时免费
智谱推出面向长任务时代的旗舰文本模型 GLM-5.2,支持真正可用的 1M 上下文窗口,可承载项目级工程上下文。该模型输入价格 8 元/百万 tokens,输出 28 元/百万 tokens,当前处于限时免费阶段(折扣后约 2 元/百万 tokens)。
智谱 BigModel 开放平台 API 文档发布与开发生态集成
智谱大模型开放平台 bigmodel.cn 于 2026 年 8 月 15 日发布完整 API 服务文档,涵盖文本、视觉、图像、视频及音频模型的调用、专属资源部署、微调、评测、联网搜索及知识库检索等一站式 MaaS 能力。平台同时明确支持标准 RESTful API、官方 Python/Java SDK,并特别强调兼容 OpenAI SDK 以及集成 LangChain 框架,以降低开发者迁移成本和构建复杂 Agent 应用的门槛。兼容 OpenAI SDK 已成为国内模型厂商争夺存量开发者的标配策略,LangChain 集成则表明平台正积极适配主流 Agent 开发范式,争夺 AI 应用层生态位。Java SDK 的高并发支持利好企业级后端集成场景。
智谱 GLM-5/5.1/5-Turbo 系列模型上线并按上下文分段计费
除 GLM-5.2 外,智谱同步上线 GLM-5、GLM-5.1、GLM-5-Turbo 三款新模型,均采用上下文长度分段计费:32K 以下输入 4-6 元/百万 tokens,32K 以上 6-8 元/百万 tokens。所有新模型当前均有限时免费优惠。
智谱推出云端私有化年套餐,GLM-4.5 年费 110 万元
针对长期稳定私有化部署客户,智谱推出云端私有化年套餐:GLM-4.5 套餐含 5840 算力单元/年 + 10 亿 tokens 训练额度,售价 110 万元/年;GLM-4.5-Air 套餐同规格售价 50 万元/年。增购算力单元 60-70 元/天,增购训练额度另计。
智谱上线搜索工具服务 API,含自研及搜狗/夸克聚合
智谱推出 Search-Std(0.01 元/次)、Search-Pro(0.03 元/次)自研搜索 API,并聚合搜狗搜索与夸克搜索(均为 0.05 元/次),为 Agent 提供标准化联网检索能力。新品上线限时 4 折体验包。
智谱 GLM-4.7-Flash 200K 模型永久免费开放
智谱将 GLM-4.7-Flash 200K 版本设为永久免费,支持 200K 上下文窗口,输入输出均不收费。此前 Flash 系列已有免费策略,此次扩展至 200K 长上下文版本。
智谱发布首个多模态 Agent 基座模型 GLM-5V-Turbo
GLM-5V-Turbo 定位为多模态 Agent 基座,支持图像、视频、文本与文件等多模态输入,强化视觉理解、长程规划与动作执行能力,旨在融入 Agent 工作流完成「感知→规划→执行」闭环。输入价格 5-7 元/百万 tokens,限时优惠至 1.2-1.8 元。
智谱发布 GLM-5.2 文本生成模型
智谱在 HuggingFace 发布 GLM-5.2 文本生成模型,作为 GLM-5 系列的最新迭代版本。这表明智谱在持续迭代其旗舰文本模型,保持与大模型竞争节奏同步,面向开发者提供最新的文本生成能力。具体参数量、基准评测成绩及架构变化等细节尚未披露。
智谱发布 SCAIL-2 图生视频模型
智谱在 HuggingFace 发布 SCAIL-2 图像到视频生成模型,为 SCAIL 系列第二代产品。该模型进一步巩固了智谱在多模态视频生成领域的布局,面向内容创作者和视频制作者提供静态图像生成动态视频的能力。视频时长上限、分辨率及与上一代差异等技术参数尚未说明。
智谱发布 GLM-5.1 文本生成模型
智谱在 HuggingFace 发布 GLM-5.1 文本生成模型,作为 GLM-5 系列的迭代版本。该发布填补了 GLM-5 到后续版本之间的迭代,表明智谱采用快速迭代策略以保持竞争力,面向 AI 开发者和企业用户提供升级的文本生成能力。具体改进点和参数量未披露。
智谱发布2025年度首份业绩报告
智谱(02513.HK)公布截至2025年12月31日止年度的全年业绩报告,这是其上市后的首份业绩报告。报告同时提及探索AGI智能上界的战略方向。该发布为市场评估中国大模型公司的商业化路径、财务健康度及AGI战略提供了关键的基准参考。
智谱发布新一代旗舰模型 GLM-5
智谱在 HuggingFace 发布 GLM-5 文本生成模型,这是 GLM-4 系列之后的新一代旗舰模型,代表代际升级。该模型面向所有 AI 开发者和企业用户,可能涉及架构、性能和效率的全面升级。具体参数量、架构细节、训练数据及基准评测成绩等核心信息尚未披露。
智谱发布 GLM-OCR 多模态识别模型
智谱在 HuggingFace 发布 GLM-OCR 多模态图像文本识别模型,接收图像和文本输入并输出文本。这是智谱在 OCR 垂直领域的重要布局,面向文档数字化、票据识别等场景。识别精度、支持语言及与通用多模态模型的 OCR 能力差异尚未说明。
智谱发布 GLM-4.7-Flash 轻量级文本模型
智谱在 HuggingFace 发布 GLM-4.7-Flash 文本生成模型,作为 GLM-4.7 系列的轻量/快速版本。此举表明智谱正在布局低延迟、高性价比模型市场,面向对延迟敏感、需要高吞吐量文本生成的开发者和企业用户。具体参数量、推理速度及与完整版的性能差异未披露。
智谱发布 GLM-Image 文生图模型
智谱在 HuggingFace 发布 GLM-Image 文本到图像生成模型,标志着其从文本/多模态理解扩展到图像生成领域,与 Midjourney、Stable Diffusion 等形成竞争。该模型面向设计师、内容创作者和 AI 开发者,但分辨率、风格控制能力及开源商用策略等细节尚未明确。
智谱发布 GLM-4.7 文本生成模型
智谱在 HuggingFace 发布 GLM-4.7 文本生成模型,作为 GLM-4.6 的后续迭代版本。该模型维持了智谱在文本生成领域的竞争力,面向 AI 开发者和企业用户提供升级的文本生成能力。具体参数量、基准测试结果及与上一代的具体改进点尚未披露。
智谱在 HuggingFace 发布 RealVideo 全模态模型
2025年12月11日,智谱在 HuggingFace 平台发布了 RealVideo 全模态模型。该模型采用任意到任意(any-to-any)架构,支持多种输入输出模态之间的转换,面向视频创作者和 AI 开发者提供多模态视频生成与编辑能力。RealVideo 的 any-to-any 设计在视频生成领域具有差异化特点,可能推动全模态视频生成的技术方向。目前关于该模型的具体模态组合、视频时长、分辨率以及与智谱 SCAIL 系列模型的关系等细节尚未明确披露。
智谱发布 GLM-TTS 文本到语音合成模型
智谱于 2025 年 12 月 10 日在 HuggingFace 发布 GLM-TTS 文本到语音合成模型。该模型的发布标志着智谱正式进入语音合成领域,丰富了其多模态产品矩阵,与现有语音 AI 厂商形成竞争。高质量的 TTS 模型在有声内容制作、智能语音助手、虚拟数字人及无障碍应用等场景中不可或缺,GLM-TTS 的推出使得智谱能够提供从文本、视觉到语音的全链路 AI 能力。面向需要语音合成能力的开发者。音色数量、支持语言、自然度指标及实时性等细节尚未说明。
智谱发布 GLM-ASR-Nano-2512 轻量级语音识别模型
智谱于 2025 年 12 月 9 日在 HuggingFace 发布 GLM-ASR-Nano-2512 自动语音识别模型。Nano 命名暗示其为轻量级 ASR 模型,使智谱的语音 AI 能力覆盖语音识别和合成两端,完善了语音模态布局。轻量级 ASR 模型在端侧部署、低功耗设备及实时转写场景中具有显著优势,适用于会议记录、语音助手和字幕生成等应用。该模型的发布为开发者提供了更灵活的语音转文字解决方案。具体参数量、识别精度、支持语言及与更大 ASR 模型的关系尚未说明。
智谱发布 AutoGLM-Phone-9B-Multilingual 多语言手机 Agent 模型
智谱于 2025 年 12 月 9 日在 HuggingFace 发布 AutoGLM-Phone-9B-Multilingual 模型。作为 AutoGLM-Phone-9B 的多语言扩展版本,该模型扩大了 AutoGLM 的潜在用户群,推动手机 Agent 技术在全球市场的应用。多语言支持使得非中文市场的开发者也能将其应用于多语言手机操作场景,助力中国 AI 技术的出海与全球化布局,满足不同国家和地区用户的本地化交互需求。具体支持的语言种类、各语言操作精度及与原版性能差异尚未说明。
智谱发布 AutoGLM-Phone-9B 手机操作 Agent 模型
智谱于 2025 年 12 月 8 日在 HuggingFace 发布 AutoGLM-Phone-9B 手机操作 Agent 模型。该模型基于视觉理解(image-text-to-text)来操作手机界面,9B 的参数规模展示了小模型在 Agent 场景的潜力,与 Apple Intelligence、Google Gemini 的手机操作能力形成直接竞争。手机端 Agent 能够代替用户执行复杂的跨应用操作,极大提升智能手机的交互体验,面向手机应用开发者、自动化测试工程师和终端用户。具体操作成功率、支持的应用范围及系统权限要求尚未说明。
智谱发布 GLM-4.6V 及 Flash 版多模态视觉语言模型
智谱于 2025 年 12 月 7 日在 HuggingFace 同时发布了 GLM-4.6V 和 GLM-4.6V-Flash 两款多模态视觉语言模型。GLM-4.6V 作为 GLM-4.6 的视觉增强版本,适用于文档分析、图像问答和视觉推理等场景;GLM-4.6V-Flash 则为轻量级版本,为对延迟敏感的应用提供低延迟选项,适用于实时图像理解和移动端部署。两者的发布增强了智谱在多模态理解领域的竞争力,与 GPT-4V、Gemini Vision 等形成对标,满足了不同算力与延迟要求下的业务需求。具体参数量、视觉编码器细节及基准评测成绩尚未说明。
智谱发布 WebVIA-Agent 网页视觉交互模型
智谱于 2025 年 11 月 12 日在 HuggingFace 发布 WebVIA-Agent 网页视觉交互 Agent 模型。该模型基于视觉理解来操作网页界面,与 AutoGLM-Phone 形成手机与网页的 Agent 矩阵,展示了智谱在 GUI Agent 领域的系统布局。网页自动化在数据采集、表单填写、自动化测试及 RPA(机器人流程自动化)场景中具有巨大商业价值,WebVIA-Agent 的发布进一步丰富了智谱的 Agent 生态。面向网页自动化开发者。具体参数量、操作成功率及支持的浏览器环境尚未说明。
智谱发布 UI2Code_N 设计图转代码模型
智谱于 2025 年 11 月 11 日在 HuggingFace 发布 UI2Code_N 模型。该模型致力于将 UI 设计图转换为代码,是智谱在代码生成与设计自动化交叉领域的布局,旨在加速从设计稿到代码的工作流程。在前端开发中,设计稿还原通常耗费大量人力,UI2Code_N 的推出有望大幅提升研发效率,与设计工具和前端开发工具形成互补或竞争。该模型面向前端开发者和 UI 设计师。支持的前端框架、代码质量、生成精度及是否支持多平台等细节尚未说明。
智谱发布 Kaleido-14B-S2V 多模态转换模型
智谱于 2025 年 10 月 27 日在 HuggingFace 发布 Kaleido-14B-S2V 模型。模型 ID 表明其参数规模为 14B,S2V 可能指代 Speech-to-Video 或类似的多模态转换任务,展示了智谱在跨模态转换(特别是语音到视频方向)的技术探索。随着短视频和数字人业务的爆发,语音直接驱动视频生成的需求日益增长,该模型为多模态 AI 开发者和研究者提供了新的技术选项,有助于降低视频内容的制作门槛。具体任务类型、性能指标及 S2V 的确切含义尚未说明。
智谱发布 Glyph 图像文本生成模型
智谱于 2025 年 10 月 25 日在 HuggingFace 发布 Glyph 模型。该模型为图像文本生成类型(image-text-to-text),可能专注于文字渲染、字形识别或排版等细分领域,体现了智谱在视觉领域的精细化布局。在复杂的文档解析、海报设计及视觉内容生成中,精准的文字渲染与识别是核心痛点,Glyph 模型的推出有望解决这一难题。该模型面向需要文字渲染、字形识别或图像中文字处理的开发者和设计师。具体功能定位、与 GLM-OCR 的差异及应用场景尚未明确说明。
智谱在 HuggingFace 发布 GLM-4.6 文本生成模型
智谱于 2025 年 9 月 29 日在 HuggingFace 发布 GLM-4.6 文本生成模型。作为 GLM-4 系列的重要迭代版本,该模型维持了智谱在文本生成领域的竞争力,面向 AI 开发者和企业用户提供升级的文本生成能力。此次发布体现了智谱在基础大模型领域的持续演进,通过不断优化文本生成质量与逻辑推理能力,巩固其在国内大模型市场的第一梯队地位。开发者可利用该模型构建更智能的对话系统、内容生成工具及企业级知识库应用。具体参数量、基准测试结果及与前代版本的具体改进点尚未披露。
中关村自主大模型产业联盟召开第一次会员大会
中关村自主大模型产业联盟召开第一次会员大会,32家会员单位出席,会议由智谱董事长刘德兵主持,表决通过章程草案等。该联盟的成立标志着中国大模型产业在区域层面形成有组织的行业协作机制,智谱在其中扮演核心召集角色。
智谱开源GLM-PC基座模型CogAgent-9B
智谱开源GLM-PC的基座模型CogAgent-9B-20241220。该模型基于GLM-4V-9B训练,仅需屏幕截图作为输入即可完成Agent任务,无需HTML等文本信息。这降低了GUI Agent开发门槛,推动Agent生态向视觉交互范式演进。
智谱Agent OpenDay发布AutoGLM跨端进展及GLM-PC内测
智谱在Agent OpenDay上发布多项Agent新进展:AutoGLM支持跨app任务及超过50步的长步骤自主操作,并支持数十个网站的无人驾驶上网;同时GLM-PC启动内测,可像人一样操作计算机。这将Agent能力推进到长链路自主执行的新基线。
智谱与英特尔合作落地端侧智谱清言和CodeGeeX AI PC版
智谱与英特尔在AI PC领域深化合作,基于端云一体的模型产品矩阵,联合落地端侧智谱清言和CodeGeeX智能编程助手AIPC版。此举标志着大模型能力向消费硬件端延伸,为用户提供低延迟、隐私保护的端侧AI体验。