信号图谱
智谱 BigModel重要新发布2 个来源印证2026-08-12

智谱发布首个多模态 Agent 基座模型 GLM-5V-Turbo

Zhipu Unveils GLM-5V-Turbo, Its First Multimodal Agent Foundation Model

多模态Agent Runtime

EVENT SUMMARY

事件摘要

GLM-5V-Turbo 定位为多模态 Agent 基座,支持图像、视频、文本与文件等多模态输入,强化视觉理解、长程规划与动作执行能力,旨在融入 Agent 工作流完成「感知→规划→执行」闭环。输入价格 5-7 元/百万 tokens,限时优惠至 1.2-1.8 元。

ANALYST VIEW

中立分析

为什么重要

标志着大模型从单一感知向「感知→规划→执行」闭环的 Agent 基座演进。专为视觉编程与复杂任务场景优化,丰富了多模态 Agent 基础设施的市场供给,推动了 AI 代理在自动化工作流中的落地与应用。

影响对象

影响构建多模态 AI Agent 和自动化工作流的开发者与企业。他们可以利用该模型处理图像、视频等多模态输入,实现环境感知、任务规划到执行落地的完整闭环,并在限时优惠期间降低开发成本。

证据说明

原文直接证明了智谱发布了首个多模态 Agent 基座模型 GLM-5V-Turbo,支持多种模态输入,旨在完成「环境感知 → 任务规划 → 执行落地」闭环,并公布了标准价格与限时优惠价格。

不确定性

原文未提供该模型在视觉理解、长程规划与动作执行方面的具体评测指标,未说明支持的具体文件格式,也未明确限时优惠的截止日期。

SOURCES

2 个来源 · 3 条记录