model
智谱 GLM
直接答案智谱官方当前推荐 GLM-5.2 处理长程文本与 Coding、GLM-5V-Turbo 处理视觉 Coding、GLM-Image 处理图像生成,并提供多类专用模型。
更新 · 审核信息
官方当前产品线
智谱模型概览当前推荐 GLM-5.2、GLM-5V-Turbo 与 GLM-Image,并分别列出文本、视觉、图像、视频、音视频、向量和角色模型。不同类别不是同一个对话模型的开关。
能力划分
GLM-5.2 面向长程任务与工程交付;视觉型号处理图像/视频理解和多模态工具;GLM-Image、CogVideoX、TTS/ASR 等使用各自生成或处理接口。官方表格给出每个型号的上下文和输出。
如何选择
复杂代码和 Agent 先评估旗舰文本模型,图形界面理解或图文代码使用视觉型号,中文文字图像使用图像模型,音视频任务选择专用资源。不要把免费或 Flash 版本用于未经评测的高价值任务。
API 使用
文本对话通过 /v1/chat/completions 及 Bearer 令牌;媒体或异步任务使用对应专用路径。思考、工具、结构化输出和上下文缓存按具体型号启用。
生命周期
官方概览会标记即将弃用型号。上线前核验精确版本、上下文与输出、思考开关、媒体限制、并发、计费、备案与数据处理政策。
适用场景
- 智能体和代码
- 长上下文
- 视觉生成
API 协议
/v1/chat/completions
FAQ
模型名是否固定?
否。官方别名可能移动,平台启用的精确 API ID 也会变化;生产应固定已验证 ID,并在模型广场单独确认可用性。
GLM 文本、视觉、图像和音视频模型能互相替代吗?
不能。文本与 Agent、视觉理解、图像生成、视频和语音是不同模型类别,输入模态、上下文和输出协议不同。应按任务选择专用型号,并用真实样本验证质量、延迟和限制。
GLM 的 OpenAI 兼容对话能调用所有媒体任务吗?
不能。文本对话可使用 Chat Completions,图像、视频、TTS/ASR 等媒体或异步任务使用各自接口;思考、工具、结构化输出和缓存也必须按精确模型启用。
关联指南
官方来源
- GLM Overview Official
兔子API