← 返回首页

所有模型

全系列模型完整目录:64 款模型,涵盖文本对话、深度推理、视觉理解、图像生成、视频生成、语音音频、AI搜索、代码、向量模型。

64
款模型
12
个类别
8
免费
⚠ 部分旧版模型即将下线,建议迁移至新版本
前往体验场

数据更新于 2026 年 8 月

文本对话

22

GLM-5.3

旗舰

最新旗舰模型,编程能力最强的开放权重模型:Z.ai Code Bench 较 GLM-5.2 提升 50%,Terminal-Bench 3.0 与 Agents' Last Exam 开源 SOTA,漏洞发现基准 CyberGym 当前最佳(84.5)

上下文: 1M 最大输出: 128K
¥8 / 28 每百万tokens

GLM-5.3-Flash

多模态

GLM-5 系列首个原生多模态模型:总参数 320B / 激活 18B,首个采用稀疏+线性混合注意力的开源前沿模型,视觉能力原生融入 Coding 循环,以十分之一价格超越 GLM-5.2,Coding Plan 额度 3 倍

上下文: 1M 最大输出: 128K
¥0.8 / 2.8 每百万tokens

GLM-5.2

推理

上一代旗舰:1M 无损上下文,一代编程开源 SOTA,支撑复杂长程任务稳定执行 — GLM-5.3 后训练建立的基座

上下文: 1M 最大输出: 128K
¥8 / 28 每百万tokens

GLM-5.1

推理

Coding能力对齐Claude Opus 4.6,长程任务显著提升,可自主工作长达8小时

上下文: 200K 最大输出: 128K
¥6 / 24 每百万tokens

GLM-5

推理

编程能力对齐Claude Opus 4.5,擅长Agentic长程规划与执行

上下文: 200K 最大输出: 128K
¥4 / 18 每百万tokens

GLM-5-Turbo

推理

长任务专项优化,复杂长任务执行连续性好

上下文: 200K 最大输出: 128K
¥5 / 22 每百万tokens

GLM-4.7

推理

通用对话、推理与智能体能力全面升级,编程更强更稳,审美更好

上下文: 200K 最大输出: 128K
¥2 / 8 每百万tokens

GLM-4.7-FlashX

轻量

轻量高速,小尺寸强能力,适用于中文写作、翻译、角色扮演等通用场景

上下文: 200K 最大输出: 128K
¥0.5 / 3 每百万tokens

GLM-4.7-Flash

轻量免费

免费模型,提供普惠体验,延续GLM-4.7基座的通用能力

上下文: 200K 最大输出: 128K
免费

GLM-4.6

上下文提升至200K,擅长高级编码、复杂推理与工具调用

上下文: 200K 最大输出: 128K
¥1 / 5 每百万tokens

GLM-4.5

均衡性能与成本的通用模型,适用于对话、分析和文档处理

上下文: 128K 最大输出: 96K
¥2 / 8 每百万tokens

GLM-4.5-Air

轻量

高性价比轻量模型,推理、编码与智能体任务表现稳定

上下文: 128K 最大输出: 96K
¥0.8 / 2 每百万tokens

GLM-4.5-AirX

轻量

高性价比极速版本,适合低延迟、高响应要求的业务场景

上下文: 128K 最大输出: 96K
¥1 / 4 每百万tokens

GLM-4.5-Flash

轻量免费

免费模型,支持深度思考模式,支持128K上下文处理

上下文: 128K 最大输出: 96K
免费

GLM-4-Long

超长

支持1M上下文长度,为处理超长文本和记忆型任务设计

上下文: 1M 最大输出: 4K
¥1 每百万tokens

GLM-4-Plus

旧版

第四代旗舰模型,综合性能力强(旧版)

上下文: 128K 最大输出: 4K
¥5 每百万tokens

GLM-4-Air

轻量旧版

轻量版模型,速度快成本低(旧版)

上下文: 128K 最大输出: 4K
¥0.5 每百万tokens

GLM-4-AirX

轻量旧版

轻量极速版,更快响应速度(旧版)

上下文: 128K 最大输出: 4K
¥1 每百万tokens

GLM-4-Assistant

智能体旧版

Agent专用模型,为智能体场景优化(旧版)

上下文: 128K 最大输出: 4K
¥5 每百万tokens

GLM-4-FlashX-250414

轻量

Flash增强高速版本,推理速度快,适合高并发调用场景

上下文: 128K 最大输出: 16K
¥0.1 每百万tokens

GLM-4-Flash-250414

轻量免费

免费模型,支持长上下文处理,适合多语言理解与工具调用场景

上下文: 128K 最大输出: 16K
免费

GLM-4-0520

旧版即将下线

旧版旗舰文本模型,2025年12月30日弃用

上下文: 128K 最大输出: 4K
¥100 每百万tokens

深度推理

3

GLM-Z1-Air

即将下线

深度推理模型,高性能版本,2025年11月15日弃用

上下文: 128K 最大输出: 16K
¥0.5 每百万tokens

GLM-Z1-AirX

即将下线

深度推理模型极速版,2025年11月15日弃用

上下文: 32K 最大输出: 16K
¥5 每百万tokens

GLM-Z1-FlashX

即将下线

深度推理模型,快速低成本版本,2025年11月15日弃用

上下文: 128K 最大输出: 16K
¥0.1 每百万tokens

视觉理解

12

GLM-5V-Turbo

旗舰

首个多模态Agent基座模型,兼顾视觉理解、推理与代码生成,支持图片、视频、文本多模态输入

上下文: 200K 最大输出: 128K
¥5 / 22 每百万tokens

GLM-4.6V

视觉推理能力增强,原生支持工具调用与长上下文,前端代码复刻效果更稳定

上下文: 128K 最大输出: 32K
¥1 / 3 每百万tokens

GLM-4.6V-FlashX

轻量

高性价比视觉推理模型,支持工具调用与长上下文

上下文: 128K 最大输出: 32K
¥0.15 / 1.5 每百万tokens

GLM-4.6V-Flash

轻量免费

免费视觉推理模型,支持工具调用与长上下文,可灵活开关思考模式

上下文: 128K 最大输出: 32K
免费

GLM-4.5V

旧版

视觉理解模型,支持图片与视频文件输入

上下文: 64K 最大输出:
¥2 / 6 每百万tokens

GLM-4.1V-Thinking-FlashX

轻量

轻量视觉推理模型,擅长复杂场景理解与多步骤分析

上下文: 64K 最大输出: 16K
¥2 每百万tokens

GLM-4.1V-Thinking-Flash

轻量免费

免费视觉推理模型,擅长复杂场景理解与多步骤分析

上下文: 64K 最大输出: 16K
免费

GLM-4V-Plus-0111

旧版

旧版图文视频识别模型(旧版)

上下文: 8K 最大输出:
¥4 每百万tokens

GLM-4V-Flash

轻量免费旧版

免费图像理解模型,具备基础多模态问答能力

上下文: 16K 最大输出: 1K
免费

GLM-4V

旧版

初代多模态视觉模型(旧版)

上下文: 2K 最大输出:
¥5 每百万tokens

GLM-OCR

OCR

轻量图文解析模型,兼顾高精度高效率文档理解,支持复杂版式解析

上下文: 最大输出:
¥0.01 每千tokens

AutoGLM-Phone

智能体

手机智能助理框架,支持自然语言完成App操作任务,覆盖完整移动端操作指令集

上下文: 20K 最大输出: 2K
¥0.04 每次

图像生成

5

GLM-Image

旗舰

旗舰图像生成模型,复杂指令遵循与知识密集生成更强,文字渲染突出,汉字尤其出色

上下文: 多分辨率 最大输出:
¥0.2 每次

CogView-4

通用图像生成模型,生成质量高,风格表达丰富多样,画面细节更完整

上下文: 多分辨率 最大输出:
¥0.06 每次

CogView-3-Plus

增强版图像生成模型,画质提升,支持更多艺术风格

上下文: 多分辨率 最大输出:
¥0.1 每次

CogView-3

旧版

通用图像生成模型,支持多种分辨率和风格(旧版)

上下文: 多分辨率 最大输出:
¥0.06 每次

CogView-3-Flash

轻量免费

免费图像生成模型,创意生成灵活,生成速度快

上下文: 多分辨率 最大输出:
免费

视频生成

5

CogVideoX-3

旗舰

高智能旗舰视频模型,画质清晰、指令遵循与物理模拟更强,支持首尾帧生成

上下文: 多分辨率 最大输出:
¥1 每次

Vidu Q1

高质量视频生成模型,画质清晰,转场流畅,风格表达更丰富,可减少画面崩坏

上下文: 多分辨率 最大输出:
¥1 每次

Vidu 2

高速低价视频模型,生成速度快,首尾帧衔接自然,多参考图一致性更强

上下文: 多分辨率 最大输出:
¥0.5 每次

CogVideoX-2

标准视频生成模型,支持多分辨率输出

上下文: 多分辨率 最大输出:
¥0.5 每次

CogVideoX-Flash

轻量免费

免费视频生成模型,支持AI音效、4K画质与60fps,最长10秒视频

上下文: 多分辨率 最大输出:
免费

语音与音频

5

GLM-TTS

TTS

语音合成模型,支持超拟人语音生成与情感表达,提供流式与非流式接口

上下文: 最大输出:
¥0.5 每千字符

GLM-TTS-Clone

TTS

音色克隆模型,3秒音频即可快速生成相似音色,支持细腻情感表达

上下文: 最大输出:
¥0.2 每秒

GLM-ASR-2512

ASR

高精度语音识别模型,字符错误率低,支持自定义词汇与多种方言

上下文: 最大输出:
¥0.06 每分钟

GLM-4-Voice

实时

实时语音对话模型,支持中英文语音理解与生成,可调整情感、语调、语速

上下文: 最大输出:
¥80 每百万tokens

GLM-Realtime

实时

实时音视频模型,支持视频通话与长时对话记忆,跨文本、音频和视频实时推理

上下文: 最大输出:
¥0.04 每分钟

代码

1

CodeGeeX-4

代码补全模型,适用于代码自动补全与开发辅助,提升编码效率

上下文: 128K 最大输出: 32K
¥0.1 每百万tokens

向量模型

2

Embedding-3

第三代向量模型,用于语义检索增强、聚类、主题建模和分类,效果显著提升

上下文: 8K 最大输出:
¥0.5 每百万tokens

Embedding-2

旧版

第二代向量模型,用于语义检索增强、聚类和分类(旧版)

上下文: 8K 最大输出:
¥0.5 每百万tokens

重排序

1

Rerank

文本重排序模型,计算文本相关性score值,优化召回结果排序与匹配效果

上下文: 4K 最大输出:
¥0.8 每百万tokens

角色扮演

2

CharGLM-4

拟人对话模型,适合情感陪伴与虚拟角色互动,支持更自然的人设化表达

上下文: 8K 最大输出: 4K
¥1 每百万tokens

Emohaa

心理情感支持模型,具备专业咨询与情绪疏导能力,帮助用户理解情感、应对问题

上下文: 8K 最大输出: 4K
¥15 每百万tokens

开源模型

2

GLM-4-9B

开源

开源9B参数模型,支持128K上下文,可本地部署,MIT许可证

上下文: 128K 最大输出:
开源免费

ChatGLM3-6B

开源旧版

第三代开源6B对话模型,初代ChatGLM系列,MIT许可证

上下文: 32K 最大输出:
开源免费