最新旗舰模型,编程能力最强的开放权重模型:Z.ai Code Bench 较 GLM-5.2 提升 50%,Terminal-Bench 3.0 与 Agents' Last Exam 开源 SOTA,漏洞发现基准 CyberGym 当前最佳(84.5)
GLM-5 系列首个原生多模态模型:总参数 320B / 激活 18B,首个采用稀疏+线性混合注意力的开源前沿模型,视觉能力原生融入 Coding 循环,以十分之一价格超越 GLM-5.2,Coding Plan 额度 3 倍
上一代旗舰:1M 无损上下文,一代编程开源 SOTA,支撑复杂长程任务稳定执行 — GLM-5.3 后训练建立的基座
Coding能力对齐Claude Opus 4.6,长程任务显著提升,可自主工作长达8小时
编程能力对齐Claude Opus 4.5,擅长Agentic长程规划与执行
长任务专项优化,复杂长任务执行连续性好
通用对话、推理与智能体能力全面升级,编程更强更稳,审美更好
轻量高速,小尺寸强能力,适用于中文写作、翻译、角色扮演等通用场景
免费模型,提供普惠体验,延续GLM-4.7基座的通用能力
上下文提升至200K,擅长高级编码、复杂推理与工具调用
均衡性能与成本的通用模型,适用于对话、分析和文档处理
高性价比轻量模型,推理、编码与智能体任务表现稳定
高性价比极速版本,适合低延迟、高响应要求的业务场景
免费模型,支持深度思考模式,支持128K上下文处理
支持1M上下文长度,为处理超长文本和记忆型任务设计
第四代旗舰模型,综合性能力强(旧版)
轻量版模型,速度快成本低(旧版)
轻量极速版,更快响应速度(旧版)
Agent专用模型,为智能体场景优化(旧版)
Flash增强高速版本,推理速度快,适合高并发调用场景
免费模型,支持长上下文处理,适合多语言理解与工具调用场景
旧版旗舰文本模型,2025年12月30日弃用
深度推理模型,高性能版本,2025年11月15日弃用
深度推理模型极速版,2025年11月15日弃用
深度推理模型,快速低成本版本,2025年11月15日弃用
首个多模态Agent基座模型,兼顾视觉理解、推理与代码生成,支持图片、视频、文本多模态输入
视觉推理能力增强,原生支持工具调用与长上下文,前端代码复刻效果更稳定
高性价比视觉推理模型,支持工具调用与长上下文
免费视觉推理模型,支持工具调用与长上下文,可灵活开关思考模式
视觉理解模型,支持图片与视频文件输入
轻量视觉推理模型,擅长复杂场景理解与多步骤分析
免费视觉推理模型,擅长复杂场景理解与多步骤分析
旧版图文视频识别模型(旧版)
免费图像理解模型,具备基础多模态问答能力
初代多模态视觉模型(旧版)
轻量图文解析模型,兼顾高精度高效率文档理解,支持复杂版式解析
手机智能助理框架,支持自然语言完成App操作任务,覆盖完整移动端操作指令集
旗舰图像生成模型,复杂指令遵循与知识密集生成更强,文字渲染突出,汉字尤其出色
通用图像生成模型,生成质量高,风格表达丰富多样,画面细节更完整
增强版图像生成模型,画质提升,支持更多艺术风格
通用图像生成模型,支持多种分辨率和风格(旧版)
免费图像生成模型,创意生成灵活,生成速度快
高智能旗舰视频模型,画质清晰、指令遵循与物理模拟更强,支持首尾帧生成
高质量视频生成模型,画质清晰,转场流畅,风格表达更丰富,可减少画面崩坏
高速低价视频模型,生成速度快,首尾帧衔接自然,多参考图一致性更强
标准视频生成模型,支持多分辨率输出
免费视频生成模型,支持AI音效、4K画质与60fps,最长10秒视频
语音合成模型,支持超拟人语音生成与情感表达,提供流式与非流式接口
音色克隆模型,3秒音频即可快速生成相似音色,支持细腻情感表达
高精度语音识别模型,字符错误率低,支持自定义词汇与多种方言
实时语音对话模型,支持中英文语音理解与生成,可调整情感、语调、语速
实时音视频模型,支持视频通话与长时对话记忆,跨文本、音频和视频实时推理
增强版AI搜索工具,深度检索网页信息,支持复杂查询与多轮搜索
标准AI搜索工具,快速检索网页信息,适合通用搜索场景
搜狗引擎搜索增强,结合搜狗搜索结果提供更精准的信息检索
夸克引擎搜索增强,结合夸克搜索结果提供更丰富的内容检索
代码补全模型,适用于代码自动补全与开发辅助,提升编码效率
第三代向量模型,用于语义检索增强、聚类、主题建模和分类,效果显著提升
第二代向量模型,用于语义检索增强、聚类和分类(旧版)
文本重排序模型,计算文本相关性score值,优化召回结果排序与匹配效果
拟人对话模型,适合情感陪伴与虚拟角色互动,支持更自然的人设化表达
心理情感支持模型,具备专业咨询与情绪疏导能力,帮助用户理解情感、应对问题
开源9B参数模型,支持128K上下文,可本地部署,MIT许可证
第三代开源6B对话模型,初代ChatGLM系列,MIT许可证