← Voltar para Início

Todos os modelos

Catálogo completo de 64 modelos: chat de texto, raciocínio, visão, geração de imagem/video, voz, busca em IA, código, embeddings.

64
modelos
12
categorias
8
Grátis
⚠ Alguns modelos legados estão sendo descontinuados. Migre para versões mais novas.
Ir para Playground

Dados atualizados em agosto de 2026

Text & Chat

22

GLM-5.3

PrincipalNovo

Último modelo flagship e o mais capacitado para codificação: +50% a mais que o GLM-5.2 no Z.ai Code Bench, SOTA open-source no Terminal-Bench 3.0 e Agents' Last Exam, estado da arte no CyberGym (84.5) para descoberta de vulnerabilidades

Context: 1M Max Output: 128K
¥8 / 28 por milhão de tokens

GLM-5.3-Flash

NovoMultimodal

Primeiro modelo-5 multimodal nativo: 320B parâmetros totais / 18B ativos, primeiro modelo de fronteira aberto com atenção linear híbrida esparsa, visão nativa no ciclo de codificação, vence o GLM-5.2 a um décimo do preço

Context: 1M Max Output: 128K
¥0,8 / 2,8 por milhão de tokens

GLM-5.2

Raciocínio

Modelo de topo de geração anterior: 1M contexto sem perda, capacidade de codificação open-source SOTA de sua geração, suporta execução estável de tarefas longas e complexas — a base sobre a qual o GLM-5.3 pós-treinamento se constrói

Context: 1M Max Output: 128K
¥8 / 28 por milhão de tokens

GLM-5.1

Raciocínio

Capacidade de codificação alinhada com Claude Opus 4.6, significativa melhoria em tarefas de longo prazo, pode funcionar independentemente por até 8 horas.

Context: 200K Max Output: 128K
¥6 / 24 por milhão de tokens

GLM-5

Raciocínio

Capacidade de programação alinhada com Claude Opus 4.5, proficiente em planejamento e execução de longo prazo agente

Context: 200K Max Output: 128K
¥4 / 18 por milhão de tokens

GLM-5-Turbo

Raciocínio

Especial otimização para tarefas longas, boa continuidade na execução de tarefas complexas de longo prazo

Context: 200K Max Output: 128K
¥5 / 22 por milhão de tokens

GLM-4.7

Raciocínio

Upgrade completo de diálogo geral, raciocínio e capacidades do agente, programação mais forte e estável, melhor estética

Context: 200K Max Output: 128K
¥2 / 8 por milhão de tokens

GLM-4.7-FlashX

Luz

Leve e rápido, tamanho pequeno com alta capacidade, adequado para cenários gerais como escrita em chinês, tradução, role-playing, etc.

Context: 200K Max Output: 128K
¥0,5 / 3 por milhão de tokens

GLM-4.7-Flash

LuzGrátis

Modelo gratuito, proporcionando experiência inclusiva, estendendo as capacidades gerais do GLM-4.7 base

Context: 200K Max Output: 128K
Grátis

GLM-4.6

Contexto aumentado para 200K, proficiente em programação avançada, raciocínio complexo e invocação de ferramentas

Context: 200K Max Output: 128K
R$1 / 5 por milhão de tokens

GLM-4.5

Um modelo geral equilibrado de desempenho e custo, adequado para diálogo, análise e processamento de documentos

Context: 128K Max Output: 96K
¥2 / 8 por milhão de tokens

GLM-4.5-Air

Luz

Modelo leve de alta performance e econômico, com desempenho estável em inferência, codificação e tarefas de agente

Context: 128K Max Output: 96K
¥0,8 / 2 por milhão de tokens

GLM-4.5-AirX

Luz

Versão ultra-rápida e econômica de alto desempenho, adequada para cenários de negócios com baixa latência e alta resposta.

Context: 128K Max Output: 96K
R$1 / 4 por milhão de tokens

GLM-4.5-Flash

LuzGrátis

Modelo gratuito, suporta modo de pensamento profundo, suporta processamento de contexto de 128K

Context: 128K Max Output: 96K
Grátis

GLM-4-Long

Longo Ctx

Suporta comprimento de contexto de 1M, projetado para processar textos longos e tarefas intensivas em memória

Context: 1M Max Output: 4K
¥1 por milhão de tokens

GLM-4-Plus

Legado

Modelo flagship da quarta geração, capacidades completas fortes (versão antiga)

Context: 128K Max Output: 4K
¥5 por milhão de tokens

GLM-4-Air

LuzLegado

Modelo leve, alta velocidade e baixo custo (versão antiga)

Context: 128K Max Output: 4K
¥0,5 por milhão de tokens

GLM-4-AirX

LuzLegado

Versão leve e rápida, velocidade de resposta mais rápida (Versão Antiga)

Context: 128K Max Output: 4K
¥1 por milhão de tokens

GLM-4-Assistant

AgenteLegado

Modelo Específico do Agente, Otimizado para Cenários de Agente (Versão Antiga)

Context: 128K Max Output: 4K
¥5 por milhão de tokens

GLM-4-FlashX-250414

Luz

Versão de alta velocidade com aceleração Flash, velocidade de inferência rápida, adequada para cenários de chamadas de alta concorrência

Context: 128K Max Output: 16K
R$0,1 por milhão de tokens

GLM-4-Flash-250414

LuzGrátis

Modelo gratuito, suporta processamento de contexto longo, adequado para cenários de compreensão multilíngue e invocação de ferramentas

Context: 128K Max Output: 16K
Grátis

GLM-4-0520

LegadoDescontinuado

Modelo de Texto Flagship da Versão Antiga, Descontinuado em 30 de dezembro de 2025

Context: 128K Max Output: 4K
¥100 por milhão de tokens

Raciocínio Profundo

3

GLM-Z1-Air

Descontinuado

Modelo de Infariação Profunda, Versão de Alto Desempenho, descontinuado em 15 de novembro de 2025

Context: 128K Max Output: 16K
¥0,5 por milhão de tokens

GLM-Z1-AirX

Descontinuado

Modelo de Infariação Profunda, Versão Ultra-Rápida, descontinuado em 15 de novembro de 2025

Context: 32K Max Output: 16K
¥5 por milhão de tokens

GLM-Z1-FlashX

Descontinuado

Modelo de Infereência Profunda, Versão Rápida e Econômica, descontinuado em 15 de novembro de 2025

Context: 128K Max Output: 16K
R$0,1 por milhão de tokens

Visão & Multimodal

12

GLM-5V-Turbo

PrincipalNovo

Primeiro modelo base de agente multimodal, equilibrando compreensão visual, raciocínio e geração de código, suportando entradas multimodais de imagens, vídeos e texto

Context: 200K Max Output: 128K
¥5 / 22 por milhão de tokens

GLM-4.6V

Capacidade de raciocínio visual aprimorada, suportando nativamente chamadas de ferramentas e contextos longos, com efeitos de clonagem de código frontend mais estáveis

Context: 128K Max Output: 32K
R$1 / 3 por milhão de tokens

GLM-4.6V-FlashX

Luz

Modelo de raciocínio visual de alta performance, suporta invocação de ferramentas e contexto longo

Context: 128K Max Output: 32K
¥0,15 / 1,5 por milhão de tokens

GLM-4.6V-Flash

LuzGrátis

Modelo de raciocínio visual gratuito, suportando invocação de ferramentas e contexto longo, com alternância flexível de modo de pensamento

Context: 128K Max Output: 32K
Grátis

GLM-4.5V

Legado

Modelo de Entendimento Visual, Suportando Entrada de Arquivos de Imagem e Vídeo

Context: 64K Max Output:
¥2 / 6 por milhão de tokens

GLM-4.1V-Thinking-FlashX

Luz

Modelo de raciocínio visual leve, proficiente em entender cenas complexas e análise de múltiplos passos

Context: 64K Max Output: 16K
¥2 por milhão de tokens

GLM-4.1V-Thinking-Flash

LuzGrátis

Modelo de raciocínio visual gratuito, proficiente em entender cenas complexas e análise de múltiplos passos

Context: 64K Max Output: 16K
Grátis

GLM-4V-Plus-0111

Legado

Versão antiga do modelo de reconhecimento de imagem-texto-vídeo (versão antiga)

Context: 8K Max Output:
¥4 por milhão de tokens

GLM-4V-Flash

LuzGrátisLegado

Modelo de compreensão de imagem gratuito com capacidade básica de perguntas e respostas multimodais

Context: 16K Max Output: 1K
Grátis

GLM-4V

Legado

Modelo multimodal visual de primeira geração (versão antiga)

Context: 2K Max Output:
¥5 por milhão de tokens

GLM-OCR

OCR

Modelo leve de parsing de imagem-texto, equilibrando alta precisão e eficiência na compreensão de documentos, suportando parsing de layout complexo

Context: Max Output:
¥0,01 por cada mil tokens

AutoGLM-Phone

AgenteNovo

Framework de assistente inteligente móvel, suportando linguagem natural para completar tarefas de operação de aplicativo, cobrindo o conjunto completo de comandos de operação móvel

Context: 20K Max Output: 2K
¥0.04 每次

Geração de Imagens

5

GLM-Image

PrincipalNovo

Modelo de geração de imagens de topo de linha, mais forte na seguinte instrução complexa e geração intensiva em conhecimento, destacado na renderização de texto, especialmente para caracteres chineses

Context: 多分辨率 Max Output:
¥0.2 每次

CogView-4

Modelo de geração de imagens geral, geração de alta qualidade, expressão de estilo rica e diversificada, detalhes de imagem mais completos

Context: 多分辨率 Max Output:
¥0.06 每次

CogView-3-Plus

Modelo de geração de imagem aprimorado, melhoria na qualidade da imagem, suporta mais estilos artísticos

Context: 多分辨率 Max Output:
¥0.1 每次

CogView-3

Legado

Modelo de geração de imagem geral, suporta múltiplas resoluções e estilos (versão antiga)

Context: 多分辨率 Max Output:
¥0.06 每次

CogView-3-Flash

LuzGrátis

Modelo de geração de imagens gratuito, geração criativa flexível, velocidade de geração rápida

Context: 多分辨率 Max Output:
Grátis

Geração de Vídeo

5

CogVideoX-3

PrincipalNovo

Modelo de vídeo de bandeira de alta inteligência, com qualidade de imagem clara, maior conformidade de comando e simulação física, suportando a geração de primeiros e últimos frames

Context: 多分辨率 Max Output:
¥1 每次

Vidu Q1

Novo

Modelo de geração de vídeo de alta qualidade, com qualidade de imagem clara, transições suaves, expressão de estilo mais rica e pode reduzir a distorção da imagem

Context: 多分辨率 Max Output:
¥1 每次

Vidu 2

Modelo de vídeo de alta velocidade e baixo custo, com velocidade de geração rápida, conexão natural de primeiros e últimos frames e maior consistência com múltiplas imagens de referência

Context: 多分辨率 Max Output:
¥0.5 每次

CogVideoX-2

Modelo de Geração de Vídeo Padrão, Suportando Saída em Multi-Résolução

Context: 多分辨率 Max Output:
¥0.5 每次

CogVideoX-Flash

LuzGrátis

Modelo de geração de vídeo gratuito, suportando efeitos sonoros de IA, qualidade de imagem 4K, 60fps e comprimento máximo de vídeo de 10 segundos.

Context: 多分辨率 Max Output:
Grátis

Voz e Áudio

5

GLM-TTS

TTS

Modelo de síntese de voz, suportando geração de voz ultra-humana e expressão emocional, fornecendo interfaces de streaming e não-streaming

Context: Max Output:
¥0.5 每千字符

GLM-TTS-Clone

TTS

Modelo de clonagem de voz, capaz de gerar voz semelhante rapidamente em 3 segundos, suportando expressão emocional delicada

Context: Max Output:
¥0.2 每秒

GLM-ASR-2512

ASR

Modelo de reconhecimento de fala de alta precisão, com baixa taxa de erro de caractere, suportando vocabulário personalizado e diversas dialetos

Context: Max Output:
¥0.06 每分钟

GLM-4-Voice

Tempo Real

Modelo de diálogo de fala em tempo real, suportando compreensão e geração de fala em chinês e inglês, ajustável para emoção, tom e velocidade

Context: Max Output:
¥80 por milhão de tokens

GLM-Realtime

Tempo RealNovo

Modelo de áudio-vídeo em tempo real, suportando chamadas de vídeo e memória de diálogo a longo prazo, inferência em tempo real de texto, áudio e vídeo.

Context: Max Output:
¥0.04 每分钟

Código

1

CodeGeeX-4

Modelo de completamento de código, adequado para completamento automático de código e assistência no desenvolvimento, melhorando a eficiência da programação

Context: 128K Max Output: 32K
R$0,1 por milhão de tokens

Embedding

2

Embedding-3

Terceira geração de modelo vetorial, usado para aprimoramento da recuperação semântica, agrupamento, modelagem de tópicos e classificação, significativamente melhorando o efeito

Context: 8K Max Output:
¥0,5 por milhão de tokens

Embedding-2

Legado

Modelo vetorial de segunda geração, usado para aprimoramento de recuperação semântica, agrupamento e classificação (versão antiga)

Context: 8K Max Output:
¥0,5 por milhão de tokens

Reordenar

1

Reordenar

Modelo de reordenação de texto, calcula a pontuação de relevância do texto, otimiza a classificação e o efeito de correspondência do resultado de recuperação

Context: 4K Max Output:
¥0,8 por milhão de tokens

Caracter

2

CharGLM-4

Modelo de conversa animada, adequado para companheirismo emocional e interação com personagens virtuais, suportando expressões de personagens mais naturais

Context: 8K Max Output: 4K
¥1 por milhão de tokens

Emohaa

Modelo de suporte psicológico e emocional, com capacidades de aconselhamento profissional e orientação emocional, ajudando os usuários a entenderem as emoções e a lidarem com problemas

Context: 8K Max Output: 4K
¥15 por milhão de tokens

Open Source

2

GLM-4-9B

Open Source

Modelo de 9B parâmetros de código aberto, suporta 128K contexto, pode ser implantado localmente, licença MIT

Context: 128K Max Output:
Grátis e de código aberto

ChatGLM3-6B

Open SourceLegado

Terceira geração de modelo de diálogo de código aberto 6B, primeira geração da série ChatGLM, licença MIT

Context: 32K Max Output:
Grátis e de código aberto