← Regresar al Inicio

Todos los modelos

Catálogo completo de 64 modelos: chat de texto, razonamiento, visión, generación de imágenes/video, voz, búsqueda AI, código, embeddings.

64
Modelos
12
Categorías
8
Gratis
⚠ Algunos modelos heredados están siendo descontinuados. Migrar a versiones más nuevas.
Ir al Playground

Datos actualizados en agosto de 2026

Texto y Chat

22

GLM-5.3

PrincipalNuevo

Último modelo insignia y el modelo de pesos abiertos más capaz para la codificación: +50% sobre GLM-5.2 en el Terminal-Bench 3.0 y Agents' Last Exam, estado de la técnica en CyberGym (84.5) para la detección de vulnerabilidades

Context: 1M Max Output: 128K
¥8 / 28 por millón de tokens

GLM-5.3-Flash

NuevoMultimodal

Primer modelo-5 multimodal nativo: 320B parámetros totales / 18B parámetros activos, primer modelo frontera abierto con atención lineal híbrida sparse, visión nativa al ciclo de codificación, supera a GLM-5.2 a una décima parte del precio

Context: 1M Max Output: 128K
¥0.8 / 2.8 por millón de tokens

GLM-5.2

Razonamiento

Modelo insignia de la generación anterior: 1M contexto sin pérdida, capacidad de codificación de código abierto SOTA de su generación, admite la ejecución estable de tareas a largo plazo complejas — la base sobre la que GLM-5.3 post-entrenamiento se construye

Context: 1M Max Output: 128K
¥8 / 28 por millón de tokens

GLM-5.1

Razonamiento

Capacidad de codificación alineada con Claude Opus 4.6, mejora significativa en tareas a largo plazo, puede funcionar de manera independiente hasta 8 horas

Context: 200K Max Output: 128K
¥6 / 24 por millón de tokens

GLM-5

Razonamiento

Capacidad de programación alineada con Claude Opus 4.5, competente en planificación y ejecución de largo plazo agente

Context: 200K Max Output: 128K
¥4 / 18 por millón de tokens

GLM-5-Turbo

Razonamiento

Optimización especial para tareas largas, buena continuidad en la ejecución de tareas complejas a largo plazo

Context: 200K Max Output: 128K
¥5 / 22 por millón de tokens

GLM-4.7

Razonamiento

Mejora completa de la capacidad de diálogo general, razonamiento y agente, programación más fuerte y estable, mejor estética

Context: 200K Max Output: 128K
2 ¥ / 8 por millón de tokens

GLM-4.7-FlashX

Luminoso

Ligero y de alta velocidad, pequeño tamaño con gran capacidad, adecuado para escenarios generales como escritura en chino, traducción, rol, etc.

Context: 200K Max Output: 128K
¥0.5 / 3 por millón de tokens

GLM-4.7-Flash

LuminosoGratis

Modelo gratuito, proporcionando una experiencia inclusiva, extendiendo las capacidades generales del modelo base GLM-4.7

Context: 200K Max Output: 128K
Gratis

GLM-4.6

Contexto mejorado a 200K, competente en codificación avanzada, razonamiento complejo y invocación de herramientas

Context: 200K Max Output: 128K
1 ¥ / 5 por millón de tokens

GLM-4.5

Un modelo general equilibrado en rendimiento y costo, adecuado para diálogos, análisis y procesamiento de documentos

Context: 128K Max Output: 96K
2 ¥ / 8 por millón de tokens

GLM-4.5-Air

Luminoso

Modelo ligero de alto rendimiento y costo efectivo, con rendimiento estable en inferencia, codificación y tareas de agente

Context: 128K Max Output: 96K
¥0.8 / 2 por millón de tokens

GLM-4.5-AirX

Luminoso

Versión ultra-rápida de alto rendimiento y costo efectivo, adecuada para escenarios de negocios con baja latencia y alta respuesta

Context: 128K Max Output: 96K
¥1 / 4 por millón de tokens

GLM-4.5-Flash

LuminosoGratis

Modelo gratuito, admite modo de pensamiento profundo, admite procesamiento de contexto de 128K

Context: 128K Max Output: 96K
Gratis

GLM-4-Long

Contexto largo

Soporta una longitud de contexto de 1M, diseñado para procesar textos largos y tareas intensivas en memoria

Context: 1M Max Output: 4K
1 ¥ por millón de tokens

GLM-4-Plus

Legacy

Modelo insignia de cuarta generación, capacidades comprehensivas fuertes (versión antigua)

Context: 128K Max Output: 4K
5 ¥ por millón de tokens

GLM-4-Air

LuminosoLegacy

Modelo ligero, velocidad rápida y bajo costo (versión antigua)

Context: 128K Max Output: 4K
¥0.5 por millón de tokens

GLM-4-AirX

LuminosoLegacy

Versión ligera rápida, velocidad de respuesta más rápida (Versión antigua)

Context: 128K Max Output: 4K
1 ¥ por millón de tokens

GLM-4-Assistant

AgenteLegacy

Modelo específico de agente, optimizado para escenarios de agente (Versión antigua)

Context: 128K Max Output: 4K
5 ¥ por millón de tokens

GLM-4-FlashX-250414

Luminoso

Versión de alta velocidad mejorada con Flash, velocidad de inferencia rápida, adecuada para escenarios de llamadas de alta concurrencia

Context: 128K Max Output: 16K
0,1 ¥ por millón de tokens

GLM-4-Flash-250414

LuminosoGratis

Modelo gratuito, compatible con procesamiento de contexto largo, adecuado para escenarios de comprensión multilingüe e invocación de herramientas

Context: 128K Max Output: 16K
Gratis

GLM-4-0520

LegacyObsoleto

Modelo de texto insignia de versión antigua, discontinuado el 30 de diciembre de 2025

Context: 128K Max Output: 4K
¥100 por millón de tokens

Razonamiento Profundo

3

GLM-Z1-Air

Obsoleto

Modelo de Inferencia Profunda, Versión de Alto Rendimiento, retirado el 15 de noviembre de 2025

Context: 128K Max Output: 16K
¥0.5 por millón de tokens

GLM-Z1-AirX

Obsoleto

Modelo de Inferencia Profunda, Versión Ultra-Rápida, retirado el 15 de noviembre de 2025

Context: 32K Max Output: 16K
5 ¥ por millón de tokens

GLM-Z1-FlashX

Obsoleto

Modelo de Inferencia Profunda, Versión Rápida y Económica, retirado el 15 de noviembre de 2025

Context: 128K Max Output: 16K
0,1 ¥ por millón de tokens

Visión y Multimodal

12

GLM-5V-Turbo

PrincipalNuevo

Primer modelo base de agente multimodal, que equilibra la comprensión visual, la razón y la generación de código, admitiendo entradas multimodales de imágenes, videos y texto

Context: 200K Max Output: 128K
¥5 / 22 por millón de tokens

GLM-4.6V

Mejora de la capacidad de razonamiento visual, soportando llamadas de herramientas y contextos largos de manera nativa, con efectos de clonación de código de frontend más estables

Context: 128K Max Output: 32K
¥1 / 3 por millón de tokens

GLM-4.6V-FlashX

Luminoso

Modelo de Razonamiento Visual de Alto Rendimiento, soporta invocación de herramientas y contexto largo

Context: 128K Max Output: 32K
¥0.15 / 1.5 por millón de tokens

GLM-4.6V-Flash

LuminosoGratis

Modelo de razonamiento visual gratuito, compatible con invocación de herramientas y contexto largo, con cambio flexible de modo de pensamiento

Context: 128K Max Output: 32K
Gratis

GLM-4.5V

Legacy

Modelo de comprensión visual, que admite la entrada de archivos de imagen y video

Context: 64K Max Output:
2 ¥ / 6 por millón de tokens

GLM-4.1V-Thinking-FlashX

Luminoso

Modelo de razonamiento visual ligero, competente en la comprensión de escenas complejas y análisis de múltiples pasos

Context: 64K Max Output: 16K
2 ¥ por millón de tokens

GLM-4.1V-Thinking-Flash

LuminosoGratis

Modelo de razonamiento visual gratuito, competente en la comprensión de escenas complejas y análisis de múltiples pasos

Context: 64K Max Output: 16K
Gratis

GLM-4V-Plus-0111

Legacy

Versión antigua del modelo de reconocimiento de imágenes-texto-vídeo (versión antigua)

Context: 8K Max Output:
4 ¥ por millón de tokens

GLM-4V-Flash

LuminosoGratisLegacy

Modelo de comprensión de imágenes gratuito con capacidades básicas de pregunta-respuesta multimodal

Context: 16K Max Output: 1K
Gratis

GLM-4V

Legacy

Modelo multimodal visual de primera generación (versión antigua)

Context: 2K Max Output:
5 ¥ por millón de tokens

GLM-OCR

OCR

Modelo ligero de análisis de imágenes-texto, equilibrando alta precisión y eficiencia en la comprensión de documentos, soportando análisis de diseño complejo

Context: Max Output:
¥0.01 por cada mil tokens

AutoGLM-Phone

AgenteNuevo

Marco de asistente inteligente móvil, que admite el lenguaje natural para completar tareas de operación de aplicaciones, cubriendo el conjunto completo de comandos de operación móvil

Context: 20K Max Output: 2K
¥0.04 每次

Generación de Imágenes

5

GLM-Image

PrincipalNuevo

Modelo de generación de imágenes insignia, más fuerte en el seguimiento de instrucciones complejas y la generación intensiva en conocimientos, destacado en la renderización de texto, especialmente para caracteres chinos

Context: 多分辨率 Max Output:
¥0.2 每次

CogView-4

Modelo de generación de imágenes general, generación de alta calidad, expresión de estilo rica y diversa, detalles de imagen más completos

Context: 多分辨率 Max Output:
¥0.06 每次

CogView-3-Plus

Modelo de generación de imágenes mejorado, mejora la calidad de las imágenes, admite más estilos artísticos

Context: 多分辨率 Max Output:
¥0.1 每次

CogView-3

Legacy

Modelo de generación de imágenes general, admite múltiples resoluciones y estilos (versión antigua)

Context: 多分辨率 Max Output:
¥0.06 每次

CogView-3-Flash

LuminosoGratis

Modelo gratuito de generación de imágenes, generación creativa flexible, velocidad de generación rápida

Context: 多分辨率 Max Output:
Gratis

Generación de Vídeos

5

CogVideoX-3

PrincipalNuevo

Modelo de video insignia de alta inteligencia, con calidad de imagen clara, mayor cumplimiento de comandos y simulación física, que admite la generación de los primeros y últimos cuadros

Context: 多分辨率 Max Output:
¥1 每次

Vidu Q1

Nuevo

Modelo de generación de video de alta calidad, con calidad de imagen clara, transiciones suaves, expresión de estilo más rica y puede reducir la distorsión de la imagen

Context: 多分辨率 Max Output:
¥1 每次

Vidu 2

Modelo de video de alta velocidad y bajo costo, con velocidad de generación rápida, conexión natural entre el primer y el último cuadro, y mayor consistencia con múltiples imágenes de referencia

Context: 多分辨率 Max Output:
¥0.5 每次

CogVideoX-2

Modelo estándar de generación de video, que admite salida de múltiples resoluciones

Context: 多分辨率 Max Output:
¥0.5 每次

CogVideoX-Flash

LuminosoGratis

Modelo de generación de video gratuito, compatible con efectos de sonido AI, calidad de imagen 4K, 60fps, y una longitud máxima de video de 10 segundos

Context: 多分辨率 Max Output:
Gratis

Voz y Audio

5

GLM-TTS

TTS

Modelo de síntesis de voz, que admite generación de voz ultrahumana y expresión emocional, proporcionando interfaces de transmisión y no transmisión

Context: Max Output:
¥0.5 每千字符

GLM-TTS-Clone

TTS

Modelo de clonación de voz, capaz de generar una voz similar rápidamente en 3 segundos, soportando expresiones emocionales delicadas

Context: Max Output:
¥0.2 每秒

GLM-ASR-2512

ASR

Modelo de reconocimiento de voz de alta precisión, con baja tasa de error de caracteres, soporte para vocabulario personalizado y varios dialectos

Context: Max Output:
¥0.06 每分钟

GLM-4-Voice

Tiempo real

Modelo de diálogo de voz en tiempo real, compatible con comprensión y generación de voz en chino e inglés, ajustable en emoción, tono y velocidad

Context: Max Output:
80 ¥ por millón de tokens

GLM-Realtime

Tiempo realNuevo

Modelo de audio-video en tiempo real, compatible con llamadas de video y memoria de diálogo a largo plazo, inferencia en tiempo real de texto, audio y video cruzado

Context: Max Output:
¥0.04 每分钟

Código

1

CodeGeeX-4

Modelo de completación de código, adecuado para la completación automática de código y asistencia en desarrollo, mejorando la eficiencia de codificación

Context: 128K Max Output: 32K
0,1 ¥ por millón de tokens

Embedding

2

Embedding-3

Tercera generación de modelo vectorial, utilizado para mejorar la recuperación semántica, agrupación, modelado de temas y clasificación, mejorando significativamente el efecto

Context: 8K Max Output:
¥0.5 por millón de tokens

Embedding-2

Legacy

Modelo vectorial de segunda generación, utilizado para mejora de recuperación semántica, agrupación y clasificación (versión antigua)

Context: 8K Max Output:
¥0.5 por millón de tokens

Reordenar

1

Reordenar

Modelo de reordenamiento de texto, calcula la puntuación de relevancia del texto, optimiza el ordenamiento y el efecto de coincidencia de los resultados de recuperación

Context: 4K Max Output:
¥0.8 por millón de tokens

Carácter

2

CharGLM-4

Modelo de conversación animada, adecuado para acompañamiento emocional y interacción con personajes virtuales, que admite expresiones de personaje más naturales

Context: 8K Max Output: 4K
1 ¥ por millón de tokens

Emohaa

Modelo de apoyo psicológico y emocional, con capacidades de asesoramiento profesional y guía emocional, ayudando a los usuarios a entender las emociones y a lidiar con problemas

Context: 8K Max Output: 4K
¥15 por millón de tokens

Código Abierto

2

GLM-4-9B

Código Abierto

Modelo de 9B parámetros de código abierto, admite 128K de contexto, puede ser desplegado localmente, licencia MIT

Context: 128K Max Output:
Gratis y de código abierto

ChatGLM3-6B

Código AbiertoLegacy

Tercera generación de modelo de diálogo de código abierto de 6B, la primera generación de la serie ChatGLM, licencia MIT

Context: 32K Max Output:
Gratis y de código abierto