← Обратно в主页

Все модели

Полный каталог 64 моделей: текстовый чат, рассуждение, зрение, генерация изображений/видео, голос, AI-поиск, код, внедрение.

64
Модели
12
категории
8
Бесплатно
⚠ Некоторые устаревшие модели выводятся из обращения. Перемещайте на новые версии.
Go to Playground

Данные обновлены август 2026 года

Текст и Чат

22

GLM-5.3

ФлагманНовый

Последняя флагманская модель и наиболее способный модель open-weights для кодирования: +50% над GLM-5.2 на Z.ai Code Bench,开源 SOTA на Terminal-Bench 3.0 и Agents' Last Exam, передовые технологии на CyberGym (84.5) для обнаружения уязвимостей

Context: 1M Max Output: 128K
8 ¥ / 28 на миллион токенов

GLM-5.3-Flash

НовыйМультимодальный

Первый нативный многоформатный модель-5: 320B общих / 18B активных параметров, первый открытый модельный фронт с гибридной спарсной линейной注意力, зрение интегрированное в цикл кодирования, превосходит GLM-5.2 по одной десятой цены

Context: 1M Max Output: 128K
0.8 ¥ / 2.8 на миллион токенов

GLM-5.2

Рассуждение

Предыдущее поколение флагманской модели: 1M无损 контекста, кодирующая способность开源 SOTA своего поколения, поддерживает стабильное выполнение сложных долгосрочных задач — основа, на которой GLM-5.3 строит постобучение

Context: 1M Max Output: 128K
8 ¥ / 28 на миллион токенов

GLM-5.1

Рассуждение

Возможности кодирования соответствуют Claude Opus 4.6, значительное улучшение в долгосрочных задачах, может работать независимо до 8 часов

Context: 200K Max Output: 128K
6 ¥ / 24 на миллион токенов

GLM-5

Рассуждение

Возможности программирования соответствуют Claude Opus 4.5, профессиональна в агентском долгосрочном планировании и выполнении

Context: 200K Max Output: 128K
4 ¥ / 18 на миллион токенов

GLM-5-Turbo

Рассуждение

Специальная оптимизация для долгих задач, хорошая непрерывность в выполнении сложных долгосрочных задач

Context: 200K Max Output: 128K
5 ¥ / 22 на миллион токенов

GLM-4.7

Рассуждение

Полное обновление общих диалоговых, рациональных и агентских возможностей, программирование сильнее и стабильнее, улучшенная эстетика

Context: 200K Max Output: 128K
2 ¥ / 8 за миллион токенов

GLM-4.7-FlashX

Свет

Легковесная и высокоскоростная, с малым размером и высокой способностью, подходящая для общих сценариев, таких как китайская писанина, перевод, ролевые игры и т.д.

Context: 200K Max Output: 128K
0.5 ¥ / 3 на миллион токенов

GLM-4.7-Flash

СветБесплатно

Бесплатная модель, предоставляющая всеобъемлющий опыт, расширение общих возможностей базовой модели-4.7

Context: 200K Max Output: 128K
Бесплатно

GLM-4.6

Контекст увеличен до 200K, профессионально справляется с продвинутым программированием, сложным reasoning и вызовом инструментов

Context: 200K Max Output: 128K
1 ¥ / 5 на миллион токенов

GLM-4.5

Универсальная модель с балансом производительности и стоимости, подходящая для диалога, анализа и обработки документов

Context: 128K Max Output: 96K
2 ¥ / 8 за миллион токенов

GLM-4.5-Air

Свет

Высокопроизводительная и экономичная легковесная модель, с стабильной производительностью в инференсе, кодировании и задачах агента

Context: 128K Max Output: 96K
0.8 ¥ / 2 на миллион токенов

GLM-4.5-AirX

Свет

Высокопроизводительная и экономичная ultra-fast версия, подходящая для бизнес-сценариев с низким латентностью и высокой отзывчивостью

Context: 128K Max Output: 96K
1 ¥ / 4 на миллион токенов

GLM-4.5-Flash

СветБесплатно

Бесплатная модель, поддерживает режим глубокого мышления, поддерживает обработку контекста 128K

Context: 128K Max Output: 96K
Бесплатно

GLM-4-Long

Длинный контекст

Поддерживает длину контекста 1M, предназначен для обработки длинных текстов и задач с высокой нагрузкой на память

Context: 1M Max Output: 4K
1 юань за миллион токенов

GLM-4-Plus

Легаси

Флагманская модель четвертого поколения, сильные всеобъемлющие возможности (старая версия)

Context: 128K Max Output: 4K
5 юаней за миллион токенов

GLM-4-Air

СветЛегаси

Легковесная модель, быстрая скорость и низкая стоимость (старая версия)

Context: 128K Max Output: 4K
0,5 ¥ за миллион токенов

GLM-4-AirX

СветЛегаси

Легковесная быстрая версия, более быстрая скорость ответа (старая версия)

Context: 128K Max Output: 4K
1 юань за миллион токенов

GLM-4-Assistant

АгентЛегаси

Модель, специфичная для агента, оптимизированная для сценариев агента (Старая версия)

Context: 128K Max Output: 4K
5 юаней за миллион токенов

GLM-4-FlashX-250414

Свет

Версия с улучшенной быстротой и Flash, быстрый вывод результатов, подходит для сценариев высококонкурентных вызовов

Context: 128K Max Output: 16K
0,1 ¥ за миллион токенов

GLM-4-Flash-250414

СветБесплатно

Бесплатная модель, поддерживающая обработку длинного контекста, подходящая для сценариев понимания многоязычных данных и вызова инструментов

Context: 128K Max Output: 16K
Бесплатно

GLM-4-0520

ЛегасиУстаревшее

Старая версия флагманской текстовой модели, прекращена 30 декабря 2025 года

Context: 128K Max Output: 4K
100 ¥ за миллион токенов

Глубокое мышление

3

GLM-Z1-Air

Устаревшее

Глубокий модель вывода, версия с высокой производительностью, снята с производства 15 ноября 2025 года

Context: 128K Max Output: 16K
0,5 ¥ за миллион токенов

GLM-Z1-AirX

Устаревшее

Глубокий модель вывода, ультра-быстрая версия, снята с производства 15 ноября 2025 года

Context: 32K Max Output: 16K
5 юаней за миллион токенов

GLM-Z1-FlashX

Устаревшее

Модель глубокого вывода, быстрая и экономичная версия, снята с производства 15 ноября 2025 года

Context: 128K Max Output: 16K
0,1 ¥ за миллион токенов

Vision & Multimodal

12

GLM-5V-Turbo

ФлагманНовый

Первый базовый модель агента с мультимодальными входами, балансирующий визуальное понимание, рассуждение и генерацию кода, поддерживающий мультимодальные входы изображений, видео и текста

Context: 200K Max Output: 128K
5 ¥ / 22 на миллион токенов

GLM-4.6V

Улучшенная визуальная рациональность, nativно поддерживающая вызовы инструментов и длинные контексты, с более стабильными эффектами клонирования кода интерфейса

Context: 128K Max Output: 32K
1 ¥ / 3 за миллион токенов

GLM-4.6V-FlashX

Свет

Высокопроизводительная модель визуального_reasoning, поддерживающая вызов инструментов и долгий контекст

Context: 128K Max Output: 32K
0.15 ¥ / 1.5 на миллион токенов

GLM-4.6V-Flash

СветБесплатно

Бесплатная модель визуального_reasoning, поддерживающая вызов инструментов и длинный контекст, с гибкой сменой режима мышления

Context: 128K Max Output: 32K
Бесплатно

GLM-4.5V

Легаси

Модель понимания визуальной информации, поддерживающая ввод изображений и видеофайлов

Context: 64K Max Output:
2 ¥ / 6 за миллион токенов

GLM-4.1V-Thinking-FlashX

Свет

Легковесная модель визуального_reasoning, профессионально понимает сложные сцены и многоступенчатый анализ

Context: 64K Max Output: 16K
2 юаня за миллион токенов

GLM-4.1V-Thinking-Flash

СветБесплатно

Бесплатная модель визуального_reasoning, профессионально understands сложные сцены и многоступенчатый анализ

Context: 64K Max Output: 16K
Бесплатно

GLM-4V-Plus-0111

Легаси

Старая версия модели распознавания изображений-текста-видео (старая версия)

Context: 8K Max Output:
4 юаня за миллион токенов

GLM-4V-Flash

СветБесплатноЛегаси

Бесплатная модель понимания изображений с базовыми возможностями ответа на вопросы на основе много-modalных данных

Context: 16K Max Output: 1K
Бесплатно

GLM-4V

Легаси

Мультимодальный визуальный модель первого поколения (старая версия)

Context: 2K Max Output:
5 юаней за миллион токенов

GLM-OCR

Оптическое распознавание символов

Легковесная модель парсинга изображений и текста, балансирующая высокую точность и эффективность в понимании документов, поддерживающая сложный парсинг макета

Context: Max Output:
¥0,01 за тысячу токенов

AutoGLM-Phone

АгентНовый

Мобильная интеллектуальная платформа помощника, поддерживающая естественный язык для выполнения задач управления приложениями, охватывающая полный набор мобильных команд управления

Context: 20K Max Output: 2K
¥0.04 每次

Генерация изображений

5

GLM-Image

ФлагманНовый

Flagship-модель генерации изображений, сильнее в следовании сложным инструкциям и генерации,密集ющей знаниями, выдающаяся в рендеринге текста, особенно для китайских иероглифов

Context: 多分辨率 Max Output:
¥0.2 每次

CogView-4

Общий модель генерации изображений, высокое качество генерации, богатое и разнообразное стилистическое выражение, более полные детали изображения

Context: 多分辨率 Max Output:
¥0.06 每次

CogView-3-Plus

Улучшенная модель генерации изображений, улучшенное качество изображения, поддерживает больше стилей искусства

Context: 多分辨率 Max Output:
¥0.1 每次

CogView-3

Легаси

Общая модель генерации изображений, поддерживаетmultiple разрешения и стили (старая версия)

Context: 多分辨率 Max Output:
¥0.06 每次

CogView-3-Flash

СветБесплатно

Бесплатная модель генерации изображений, гибкая креативная генерация, быстрая скорость генерации

Context: 多分辨率 Max Output:
Бесплатно

Генерация видео

5

CogVideoX-3

ФлагманНовый

Высококвалифицированный флагманский видеомодель с четким качеством изображения, более сильным соблюдением команд и физической симуляцией, поддерживающий генерацию первых и последних кадров

Context: 多分辨率 Max Output:
¥1 每次

Vidu Q1

Новый

Высококачественная модель генерации видео, с четким качеством изображения, плавными переходами, более богатым стилем выражения и способностью уменьшать искажение изображений

Context: 多分辨率 Max Output:
¥1 每次

Vidu 2

Высокоскоростной и недорогой видеомодель с быстрой скоростью генерации, естественным соединением первых и последних кадров и более сильной согласованностью с несколькими referenciaльными изображениями

Context: 多分辨率 Max Output:
¥0.5 每次

CogVideoX-2

Стандартная модель генерации видео, поддерживающая многоуровневый вывод разрешения

Context: 多分辨率 Max Output:
¥0.5 每次

CogVideoX-Flash

СветБесплатно

Бесплатная модель генерации видео, поддерживающая AI-эффекты звука, качество изображения 4K и 60fps, максимальная длина видео 10 секунд

Context: 多分辨率 Max Output:
Бесплатно

Голос и аудио

5

GLM-TTS

Текстогенерация

Модель синтеза голоса, поддерживающая сверхчеловеческое генерирование голоса и эмоциональную экспрессию, предоставляющая потоковые и непотоковые интерфейсы

Context: Max Output:
¥0.5 每千字符

GLM-TTS-Clone

Текстогенерация

Модель клонирования голоса, способная быстро генерировать похожий голос за 3 секунды, поддерживающая тонкую эмоциональную выразительность

Context: Max Output:
¥0.2 每秒

GLM-ASR-2512

Автоматическое распознавание речи

Высокоточный модель распознавания речи с низкой ошибкой символа, поддерживающая пользовательский словарь и различные диалекты

Context: Max Output:
¥0.06 每分钟

GLM-4-Voice

Реальное время

Реальное время модели диалога с речью, поддерживающей понимание и генерацию китайского и английского языка, регулируемая по эмоциям, интонации и скорости

Context: Max Output:
80 ¥ за миллион токенов

GLM-Realtime

Реальное времяНовый

Реальный аудио-видео модель, поддерживающая видеозвонки и долгосрочную память диалога, перекрестное текстовое, аудио и видео реальное время вывода

Context: Max Output:
¥0.04 每分钟

Код

1

CodeGeeX-4

Модель завершения кода, подходящая для автоматического завершения кода и поддержки разработки, улучшающая эффективность программирования

Context: 128K Max Output: 32K
0,1 ¥ за миллион токенов

Векторизация

2

Embedding-3

Третье поколение векторной модели, используемой для улучшения семантического поиска, кластеризации, моделирования тем и классификации, значительно улучшающее эффект

Context: 8K Max Output:
0,5 ¥ за миллион токенов

Embedding-2

Легаси

Второе поколение векторной модели, используемой для улучшения семантического поиска, кластеризации и классификации (старая версия)

Context: 8K Max Output:
0,5 ¥ за миллион токенов

Переранкинг

1

Переранкинг

Модель перестановки текста, вычисляет рейтинг релевантности текста, оптимизирует сортировку результатов召回 и эффект соответствия

Context: 4K Max Output:
0,8 ¥ за миллион токенов

Характеристика

2

CharGLM-4

Анимированная модель диалога, подходящая для эмоционального companionship и взаимодействия с виртуальными персонажами, поддерживающая более естественную экспрессию персонажей

Context: 8K Max Output: 4K
1 юань за миллион токенов

Эмохаа

Модель психологической и эмоциональной поддержки с возможностями профессиональной консультации и эмоционального руководства, помогающая пользователям понимать эмоции и справляться с проблемами

Context: 8K Max Output: 4K
15 ¥ за миллион токенов

Открытый исходный код

2

GLM-4-9B

Открытый исходный код

Открыточная модель с 9B параметрами, поддерживает контекст 128K, может быть локально развернута, лицензия MIT

Context: 128K Max Output:
Бесплатно и открыто

ChatGLM3-6B

Открытый исходный кодЛегаси

Третье поколение открытого исходного кода диалоговой модели 6B, первая серия ChatGLM, лицензия MIT

Context: 32K Max Output:
Бесплатно и открыто