← Zurück zur Startseite

Alle Modelle

Vollständiges Katalog der 64 Modelle: Text-Chat, Reasoning, Vision, Bild/Video-Generierung, Stimme, KI-Suche, Code, Embedding.

64
Modelle
12
Kategorien
8
Kostenlos
⚠ Einige veraltete Modelle werden abgekündigt. Migrate zu neueren Versionen.
Zum Playground

Daten aktualisiert August 2026

Text & Chat

22

GLM-5.3

FlaggschiffNeu

Neuestes Flaggschiffmodell und das leistungsfähigste Open-Weights-Modell für Codierung: +50% über GLM-5.2 auf Z.ai Code Bench, Open-Source SOTA auf Terminal-Bench 3.0 und Agents' Last Exam, State of the Art auf CyberGym (84.5) für die Schwachstellenentdeckung

Context: 1M Max Output: 128K
8 ¥ / 28 pro Million Tokens

GLM-5.3-Flash

NeuMultimodal

Erster nativ multimodaler GLM-5-Modell: 320B Gesamt / 18B aktive Parameter, erster offener Frontier-Modell mit hybrider sparsamer linearer Aufmerksamkeit, visuelle Eigenschaften im Koding-Zyklus, schlägt GLM-5.2 bei einem Zehntel des Preises

Context: 1M Max Output: 128K
0.8 ¥ / 2.8 pro Million Tokens

GLM-5.2

Reasoning

Vorzugliches Modell der Vor generation: 1M Verlustfreier Kontext, Koding-Fähigkeit Open-Source SOTA seiner Generation, unterstützt die stabile Ausführung komplexer langfristiger Aufgaben — die Grundlage, auf der GLM-5.3 nach der Schulung aufbaut

Context: 1M Max Output: 128K
8 ¥ / 28 pro Million Tokens

GLM-5.1

Reasoning

Koding-Fähigkeit auf Claude Opus 4.6 ausgerichtet, erhebliche Verbesserung bei langfristigen Aufgaben, kann bis zu 8 Stunden unabhängig arbeiten.

Context: 200K Max Output: 128K
6 ¥ / 24 pro Million Tokens

GLM-5

Reasoning

Programmierfähigkeit auf Augenhöhe mit Claude Opus 4.5, versiert in agiler langfristiger Planung und Ausführung

Context: 200K Max Output: 128K
4 ¥ / 18 pro Million Tokens

GLM-5-Turbo

Reasoning

Besondere Optimierung für lange Aufgaben, gute Kontinuität bei der Ausführung komplexer langfristiger Aufgaben

Context: 200K Max Output: 128K
5 ¥ / 22 pro Million Tokens

GLM-4.7

Reasoning

Komplette Überarbeitung der allgemeinen Dialog-, Reasoning- und Agentenfähigkeiten, stärker und stabiler programmiert, verbesserte Ästhetik

Context: 200K Max Output: 128K
2 ¥ / 8 pro Million Tokens

GLM-4.7-FlashX

Licht

Leicht und schnell, kleiner Umfang mit starker Kapazität, geeignet für allgemeine Szenarien wie chinesische Schreibweise, Übersetzung, Rollenspiel usw.

Context: 200K Max Output: 128K
0.5 ¥ / 3 pro Million Tokens

GLM-4.7-Flash

LichtKostenlos

Kostenlose Version, umfassende Erfahrung bietet, erweitert die allgemeinen Fähigkeiten des GLM-4.7-Basismodells

Context: 200K Max Output: 128K
Kostenlos

GLM-4.6

Kontext auf 200K erweitert, versiert in fortgeschrittenem Coding, komplexem Reasoning und Tool-Aufruf

Context: 200K Max Output: 128K
1 ¥ / 5 pro Million Tokens

GLM-4.5

Ein ausgewogener Leistung und Kosten-Allgemeinmodell, geeignet für Dialoge, Analyse und Dokumentenverarbeitung

Context: 128K Max Output: 96K
2 ¥ / 8 pro Million Tokens

GLM-4.5-Air

Licht

Hochleistungsfähiges und kosteneffektives Leichtmodell mit stabiler Leistung in Inferenz, Codierung und Agentenaufgaben

Context: 128K Max Output: 96K
0.8 ¥ / 2 pro Million Tokens

GLM-4.5-AirX

Licht

Hochleistungs- und kosteneffektive Ultrageschwindigkeitsversion, geeignet für Geschäftsbedingungen mit niedriger Latenz und hoher Reaktionsfähigkeit.

Context: 128K Max Output: 96K
1 ¥ / 4 pro Million Tokens

GLM-4.5-Flash

LichtKostenlos

Kostenlose Modellversion, unterstützt tiefes Denkmuster, unterstützt 128K Kontextverarbeitung

Context: 128K Max Output: 96K
Kostenlos

GLM-4-Long

Langzeithintergrund

Unterstützt eine Kontextlänge von 1M, konzipiert für die Verarbeitung langer Texte und speicherintensiver Aufgaben

Context: 1M Max Output: 4K
1 ¥ pro Million Tokens

GLM-4-Plus

Legacy

Vierter Generation Flaggschiffmodell, starke umfassende Fähigkeiten (alte Version)

Context: 128K Max Output: 4K
5 ¥ pro Million Tokens

GLM-4-Air

LichtLegacy

Leichtes Modell, schnelle Geschwindigkeit und geringer Preis (alte Version)

Context: 128K Max Output: 4K
0.5 ¥ pro Million Tokens

GLM-4-AirX

LichtLegacy

Leichte Schnellversion, schnellere Antwortgeschwindigkeit (Alte Version)

Context: 128K Max Output: 4K
1 ¥ pro Million Tokens

GLM-4-Assistant

AgentLegacy

Agent-spezifisches Modell, optimiert für Agentenszenarien (Alte Version)

Context: 128K Max Output: 4K
5 ¥ pro Million Tokens

GLM-4-FlashX-250414

Licht

Flash-verbesserte Hochgeschwindigkeitsversion, schnelle Inferenzgeschwindigkeit, geeignet für Szenarien mit hohem Konnektivitätsbedarf

Context: 128K Max Output: 16K
0.1 ¥ pro Million Tokens

GLM-4-Flash-250414

LichtKostenlos

Kostenlose Modelle, unterstützen die Verarbeitung langer Kontexte, geeignet für mehrsprachige Verständigung und Werkzeugaufruf-Szenarien

Context: 128K Max Output: 16K
Kostenlos

GLM-4-0520

LegacyVeraltet

Alte Version Flagship Text-Modell, ab dem 30. Dezember 2025 eingestellt

Context: 128K Max Output: 4K
100 ¥ pro Million Tokens

Tiefes Reasoning

3

GLM-Z1-Air

Veraltet

Deepes Inferenzmodell, Hochleistungs-Version, eingestellt am 15. November 2025

Context: 128K Max Output: 16K
0.5 ¥ pro Million Tokens

GLM-Z1-AirX

Veraltet

Deepes Inferenzmodell, Ultra-Schnell-Version, eingestellt am 15. November 2025

Context: 32K Max Output: 16K
5 ¥ pro Million Tokens

GLM-Z1-FlashX

Veraltet

Deep Inference Model, schnelle und kostengünstige Version, ab dem 15. November 2025 eingestellt

Context: 128K Max Output: 16K
0.1 ¥ pro Million Tokens

Vision & Multimodal

12

GLM-5V-Turbo

FlaggschiffNeu

Erster Multimodaler Agentenbasismodell, das visuelle Verständigung, Reasoning und Code-Generierung ausbalanciert, und multimodale Eingaben von Bildern, Videos und Text unterstützt

Context: 200K Max Output: 128K
5 ¥ / 22 pro Million Tokens

GLM-4.6V

Verbesserte visuelle Reasoning-Fähigkeit, nativ unterstützt Tool-Aufrufe und lange Kontexte, mit stabileren Frontend-Code-Klonungseffekten

Context: 128K Max Output: 32K
1 ¥ / 3 pro Million Tokens

GLM-4.6V-FlashX

Licht

Hochleistungsmodell für visuelle Reasoning, unterstützt Werkzeugaufrufe und lange Kontexte

Context: 128K Max Output: 32K
0.15 ¥ / 1.5 pro Million Tokens

GLM-4.6V-Flash

LichtKostenlos

Kostenlose visuelle Reasoning-Modelle, unterstützen Werkzeugaufrufe und lange Kontexte, mit flexibler Umschaltung des Denkmusters

Context: 128K Max Output: 32K
Kostenlos

GLM-4.5V

Legacy

Modell für visuelles Verständnis, unterstützt die Eingabe von Bild- und Videodateien

Context: 64K Max Output:
2 ¥ / 6 pro Million Tokens

GLM-4.1V-Thinking-FlashX

Licht

Leichtes visuelles Verständnismodell, erfahren in der Analyse komplexer Szenarien und mehrstufiger Analyse

Context: 64K Max Output: 16K
2 ¥ pro Million Tokens

GLM-4.1V-Thinking-Flash

LichtKostenlos

Kostenlose visuelle Reasoning-Modelle, versiert im Verständnis komplexer Szenarien und mehrstufiger Analyse

Context: 64K Max Output: 16K
Kostenlos

GLM-4V-Plus-0111

Legacy

Alte Version des Bild-Text-Video-Erkennungsmodells (alte Version)

Context: 8K Max Output:
4 ¥ pro Million Tokens

GLM-4V-Flash

LichtKostenlosLegacy

KOSTENLOSER Bildverständnismodell mit grundlegenden multimodalen Frage-und-Antwort-Fähigkeiten

Context: 16K Max Output: 1K
Kostenlos

GLM-4V

Legacy

Erste Generation multimodales visuelles Modell (alte Version)

Context: 2K Max Output:
5 ¥ pro Million Tokens

GLM-OCR

OCR

Leichtgewichtiges Bild-Text-Parsing-Modell, Ausgewogenheit zwischen hoher Präzision und Effizienz bei der Dokumentenverständigung, unterstützt komplexe Layout-Parsing

Context: Max Output:
0,01 ¥ pro 1000 Tokens

AutoGLM-Phone

AgentNeu

Mobile intelligente Assistentenrahmenwerk, das natürliche Sprache unterstützt, um App-Betriebsaufgaben zu erledigen und das vollständige Set von mobilen Betriebsbefehlen abdeckt

Context: 20K Max Output: 2K
¥0.04 每次

Bildgenerierung

5

GLM-Image

FlaggschiffNeu

Flagship-Image-Generationsmodell, stärker im Folgen komplexer Anweisungen und in kenntnisintensiver Generierung, hervorragend in Textdarstellung, insbesondere für chinesische Zeichen

Context: 多分辨率 Max Output:
¥0.2 每次

CogView-4

Allgemeines Bildgenerationsmodell, hochwertige Generierung, reichhaltige und vielfältige Stilausdrucksweise, mehr umfassende Bilddetails

Context: 多分辨率 Max Output:
¥0.06 每次

CogView-3-Plus

Verbessertes Bildgenerationsmodell, verbesserte Bildqualität, unterstützt mehr künstlerische Stile

Context: 多分辨率 Max Output:
¥0.1 每次

CogView-3

Legacy

Allgemeines Bildgenerationsmodell, unterstützt mehrere Auflösungen und Stile (alte Version)

Context: 多分辨率 Max Output:
¥0.06 每次

CogView-3-Flash

LichtKostenlos

Kostenlose Bildgenerierungsmodellversion, flexible kreative Generierung, schnelle Generierungsgeschwindigkeit

Context: 多分辨率 Max Output:
Kostenlos

Videogenerierung

5

CogVideoX-3

FlaggschiffNeu

Hochintelligentes Flaggschiff-Videomodell mit klarer Bildqualität, stärkerer Kommandoerfüllung und physischer Simulation, unterstützt die Generierung der ersten und letzten Frames

Context: 多分辨率 Max Output:
¥1 每次

Vidu Q1

Neu

Hochwertiges Videogenerierungsmodell mit klarem Bildqualität, glatten Übergängen, reicher Stilexpression und kann Bildverzerrungen reduzieren

Context: 多分辨率 Max Output:
¥1 每次

Vidu 2

Hochgeschwindigkeits- und kostengünstiges Videomodell mit schneller Generierungsgeschwindigkeit, natürlicher Verbindung der ersten und letzten Frames und stärkerer Konsistenz mit mehreren Referenzbildern

Context: 多分辨率 Max Output:
¥0.5 每次

CogVideoX-2

Standardmodell zur Videogenerierung, unterstützt Ausgabe in mehreren Auflösungen

Context: 多分辨率 Max Output:
¥0.5 每次

CogVideoX-Flash

LichtKostenlos

Kostenloses Video-Generierungsmodell, das AI-Soundeffekte unterstützt, 4K-Bildqualität, 60fps und eine maximale Videolänge von 10 Sekunden.

Context: 多分辨率 Max Output:
Kostenlos

Stimme & Audio

5

GLM-TTS

TTS

Sprachsynthese-Modell, unterstützt die Generierung von übermenschlicher Stimme und emotionale Ausdrucksweise, bietet Streaming- und Nicht-Streaming-Schnittstellen

Context: Max Output:
¥0.5 每千字符

GLM-TTS-Clone

TTS

Stimmenklonmodell, in der Lage, ähnliche Stimmen in 3 Sekunden zu generieren, unterstützt feine emotionale Ausdrucksweise

Context: Max Output:
¥0.2 每秒

GLM-ASR-2512

ASR

Hochpräzises Spracherkennungsmodell mit niedriger Zeichenerfassungsfehlerquote, unterstützt benutzerdefinierte Wörterbücher und verschiedene Dialekte

Context: Max Output:
¥0.06 每分钟

GLM-4-Voice

Echtzeit

Echtzeit-Sprachdialogmodell, das chinesische und englische Sprachverständnis und -generierung unterstützt, an Emotion, Ton und Geschwindigkeit anpassbar

Context: Max Output:
80 ¥ pro Million Tokens

GLM-Realtime

EchtzeitNeu

Echtzeit-Audio-Video-Modell, das Videokonferenzen und langfristiges Dialoggedächtnis unterstützt, sowie Cross-Text, Audio- und Video-Echtzeit-Inferenz.

Context: Max Output:
¥0.04 每分钟

Code

1

CodeGeeX-4

Code-Vervollständigungsmuster, geeignet für automatische Code-Vervollständigung und Entwicklungsunterstützung, verbessert die Codierproduktivität

Context: 128K Max Output: 32K
0.1 ¥ pro Million Tokens

Embedding

2

Embedding-3

Drittes Generationen Vektormodell, das zur Verbesserung der semantischen Retrieval, Clustering, Themenmodellierung und Klassifizierung verwendet wird, was die Effektivität erheblich verbessert

Context: 8K Max Output:
0.5 ¥ pro Million Tokens

Embedding-2

Legacy

Zweigenerationen-Vektormodell, verwendet für die Verbesserung der semantischen Recherche, Clustering und Klassifizierung (alte Version)

Context: 8K Max Output:
0.5 ¥ pro Million Tokens

Rerank

1

Rerank

Textumordnungsmuster, berechnet Textrelevanzscore, optimiert die Sortierung und das Matching der Rückgabefolge

Context: 4K Max Output:
0.8 ¥ pro Million Tokens

Zeichen

2

CharGLM-4

Animations-Dialogmodell, geeignet für emotionale Begleitung und Interaktion mit virtuellen Charakteren, das natürlichere Charakterausdrücke unterstützt

Context: 8K Max Output: 4K
1 ¥ pro Million Tokens

Emohaa

Psychologisches und emotionales Unterstützungsmodell mit professioneller Beratung und emotionaler Begleitungsfähigkeit, um Benutzern zu helfen, Emotionen zu verstehen und mit Problemen umzugehen

Context: 8K Max Output: 4K
15 ¥ pro Million Tokens

Open Source

2

GLM-4-9B

Open Source

Open-Source-Modell mit 9B Parametern, unterstützt 128K Kontext, kann lokal bereitgestellt werden, MIT-Lizenz

Context: 128K Max Output:
Kostenlos und Open Source

ChatGLM3-6B

Open SourceLegacy

Drittgeneration offenes Quellcode-6B Dialogmodell, erste Generation ChatGLM-Serie, MIT-Lizenz

Context: 32K Max Output:
Kostenlos und Open Source