DeepSeek V4 Flash ist live · Unser GLM-5.2-Preis ist gerade auf 50% der Liste gefallen
Alle Modelle
Z.ai · API

GLM-5.2 API

Verwenden Sie den Kontext 1M mit einem OmniaKey-API-Schlüssel.

Modell-ID
glm-5.2
Kontext
1M
Anbieter
Z.ai
Eingabe · USD / 1 Mio. Token
$0.7 USD
Offizieller Preis $1.4 USD
Ausgabe · USD / 1 Mio. Token
$2.2 USD
Offizieller Preis $4.4 USD
Einsparungen
50%
Zuletzt überprüft
2026-08-09

01

Wofür dieses Modell gedacht ist

GLM-5.2 ist das Flaggschiff-Textmodell von Z.ai für Aufgaben mit großem Horizont. Die offizielle Modellreferenz listet ein Kontextfenster mit 1 Million Token, bis zu 128.000 Ausgabetokens, Denkmodi, Streaming, Funktionsaufrufe, strukturierte Ausgabe, MCP-Integration und Kontext-Caching auf. Dies sind Anbieterfunktionen; Die genauen bereitgestellten Steuerelemente hängen immer noch vom Client und der API-Route ab.

Rufen Sie auf OmniaKey die genaue Modell-ID glm-5.2 über den OpenAI-kompatiblen Endpunkt /v1/chat/completions auf. Mit Stand vom 9. August 2026 berechnet der aktuelle Katalog 0,70 US-Dollar pro 1 Mio. nicht zwischengespeicherter Eingabe-Token und 2,20 US-Dollar pro 1 Mio. Ausgabe-Token, also die Hälfte der Listenpreise von Z.ai in Höhe von 1,40 US-Dollar bzw. 4,40 US-Dollar. Behandeln Sie das 1-Millionen-Fenster als gemessene Kapazität, nicht als kostenlose Zulage, und validieren Sie Kosten und Akzeptanzrate für repräsentative Arbeiten.

Wählen Sie GLM-5.2 für Engineering im Projektmaßstab, Refactors mit langer Laufzeit oder Agent-Workflows, bei denen Einschränkungen über viele werkzeuggesteuerte Schritte hinweg beibehalten werden müssen.

Optimale Codierungs-Workloads

Endlageranalyse im Projektmaßstab

Behalten Sie den Umfang von Architektur, API-Verträgen, Tests, Dokumentation und technischen Regeln bei, während Sie eine begrenzte Änderung planen.

Langfristige Umsetzung

Führen Sie eine Aufgabe mit mehreren Dateien von der Abhängigkeitsanalyse bis hin zu Bearbeitungen und Überprüfung durch, ohne frühere Einschränkungen fallen zu lassen.

Strukturierte Agenten-Workflows

Kombinieren Sie Funktionsaufrufe, maschinenlesbare Ausgabe, Streaming und wiederverwendbaren Kontext in der Automatisierung mit expliziten Berechtigungen und Akzeptanzprüfungen.

02

Technische Spezifikation

Für diese Route überprüfte Katalogfakten und Integrationsdetails.

Modell-ID
glm-5.2
Kontext
1M
Eingaben und Werkzeuge
Werkzeuggebrauch
API-Endpunkt
/v1/chat/completions
Cache-Treffer / 1 Mio
$0.13 USD
Codierungsclients
Claude Code · Codex · Cursor · Cline · Aider

Grenzen, um die man herumplanen kann

  • Die Modellkarte von Z.ai listet GLM-5.2 als Texteingabe und Textausgabe auf; Verwenden Sie ein Modell, das ausdrücklich für die Sicht gekennzeichnet ist, wenn für die Aufgabe Bilder erforderlich sind.
  • Eine Kontextbeschränkung von 1 Million macht ein ungefiltertes Repository nicht nützlich oder billig. Abrufqualität, Client-Limits, Cache-Berechtigung und Ausgabevolumen wirken sich weiterhin auf Ergebnisse und Kosten aus.
  • Die Benchmark- und Produktansprüche von Z.ai werden hier nicht unabhängig wiedergegeben. Testen Sie vor der Standardisierung die Korrektheit, die Zuverlässigkeit des Tool-Aufrufs, die Latenz, die Wiederholungsversuche und die Kosten für dieselbe akzeptierte Aufgabe.

03

Vergleichen Sie Modelle in der Nähe

Vergleichen Sie die Workload-Passform und die aktuell aufgeführten Token-Raten, bevor Sie eine Route auswählen.

ModellAm besten fürKontextEingabeAusgabe
GLM-5.2Diese Seite
glm-5.2
Textorientierte Agenten mit langem Horizont arbeiten mit 1 Million Kontext, einer Ausgabeobergrenze von 128 KB und aktuellen OmniaKey-Preisen von 50 % der Z.ai-Listenpreise.1M
$0.7 USD
Offizieller Preis $1.4 USD
$2.2 USD
Offizieller Preis $4.4 USD
DeepSeek V4 Pro
deepseek-v4-pro
Eine weitere Text- und Tool-Nutzungsroute mit 1 Mio. Kontext und niedrigeren aufgeführten Token-Raten; Vergleichen Sie die Qualität akzeptierter Aufgaben, die Wiederholungsversuche und das Cache-Verhalten.1M
$0.435 USD
Offizieller Preis $0.435 USD
$0.87 USD
Offizieller Preis $0.87 USD
Gemini 3.1 Pro Preview
gemini-3.1-pro-preview
Eine 1M-Kontext-Vorschauroute, die auch visuelle Eingaben akzeptiert; Wählen Sie es, wenn multimodale Eingaben wichtig sind und ein Vorschau-Lebenszyklus akzeptabel ist.1M
$1.6 USD
Offizieller Preis $2 USD
$9.6 USD
Offizieller Preis $12 USD

04

SDK-Schnellstarts

Verwenden Sie eine Basis-URL und eine Modell-ID von cURL, Python oder TypeScript.

Abschluss des Streaming-Chats
curl https://api.omniakey.com/v1/chat/completions \
  -H "Authorization: Bearer $OMNIAKEY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.2",
    "messages": [
      {"role": "user", "content": "Review this pull request"}
    ],
    "stream": true
  }'

05

Schätzen Sie die Token-Kosten

Geben Sie die erwarteten Ein- und Ausgabetokens ein, um die aktuell aufgeführten Preise zu vergleichen.

OmniaKey-Schätzung
0,114 $
Offizieller Kostenvoranschlag
0,228 $
Geschätzte Einsparungen
0,114 $

Die Schätzung umfasst nur Eingabe- und Ausgabe-Tokens. Cache-Nutzung, Wiederholungsversuche, Tools und clientseitige Token-Abrechnung können die endgültige Gebühr ändern.

07

Quellen und Überprüfung

Modellfakten und Links wurden auf 2026-08-09 überprüft. Die Anbieterdokumentation bleibt die Autorität für das Upstream-Verhalten.

Häufig gestellte Fragen

Wie viel kostet GLM-5.2 auf OmniaKey?

OmniaKey berechnet $0.7 USD pro 1 Mio. Eingabe-Tokens und $2.2 USD pro 1 Mio. Ausgabe-Tokens in USD. Offizielle Preise sind $1.4 USD und $4.4 USD; Sie sparen 50%.

Was ist das Kontextfenster für GLM-5.2?

Das aufgeführte Kontextfenster ist 1M. Die tatsächlich nutzbaren Grenzwerte können auch vom Client- und Upstream-Anforderungsformat abhängen.

Welche Modell-ID und welchen Endpunkt sollte ich für GLM-5.2 verwenden?

Verwenden Sie die genaue Modell-ID glm-5.2 und senden Sie eine OpenAI-kompatible Anfrage an https://api.omniakey.com/v1/chat/completions mit Bearer-API-Schlüsselauthentifizierung. Ersetzen Sie die Modell-ID nicht durch den Seitentitel oder den Anzeigenamen des Anbieters.

Akzeptiert GLM-5.2 Bilder oder andere multimodale Eingaben?

Die aktuelle GLM-5.2-Modellkarte von Z.ai listet sowohl die Eingabe als auch die Ausgabe als Text auf. Verwechseln Sie die multimodalen Formate der allgemeinen Chat Completions API nicht mit GLM-5.2 Vision-Unterstützung; Wählen Sie ein Katalogmodell, das ausdrücklich für die Sichtbarkeit gekennzeichnet ist, wenn Bilder erforderlich sind.

Welche GLM-5.2-Funktionen sollte ich vor der Produktion überprüfen?

Geben Sie repräsentative Anfragen nach Denksteuerung, Streaming, Funktionsaufrufen, strukturierter Ausgabe und Cache-Buchhaltung in genau der SDK- und Agent-Version wieder, die Sie bereitstellen werden. Überprüfen Sie außerdem Abbrüche, Wiederholungsversuche, Nutzungsaufzeichnungen und Akzeptanztests, bevor Sie ein Schlüssellimit erhöhen.