DeepSeek V4 Flash est en ligne · Notre prix GLM-5.2 vient de baisser à 50% de la liste
Tous les modèles
Z.ai · API

API GLM-5.2

Utilisez le contexte 1M avec une clé API OmniaKey.

ID du modèle
glm-5.2
Contexte
1M
Fournisseur
Z.ai
Entrée · Jetons USD/1 million
$0.7 USD
Prix officiel $1.4 USD
Sortie · Jetons USD/1 million
$2.2 USD
Prix officiel $4.4 USD
Économies
50%
Dernière vérification
2026-08-09

01

A quoi sert ce modèle

GLM-5.2 est le modèle de texte phare de Z.ai pour les tâches à long terme. Sa référence de modèle officielle répertorie une fenêtre contextuelle d'un million de jetons, jusqu'à 128 000 jetons de sortie, des modes de réflexion, du streaming, des appels de fonctions, une sortie structurée, une intégration MCP et une mise en cache contextuelle. Il s'agit des capacités du fournisseur ; les contrôles exacts exposés dépendent toujours du client et de la route API.

Sur OmniaKey, appelez l'ID de modèle exact glm-5.2 via le point de terminaison /v1/chat/completions compatible OpenAI. Au 9 août 2026, le catalogue actuel facture 0,70 $ par million de jetons d'entrée non mis en cache et 2,20 $ par 1 million de jetons de sortie, soit la moitié des tarifs catalogue de 1,40 $ et 4,40 $ de Z.ai. Traitez la fenêtre 1M comme une capacité mesurée, et non comme une allocation gratuite, et validez le coût et le taux d'acceptation sur un travail représentatif.

Choisissez GLM-5.2 pour l'ingénierie à l'échelle d'un projet, les refactors de longue durée ou les flux de travail d'agent qui doivent préserver les contraintes tout au long de nombreuses étapes pilotées par des outils.

Charges de travail de codage les mieux adaptées

Analyse du référentiel à l'échelle du projet

Gardez l'architecture, les contrats d'API, les tests, la documentation et les règles d'ingénierie dans le champ d'application tout en planifiant un changement limité.

Mise en œuvre à long terme

Effectuez une tâche multi-fichiers depuis l’analyse des dépendances jusqu’aux modifications et vérifications sans abandonner les contraintes antérieures.

Flux de travail structurés des agents

Combinez les appels de fonction, la sortie lisible par machine, le streaming et le contexte réutilisable dans l'automatisation avec des autorisations explicites et des contrôles d'acceptation.

02

Spécification technique

Informations sur le catalogue et détails d'intégration vérifiés pour cet itinéraire.

ID du modèle
glm-5.2
Contexte
1M
Entrées et outils
Utilisation des outils
Point de terminaison de l'API
/v1/chat/completions
Accès au cache / 1 M
$0.13 USD
Codage des clients
Claude Code · Codex · Cursor · Cline · Aider

Limites à contourner

  • La carte modèle de Z.ai répertorie GLM-5.2 comme entrée de texte et sortie de texte ; utilisez un modèle explicitement marqué pour la vision lorsque la tâche nécessite des images.
  • Une limite de contexte de 1 million ne rend pas un référentiel non filtré utile ou bon marché. La qualité de la récupération, les limites des clients, l'éligibilité du cache et le volume de sortie affectent toujours les résultats et les coûts.
  • Les allégations de référence et de produit de Z.ai ne sont pas reproduites indépendamment ici. Testez l’exactitude, la fiabilité des appels d’outils, la latence, les tentatives et le coût sur la même tâche acceptée avant de normaliser.

03

Comparez les modèles à proximité

Comparez l’adéquation à la charge de travail et les taux de jetons actuellement répertoriés avant de choisir un itinéraire.

ModèleIdéal pourContexteEntréeSortie
GLM-5.2Cette page
glm-5.2
Les agents à long horizon axés sur le texte fonctionnent avec un contexte de 1 million, un plafond de sortie de 128 000 et une tarification actuelle d'OmniaKey à 50 % des tarifs de la liste Z.ai.1M
$0.7 USD
Prix officiel $1.4 USD
$2.2 USD
Prix officiel $4.4 USD
DeepSeek V4 Pro
deepseek-v4-pro
Un autre itinéraire d'utilisation de texte et d'outils avec un contexte de 1 million et des taux de jetons inférieurs ; comparer la qualité des tâches acceptées, les tentatives et le comportement du cache.1M
$0.435 USD
Prix officiel $0.435 USD
$0.87 USD
Prix officiel $0.87 USD
Gemini 3.1 Pro Preview
gemini-3.1-pro-preview
Un itinéraire de prévisualisation de contexte 1M qui accepte également les entrées de vision ; choisissez-le lorsque l’entrée multimodale est importante et qu’un cycle de vie d’aperçu est acceptable.1M
$1.6 USD
Prix officiel $2 USD
$9.6 USD
Prix officiel $12 USD

04

Démarrages rapides du SDK

Utilisez une URL de base et un ID de modèle provenant de cURL, Python ou TypeScript.

Achèvement du chat en streaming
curl https://api.omniakey.com/v1/chat/completions \
  -H "Authorization: Bearer $OMNIAKEY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.2",
    "messages": [
      {"role": "user", "content": "Review this pull request"}
    ],
    "stream": true
  }'

05

Estimer le coût du jeton

Entrez les jetons d’entrée et de sortie attendus pour comparer les taux actuellement répertoriés.

Estimation OmniaKey
0,114 $US
Estimation officielle
0,228 $US
Économies estimées
0,114 $US

L’estimation couvre uniquement les jetons d’entrée et de sortie. L'utilisation du cache, les tentatives, les outils et la comptabilité des jetons côté client peuvent modifier les frais finaux.

07

Sources et vérification

Les faits et les liens du modèle ont été vérifiés sur 2026-08-09. La documentation du fournisseur reste l'autorité en matière de comportement en amont.

Questions fréquemment posées

Combien coûte GLM-5.2 sur OmniaKey ?

OmniaKey facture $0.7 USD pour 1 million de jetons d'entrée et $2.2 USD pour 1 million de jetons de sortie, en USD. Les prix officiels sont $1.4 USD et $4.4 USD ; vous enregistrez 50%.

Quelle est la fenêtre contextuelle de GLM-5.2 ?

La fenêtre contextuelle répertoriée est 1M. Les limites utilisables réelles peuvent également dépendre du client et du format de demande en amont.

Quel ID de modèle et point de terminaison dois-je utiliser pour GLM-5.2 ?

Utilisez l'ID de modèle exact glm-5.2 et envoyez une requête compatible OpenAI à https://api.omniakey.com/v1/chat/completions avec l'authentification par clé API Bearer. Ne remplacez pas le titre de la page ou le nom d’affichage du fournisseur par l’ID du modèle.

GLM-5.2 accepte-t-il les images ou autres entrées multimodales ?

La carte modèle GLM-5.2 actuelle de Z.ai répertorie les entrées et les sorties sous forme de texte. Ne confondez pas les formats multimodaux généraux de l'API Chat Completions avec la prise en charge de la vision GLM-5.2 ; choisissez un modèle de catalogue explicitement marqué pour la vision lorsque des images sont requises.

Quelles fonctionnalités GLM-5.2 dois-je vérifier avant la production ?

Rejouez les demandes représentatives pour les contrôles de réflexion, le streaming, les appels de fonction, la sortie structurée et la comptabilité du cache dans la version exacte du SDK et de l'agent que vous déployerez. Vérifiez également les annulations, les tentatives, les enregistrements d'utilisation et les tests d'acceptation avant d'augmenter une limite de clé.