DeepSeek V4 Flash ya está disponible · Nuestro precio de GLM-5.2 baja al 50% del oficial
Todos los modelos
Z.ai · API

GLM-5.2 API

Accede con 1M de contexto usando una sola clave OmniaKey.

ID del modelo
glm-5.2
Contexto
1M
Proveedor
Z.ai
Entrada · USD / 1M tokens
$0.7 USD
Precio oficial $1.4 USD
Salida · USD / 1M tokens
$2.2 USD
Precio oficial $4.4 USD
Ahorro
50%
Última verificación
2026-08-09

01

Para qué sirve este modelo

GLM-5.2 es el modelo de texto insignia de Z.ai para tareas de larga duración. Su ficha oficial enumera una ventana de contexto de un millón de tokens, hasta 128.000 tokens de salida, modos de pensamiento, streaming, llamadas a funciones, salida estructurada, integración MCP y caché de contexto. Son capacidades del proveedor; los controles disponibles dependen del cliente y de la ruta API.

En OmniaKey, usa el identificador exacto glm-5.2 con /v1/chat/completions compatible con OpenAI. A 9 de agosto de 2026, el catálogo cobra $0.70 por 1M tokens de entrada sin caché y $2.20 por 1M tokens de salida, el 50 % de las tarifas de Z.ai de $1.40 y $4.40. La ventana de 1M es capacidad medida, no una franquicia gratuita; valida coste y aceptación con tareas representativas.

Elige GLM-5.2 para ingeniería a escala de proyecto, refactorizaciones largas o agentes que deben conservar restricciones durante muchos pasos con herramientas.

Tareas de programación ideales

Análisis de repositorios completos

Mantén arquitectura, contratos API, pruebas, documentación y normas de ingeniería al planificar un cambio acotado.

Implementación de larga duración

Lleva una tarea de varios archivos desde el análisis de dependencias hasta la edición y verificación sin perder restricciones previas.

Flujos de agentes estructurados

Combina funciones, salida legible por máquinas, streaming y contexto reutilizable con permisos y criterios de aceptación explícitos.

02

Especificación técnica

Datos del catálogo e integración verificados para esta ruta.

ID del modelo
glm-5.2
Contexto
1M
Entradas y herramientas
Uso de herramientas
Endpoint API
/v1/chat/completions
Caché / 1M
$0.13 USD
Clientes de programación
Claude Code · Codex · Cursor · Cline · Aider

Límites que debes prever

  • La ficha de Z.ai define GLM-5.2 con entrada y salida de texto; para tareas con imágenes, usa un modelo marcado explícitamente para visión.
  • El límite de 1M no vuelve útil ni barato enviar un repositorio sin filtrar. La recuperación, los límites del cliente, la caché y el volumen de salida siguen afectando al resultado y al coste.
  • Esta página no reproduce de forma independiente los benchmarks de Z.ai. Compara corrección, fiabilidad de herramientas, latencia, reintentos y coste sobre la misma tarea aceptada antes de estandarizar.

03

Compara modelos cercanos

Compara el tipo de trabajo y los precios actuales por token antes de elegir.

ModeloIdeal paraContextoEntradaSalida
GLM-5.2Esta página
glm-5.2
Trabajo de agentes centrado en texto y de larga duración, con contexto de 1M, salida máxima de 128K y precio actual de OmniaKey al 50 % de la tarifa de Z.ai.1M
$0.7 USD
Precio oficial $1.4 USD
$2.2 USD
Precio oficial $4.4 USD
DeepSeek V4 Pro
deepseek-v4-pro
Otra ruta de texto y herramientas con contexto de 1M y tarifas de tokens inferiores; compara calidad aceptada, reintentos y comportamiento de caché.1M
$0.435 USD
Precio oficial $0.435 USD
$0.87 USD
Precio oficial $0.87 USD
Gemini 3.1 Pro Preview
gemini-3.1-pro-preview
Ruta preview de contexto 1M que también admite visión; conviene cuando importa la entrada multimodal y se acepta el ciclo de vida de una vista previa.1M
$1.6 USD
Precio oficial $2 USD
$9.6 USD
Precio oficial $12 USD

04

Inicio rápido con SDK

Usa la misma URL base y el mismo ID desde cURL, Python o TypeScript.

Chat Completion en streaming
curl https://api.omniakey.com/v1/chat/completions \
  -H "Authorization: Bearer $OMNIAKEY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.2",
    "messages": [
      {"role": "user", "content": "Review this pull request"}
    ],
    "stream": true
  }'

05

Calcula el coste de tokens

Introduce los tokens de entrada y salida previstos para comparar las tarifas actuales.

Estimación OmniaKey
0,114 US$
Estimación a precio oficial
0,228 US$
Ahorro estimado
0,114 US$

La estimación solo incluye tokens de entrada y salida. Caché, reintentos, herramientas y el recuento del cliente pueden cambiar el cargo final.

07

Fuentes y verificación

Los datos y enlaces se verificaron el 2026-08-09. La documentación del proveedor manda sobre el comportamiento upstream.

Preguntas frecuentes

¿Cuánto cuesta GLM-5.2 en OmniaKey?

OmniaKey cobra $0.7 USD por 1 M de tokens de entrada y $2.2 USD por 1 M de salida, en USD. Los precios oficiales son $1.4 USD y $4.4 USD; ahorras 50%.

¿Cuál es el contexto de GLM-5.2?

El contexto indicado es 1M. El límite útil también puede depender del cliente y del formato upstream.

¿Qué ID de modelo y endpoint debo usar para GLM-5.2?

Usa el ID exacto glm-5.2 y envía una solicitud compatible con OpenAI a https://api.omniakey.com/v1/chat/completions con autenticación Bearer mediante API Key. No sustituyas el ID por el título de la página ni por el nombre del proveedor.

¿GLM-5.2 admite imágenes u otras entradas multimodales?

La ficha actual de GLM-5.2 de Z.ai marca tanto la entrada como la salida como texto. No confundas los formatos multimodales de la API general de Chat Completions con soporte visual de GLM-5.2; para imágenes, elige un modelo del catálogo marcado para visión.

¿Qué funciones de GLM-5.2 debo validar antes de producción?

Repite solicitudes representativas de controles de pensamiento, streaming, llamadas a funciones, salida estructurada y contabilidad de caché en la versión exacta del SDK y del agente que desplegarás. Valida también cancelación, reintentos, registros de uso y pruebas de aceptación.