DeepSeek V4 Flash está ativo · Nosso preço GLM-5.2 caiu para 50% da lista
Todos os modelos
Z.ai · API

GLM-5.2 API

Use o contexto 1M com uma chave de API OmniaKey.

ID do modelo
glm-5.2
Contexto
1M
Provedor
Z.ai
Entrada · Tokens USD/1 milhão
$0.7 USD
Preço oficial $1.4 USD
Saída · Tokens USD/1 milhão
$2.2 USD
Preço oficial $4.4 USD
Poupança
50%
Última verificação
2026-08-09

01

Para que serve este modelo

GLM-5.2 é o principal modelo de texto da Z.ai para tarefas de longo horizonte. Sua referência de modelo oficial lista uma janela de contexto de 1 milhão de tokens, até 128.000 tokens de saída, modos de pensamento, streaming, chamada de função, saída estruturada, integração MCP e cache de contexto. Estas são capacidades do provedor; os controles exatos expostos ainda dependem do cliente e da rota da API.

No OmniaKey, chame o ID exato do modelo glm-5.2 por meio do endpoint /v1/chat/completions compatível com OpenAI. Em 9 de agosto de 2026, o catálogo atual cobra US$ 0,70 por 1 milhão de tokens de entrada sem cache e US$ 2,20 por 1 milhão de tokens de saída, metade das taxas de lista de US$ 1,40 e US$ 4,40 da Z.ai. Trate a janela de 1 milhão como capacidade medida, não como subsídio gratuito, e valide o custo e a taxa de aceitação do trabalho representativo.

Escolha o GLM-5.2 para engenharia em escala de projeto, refatoradores de longa duração ou fluxos de trabalho de agentes que devem preservar restrições em muitas etapas orientadas por ferramentas.

Cargas de trabalho de codificação mais adequadas

Análise de repositório em escala de projeto

Mantenha a arquitetura, os contratos de API, os testes, a documentação e as regras de engenharia no escopo enquanto planeja uma mudança limitada.

Implementação de longo horizonte

Execute uma tarefa de vários arquivos, desde a análise de dependência até edições e verificação, sem eliminar as restrições anteriores.

Fluxos de trabalho de agentes estruturados

Combine chamadas de função, saída legível por máquina, streaming e contexto reutilizável em automação com permissões explícitas e verificações de aceitação.

02

Especificação técnica

Fatos de catálogo e detalhes de integração verificados para esta rota.

ID do modelo
glm-5.2
Contexto
1M
Entradas e ferramentas
Uso de ferramentas
Ponto de extremidade da API
/v1/chat/completions
Acertos no cache / 1 milhão
$0.13 USD
Codificando clientes
Claude Code · Codex · Cursor · Cline · Aider

Limites para planejar

  • O cartão modelo da Z.ai lista GLM-5.2 como entrada e saída de texto; use um modelo explicitamente marcado para visão quando a tarefa exigir imagens.
  • Um limite de contexto de 1 milhão não torna um repositório não filtrado útil ou barato. A qualidade da recuperação, os limites do cliente, a elegibilidade do cache e o volume de saída ainda afetam os resultados e os custos.
  • O benchmark e as afirmações do produto da Z.ai não são reproduzidos aqui de forma independente. Teste a exatidão, a confiabilidade da chamada de ferramenta, a latência, as novas tentativas e o custo na mesma tarefa aceita antes de padronizar.

03

Compare modelos próximos

Compare o ajuste da carga de trabalho e as taxas atuais de token listadas antes de escolher uma rota.

ModeloMelhor paraContextoEntradaSaída
GLM-5.2Esta página
glm-5.2
O agente de longo horizonte que prioriza o texto trabalha com contexto de 1 milhão, um teto de saída de 128K e preços atuais do OmniaKey de 50% das taxas de lista Z.ai.1M
$0.7 USD
Preço oficial $1.4 USD
$2.2 USD
Preço oficial $4.4 USD
DeepSeek V4 Pro
deepseek-v4-pro
Outra rota de uso de texto e ferramentas com contexto de 1 milhão e taxas de token listadas mais baixas; compare a qualidade das tarefas aceitas, as novas tentativas e o comportamento do cache.1M
$0.435 USD
Preço oficial $0.435 USD
$0.87 USD
Preço oficial $0.87 USD
Gemini 3.1 Pro Preview
gemini-3.1-pro-preview
Uma rota de visualização de contexto de 1M que também aceita entrada de visão; escolha-o quando a entrada multimodal for importante e um ciclo de vida de visualização for aceitável.1M
$1.6 USD
Preço oficial $2 USD
$9.6 USD
Preço oficial $12 USD

04

Guias de início rápido do SDK

Use um URL base e um ID de modelo de cURL, Python ou TypeScript.

Conclusão do chat de streaming
curl https://api.omniakey.com/v1/chat/completions \
  -H "Authorization: Bearer $OMNIAKEY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.2",
    "messages": [
      {"role": "user", "content": "Review this pull request"}
    ],
    "stream": true
  }'

05

Estimar o custo do token

Insira os tokens de entrada e saída esperados para comparar as taxas listadas atuais.

Estimativa OmniaKey
US$ 0,114
Estimativa da taxa oficial
US$ 0,228
Economia estimada
US$ 0,114

A estimativa cobre apenas tokens de entrada e saída. O uso do cache, novas tentativas, ferramentas e contabilidade de token do lado do cliente podem alterar a cobrança final.

07

Fontes e verificação

Os fatos e links do modelo foram verificados em 2026-08-09. A documentação do provedor continua sendo a autoridade para o comportamento upstream.

Perguntas frequentes

Quanto custa GLM-5.2 no OmniaKey?

OmniaKey cobra $0.7 USD por 1 milhão de tokens de entrada e $2.2 USD por 1 milhão de tokens de saída, em dólares americanos. Os preços oficiais são $1.4 USD e $4.4 USD; você salva 50%.

Qual é a janela de contexto para GLM-5.2?

A janela de contexto listada é 1M. Os limites utilizáveis ​​reais também podem depender do formato da solicitação do cliente e do upstream.

Qual ID de modelo e endpoint devo usar para GLM-5.2?

Use o ID exato do modelo glm-5.2 e envie uma solicitação compatível com OpenAI para https://api.omniakey.com/v1/chat/completions com autenticação de chave API Bearer. Não substitua o título da página ou o nome de exibição do provedor pelo ID do modelo.

O GLM-5.2 aceita imagens ou outras entradas multimodais?

O cartão modelo GLM-5.2 atual da Z.ai lista a entrada e a saída como texto. Não confunda os formatos multimodais da API geral de Chat Completions com suporte de visão GLM-5.2; escolha um modelo de catálogo explicitamente marcado para visão quando imagens forem necessárias.

Quais recursos do GLM-5.2 devo verificar antes da produção?

Reproduza solicitações representativas de controles de pensamento, streaming, chamadas de função, saída estruturada e contabilidade de cache no SDK exato e na versão do agente que você implantará. Verifique também o cancelamento, as novas tentativas, os registros de uso e os testes de aceitação antes de aumentar um limite de chave.