- モデルID
- glm-5.2
- コンテキスト
- 1M
- プロバイダー
- Z.ai
- 入力 · USD / 100万トークン
- $0.7 USD
- 正式価格 $1.4 USD
- 出力 · USD / 100万トークン
- $2.2 USD
- 正式価格 $4.4 USD
- 割引
- 50%
- 最終確認済み
- 2026-08-09
01
このモデルの用途
GLM-5.2 は、長期的なタスクに対応する Z.ai の主力テキスト モデルです。公式モデル リファレンスには、100 万トークンのコンテキスト ウィンドウ、最大 128,000 の出力トークン、思考モード、ストリーミング、関数呼び出し、構造化出力、MCP 統合、およびコンテキスト キャッシュがリストされています。これらはプロバイダーの機能です。公開される正確なコントロールは依然としてクライアントと API ルートに依存します。
OmniaKey では、OpenAI 互換の /v1/chat/completions エンドポイントを介して、正確なモデル ID glm-5.2 を呼び出します。 2026 年 8 月 9 日の時点で、現在のカタログの料金は、キャッシュされていない入力トークン 100 万個あたり 0.70 ドル、出力トークン 100 万個あたり 2.20 ドルで、Z.ai のリスト料金の 1.40 ドルと 4.40 ドルの半分です。 1M ウィンドウを無料の割り当てではなく従量制の容量として扱い、代表的な作業のコストと受け入れ率を検証します。
最適なコーディング ワーClaude
プロジェクト規模のリポジトリ分析
限定的な変更を計画しながら、アーキテクチャ、API 契約、テスト、ドキュメント、エンジニアリング ルールを範囲内に保ちます。
長期的な視野での実装
以前の制約を削除することなく、依存関係の分析から編集および検証までの複数ファイルのタスクを実行します。
構造化されたエージェントのワークフロー
明示的な権限と受け入れチェックを使用して、関数呼び出し、機械可読出力、ストリーミング、再利用可能なコンテキストを自動化で組み合わせます。
02
技術仕様
このルートに関して検証されたカタログの事実と統合の詳細。
- モデルID
- glm-5.2
- コンテキスト
- 1M
- インプットとツール
- ツールの使用
- APIエンドポイント
- /v1/chat/completions
- キャッシュ ヒット / 1M
- $0.13 USD
- コーディングクライアント
- Claude Code · Codex · Cursor · Cline · Aider
計画の限界
- Z.ai のモデル カードには、テキスト入力およびテキスト出力として GLM-5.2 がリストされています。タスクに画像が必要な場合は、視覚用に明示的にマークされたモデルを使用します。
- 1M コンテキスト制限によって、フィルターされていないリポジトリが便利になったり、安価になったりすることはありません。取得の品質、クライアントの制限、キャッシュの適格性、出力量は依然として結果とコストに影響します。
- Z.ai のベンチマークと製品の主張は、ここでは独立して複製されるものではありません。標準化する前に、受け入れられた同じタスクの正確性、ツール呼び出しの信頼性、待ち時間、再試行、コストをテストします。
03
近くのモデルを比較する
ルートを選択する前に、ワーClaudeの適合性と現在リストされているトークン レートを比較してください。
| モデル | こんな方に最適 | コンテキスト | 入力 | 出力 |
|---|---|---|---|---|
| GLM-5.2このページ glm-5.2 | テキストファーストの長期エージェントは、1M コンテキスト、128K 出力上限、および現在の OmniaKey 価格は Z.ai リスト料金の 50% で動作します。 | 1M | $0.7 USD 正式価格 $1.4 USD | $2.2 USD 正式価格 $4.4 USD |
| DeepSeek V4 Pro deepseek-v4-pro | 1M コンテキストと下位リストのトークン レートを持つ別のテキストとツールの使用ルート。受け入れられたタスクの品質、再試行、キャッシュ動作を比較します。 | 1M | $0.435 USD 正式価格 $0.435 USD | $0.87 USD 正式価格 $0.87 USD |
| Gemini 3.1 Pro Preview gemini-3.1-pro-preview | ビジョン入力も受け入れる 1M コンテキストのプレビュー ルート。マルチモーダル入力が重要で、プレビューのライフサイクルが許容される場合に選択してください。 | 1M | $1.6 USD 正式価格 $2 USD | $9.6 USD 正式価格 $12 USD |
04
SDKクイックスタート
cURL、Python、または TypeScript からの 1 つのベース URL とモデル ID を使用します。
curl https://api.omniakey.com/v1/chat/completions \
-H "Authorization: Bearer $OMNIAKEY_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [
{"role": "user", "content": "Review this pull request"}
],
"stream": true
}'05
トークンのコストを見積もる
予想される入力トークンと出力トークンを入力して、現在リストされているレートを比較します。
- OmniaKey の推定値
- $0.114
- 公定料金の見積り
- $0.228
- 推定節約額
- $0.114
推定には入力トークンと出力トークンのみが含まれます。キャッシュの使用量、再試行、ツール、クライアント側のトークン アカウンティングによって、最終的な料金が変わる可能性があります。
06
関連するコーディングガイド
このモデル ファミリの選択、セットアップ、トラブルシューティングに関する詳細なガイダンス。
GLM-5.3 vs GLM-5.2 for Coding
GLM-5.3 keeps the GLM-5.2 base model but changes the coding decision through stronger post-training, new effort controls, and a breaking thinking-mode migration.
ガイドを読むGLM-5.2 API Pricing
Z.ai lists GLM-5.2 at $1.40 input, $0.26 cached input, and $4.40 output per million tokens. OmniaKey currently charges 50% of those rates.
ガイドを読むBest LLM for Coding Agents in 2026: Claude vs GPT vs Gemini
There's no single best coding model — Claude, GPT, and Gemini each win a different axis. How they compare on tool use, context, and cost, and why routing beats picking just one.
ガイドを読む07
出典と検証
モデルのファクトとリンクは 2026-08-09 でチェックされました。プロバイダーの文書は、上流の動作に関する権限を維持します。
よくある質問
OmniaKey の GLM-5.2 の料金はいくらですか?
OmniaKey は、100 万の入力トークンごとに $0.7 USD を、100 万の出力トークンごとに $2.2 USD を米ドルで請求します。正式な価格は $1.4 USD および $4.4 USD です。 50% を保存します。
GLM-5.2 のコンテキスト ウィンドウとは何ですか?
リストされているコンテキスト ウィンドウは 1M です。実際に使用可能な制限は、クライアントとアップストリームのリクエスト形式によっても異なる場合があります。
GLM-5.2 にはどのモデル ID とエンドポイントを使用すればよいですか?
正確なモデル ID glm-5.2 を使用し、ベアラー API キー認証を使用して OpenAI 互換リクエストを https://api.omniakey.com/v1/chat/completions に送信します。モデル ID をページ タイトルやプロバイダーの表示名に置き換えないでください。
GLM-5.2 は画像やその他のマルチモーダル入力を受け入れますか?
Z.ai の現在の GLM-5.2 モデル カードでは、入力と出力の両方がテキストとしてリストされます。一般的な Chat Completions API のマルチモーダル形式を GLM-5.2 ビジョン サポートと混同しないでください。画像が必要な場合は、視覚用に明示的にマークされたカタログ モデルを選択してください。
GLM-5.2 のどの機能を実稼働前に検証する必要がありますか?
デプロイする正確な SDK およびエージェントのバージョンで、思考制御、ストリーミング、関数呼び出し、構造化出力、およびキャッシュ アカウンティングの代表的なリクエストを再生します。また、キー制限を上げる前に、キャンセル、再試行、使用記録、および受け入れテストを確認してください。