GLM-5.2 API Fiyatlandırması
Z.ai, GLM-5.2 için milyon token başına $1,40 girdi, $0,26 önbelleğe alınmış girdi ve $4,40 çıktı listeliyor. OmniaKey şu anda bu oranların %50'sini uyguluyor.
Resmi GLM-5.2 API fiyatlandırması, milyon girdi token'ı başına $1,40, milyon önbelleğe alınmış girdi token'ı başına $0,26 ve milyon çıktı token'ı başına $4,40'tır. OmniaKey aynı modeli şu anda $0,70 girdi, $0,13 önbelleğe alınmış girdi ve $2,20 çıktı fiyatıyla listeliyor.
Oran basittir ancak her isteğin maliyeti toplam token ile başlık girdi fiyatının çarpımının yarısı değildir. Bir istek önbelleksiz girdi, önbelleğe alınmış girdi ve üretilen çıktıyı birlikte içerebilir; her bölüm farklı tarifeye sahiptir.
Fiyatlar 9 Ağustos 2026 tarihinde doğrulandı. Z.ai sütunu Z.ai'ın uluslararası geliştirici fiyatlandırma sayfasından gelir. OmniaKey sütunu güncel platform oranıdır; Z.ai'ın yeni resmi liste fiyatı değildir. Oranlar ve kampanyalar değişebilir, production bütçesini kesinleştirmeden önce iki canlı sayfayı da kontrol edin.
GLM-5.3 güncellemesi: Z.ai, 14 Ağustos'ta GLM-5.3'ü Coding Plan kullanıcılarına açtı; developer API sayfası hâlâ coming soon diyor ve resmi tabloda 5.3 satırı yok. Upgrade kararı için GLM-5.3 ve GLM-5.2 karşılaştırmasını kullanın; aşağıdaki oranlar yalnız GLM-5.2 içindir.
Bir bakışta GLM-5.2 API fiyatlandırması
Aşağıdaki tüm değerler bir milyon token başına ABD dolarıdır.
| Kullanım türü | Z.ai resmi oranı | OmniaKey güncel oranı | Güncel fark |
|---|---|---|---|
| Önbelleksiz girdi | $1,40 | $0,70 | %50 daha düşük |
| Önbelleğe alınmış girdi | $0,26 | $0,13 | %50 daha düşük |
| Çıktı | $4,40 | $2,20 | %50 daha düşük |
Canlı GLM-5.2 model sayfası güncel OmniaKey oranını, bağlamı, yetenekleri ve istek örneğini gösterir. Diğer modellerle karşılaştırmak için model kataloğunu kullanın.
Genel maliyet denklemi şöyledir:
maliyet = önbelleksiz_girdi_milyonu × girdi_oranı
+ önbellekli_girdi_milyonu × önbellek_oranı
+ çıktı_milyonu × çıktı_oranı
Token sayısı karakter veya dosya boyutuyla değil, faturalama sistemiyle ölçülür. Bir milyon karakter her zaman bir milyon token değildir.
Her GLM-5.2 fiyatı ne anlama gelir?
Önbelleksiz girdi
Önbelleksiz girdi, cache hit almayan istek içeriğidir: talimatlar, konuşma geçmişi, dosyalar, araç tanımları ve diğer bağlam. Bir milyon token, herhangi bir çıktı üretilmeden önce resmi oranda $1,40 veya güncel OmniaKey oranında $0,70 tutar.
Önbelleğe alınmış girdi
Önbelleğe alınmış girdi, daha düşük okuma oranıyla sunulmaya uygun tekrarlanan bağlamdır. Z.ai milyon token başına $0,26, OmniaKey $0,13 listeler.
Önbellek oranının bulunması, her tekrarlanan token'ın cache hit olacağını garanti etmez. İstek yapısı, süre sonu ve sağlayıcı davranışı önemlidir. Her tekrarlanan Prompt'u önbellek fiyatıyla tahmin etmek yerine gerçek kullanım kaydını kontrol edin.
Önbelleğe alınmış girdinin saklanması
Z.ai tablosu cached-input storage satırını ayrıca “Limited-time Free” olarak gösterir. Bu, $0,26 önbellek okuma oranıyla aynı kalem değildir. Sınırlı süreli saklama kampanyasının süresi ve şartları bağımsız değişebilir; kalıcı olarak ücretsiz kabul etmeyin.
Çıktı
Çıktı, faturada raporlanan üretilmiş cevap ve reasoning token'larını kapsar. Bir milyon çıktı resmi olarak $4,40, OmniaKey'de şu anda $2,20 tutar. Tablo içindeki en pahalı token türüdür.
Uzun cevaplar, ayrıntılı araç döngüleri, tekrarlanan düzeltmeler ve yüksek çıktı limitleri küçük Prompt değişikliklerinden daha etkili olabilir. Her zaman maksimumu istemek yerine göreve uygun sınır belirleyin.
Yeniden hesaplanabilir üç maliyet örneği
Örnekler yayımlanan oranları doğrudan uygular. Ayrı araç ücretlerini, vergiyi, kur çevrimini veya gelecekteki fiyat değişikliklerini içermez.
Örnek 1: büyük bir depo okuma
Bir görevin bir milyon önbelleksiz girdi token'ı kullandığını ve 100.000 çıktı token'ı ürettiğini varsayın.
| Hesaplama | Z.ai resmi | OmniaKey güncel |
|---|---|---|
| Girdi | 1 × $1,40 = $1,40 | 1 × $0,70 = $0,70 |
| Çıktı | 0,1 × $4,40 = $0,44 | 0,1 × $2,20 = $0,22 |
| Toplam | $1,84 | $0,92 |
Bir milyon token bağlam penceresi kapasitedir, dahil kullanım değildir. Model kısa yanıt verse bile pencereyi önbelleksiz girdilerle doldurmak girdi ücreti oluşturur.
Örnek 2: uzun bir mühendislik iş yükü
Birden fazla çağrının toplam on milyon önbelleksiz girdi ve iki milyon çıktı token'ı kullandığını varsayın.
Z.ai: 10 × $1,40 + 2 × $4,40 = $22,80
OmniaKey: 10 × $0,70 + 2 × $2,20 = $11,40
Bu bir iş yükü toplamıdır, Benchmark tahmini değildir. Gerçek token sayısı client, Prompt, depo, araçlar, yeniden denemeler ve model davranışına bağlıdır.
Örnek 3: tekrarlanan önbellekli bağlam
On milyon token'ın önbelleğe alınmış girdi olarak faturalandığını ve modelin bir milyon çıktı token'ı ürettiğini varsayın.
Z.ai: 10 × $0,26 + 1 × $4,40 = $7,00
OmniaKey: 10 × $0,13 + 1 × $2,20 = $3,50
Bu örnek yalnızca sağlayıcı on milyonu cache hit olarak raporlarsa geçerlidir. Görsel olarak aynı Prompt, aynı faturalama sınıfını garanti etmez.
OmniaKey fiyatı neden Z.ai listesinden farklı?
Z.ai uluslararası upstream API liste oranlarını yayımlar. OmniaKey kendi ön ödemeli gateway'i üzerinden ücretlendirilen fiyatı yayımlar. Doğrulama tarihinde OmniaKey, GLM-5.2'nin önbelleksiz girdi, önbellekli girdi ve çıktısına 0,5 fiyat oranı uygular.
İki sütun farklı faturalama ilişkilerini anlatır:
- doğrudan Z.ai hesabı bütçesinde Z.ai sütununu kullanın;
- istek OmniaKey bakiyesinden düşülecekse OmniaKey sütununu kullanın;
- bir platformun girdi oranını diğerinin çıktı oranıyla birleştirmeyin;
- güncel %50 farkı kalıcı kabul etmeyin.
OmniaKey bu fiyat farkı için istenen model id'sini değiştirmez. İstek hâlâ glm-5.2 adını taşır; model kullanılamıyorsa başka modele sessizce geçmek yerine hata verir.
Genel muhasebe standardı için şeffaf API faturalamasının nasıl çalışması gerektiğini okuyun.
GLM-5.2 bu fiyata ne sunuyor?
Z.ai, GLM-5.2'yi uzun vadeli görevler için amiral gemisi olarak konumlandırır. Resmi sayfa şunları listeler:
- bir milyon token bağlam penceresi;
- 128.000'e kadar çıktı token'ı;
- thinking modları ve ayarlanabilir reasoning effort;
- streaming cevaplar;
- function calling ve MCP entegrasyonu;
- structured output;
- context caching.
Bunlar kapasite ve arayüz gerçekleridir; her client'ın her seçeneği sunduğu anlamına gelmez. Gateway uyumlu API rotası da her kodlama ürününde yerel destek demek değildir.
Fiyat tablosundan evrensel kalite kazananı çıkarılamaz. Z.ai model sayfasında Benchmark ve ürün iddiaları yayımlar, ancak bu makale testleri bağımsız olarak tekrarlamaz.
GLM-5.2 ne zaman ekonomik olabilir?
Görev aşağıdakileri gerektiriyorsa GLM-5.2 mantıklı bir adaydır:
- kod, testler, dokümantasyon ve kısıtlar arasında proje ölçeğinde bağlam;
- uzun, çok adımlı uygulama veya refactor;
- yapılandırılmış araç çağrıları ve makinece okunabilir çıktı;
- önbellekli girdi tarifesine uygun tekrarlanan bağlam;
- büyük üretimler için yüksek çıktı tavanı.
Daha küçük bir modelin güvenilir biçimde tamamladığı dar sınıflandırma, kısa çıkarma veya mekanik düzenleme için ekonomik olmayabilir. Önemli olan fiyat sayfasındaki en büyük indirim değil, görev sınıfındaki en ucuz başarılı modeldir.
Kodlama modeli seçim rehberi, yönlendirmenin neden tek fiyat yerine kabul edilen işe dayanması gerektiğini açıklar.
Kabul edilen görev başına maliyeti ölçün
GLM-5.2'yi başka bir modelle değerlendirirken depo durumunu, Prompt'u, araçları, izinleri ve kabul testini sabit tutun. Şunları kaydedin:
- önbelleksiz, önbellekli ve çıktı token'ları;
- model turları ve araç çağrıları;
- gecikme ve başarısız denemeler;
- insan düzeltme süresi;
- gerekli test ve kabul kriterlerinin geçişi;
- son faturalanan maliyet.
Düşük token oranlı model ek yeniden denemeler yaratırsa daha pahalı olabilir. Yüksek oranlı model zor işi daha az denemede bitirirse ekonomik olabilir. Ajan sonuçları değiştiği için her görevi tekrarlayın.
OmniaKey üzerinden GLM-5.2 çağırın
API Keys panelinde kapsamlı olmayan bir anahtar oluşturun ve OpenAI uyumlu Chat Completions rotasını kullanın:
curl https://api.omniakey.com/v1/chat/completions \
-H "Authorization: Bearer $OMNIAKEY_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [{"role": "user", "content": "Review this migration plan"}],
"stream": true
}'
Kesin glm-5.2 model id'sini kullanın. API hızlı başlangıç rehberi endpoint ve kimlik doğrulamayı belgeler.
Temsili bir görevden sonra client raporunu kullanım paneliyle karşılaştırın. Bakiye ve kullanım rehberi çağrı kayıtları ile anahtar limitlerini açıklar.
Limitleri tasarrufla karıştırmadan bütçeyi kontrol edin
Anahtar harcama limiti finansal riski sınırlar; limit altındaki token tüketimini azaltmaz. Yerel iş, CI ve ortak otomasyon için farklı anahtarlar kullanarak atıf ve iptali ayırın.
Uygulanabilir sıra:
- temsili bir görev çalıştırın;
- gerçek önbelleksiz, önbellekli ve çıktı kullanımını inceleyin;
- gereksiz bağlam ve yeniden denemeleri kaldırın;
- normal görev değişkenliğinin üzerinde limit belirleyin;
- limiti artırmadan önce kullanımı gözden geçirin.
Bağlam optimizasyonu için token kullanımını azaltma rehberini kullanın. Komutlar Claude Code'a özgüdür ancak ilkeler başka ajanlara da uygulanır.
Yaygın fiyatlandırma hataları
1M bağlamı ücretsiz kota saymak
Pencere maksimum kapasitedir. İçine konan girdi kendi sınıfına göre ölçülmeye devam eder.
Önbellek okumasını saklamayla karıştırmak
Z.ai, cache hit oranı ile sınırlı süreli storage kampanyasını ayrı listeler. Birbirinin yerine geçmezler.
Her tekrarlanan Prompt'u önbellekli fiyatlamak
Yalnızca sağlayıcının raporladığı cache hit düşük oranı alır. Gerçek satır kalemini kontrol edin.
Çıktı hacmini ölçmeden fiyat karşılaştırmak
Çıktı token başına daha pahalıdır. Fazla reasoning ve tekrarlanan yamalar Prompt tasarrufunu silebilir.
Bugünkü indirimi kalıcı sözleşme saymak
OmniaKey'in %50 oranı 9 Ağustos 2026 itibarıyla günceldir. Bütçe veya satın alma öncesi canlı kataloğu kontrol edin.
Düşük oranı Benchmark galibiyeti ilan etmek
Fiyat faturalamayı ölçer; doğruluk, gecikme, araç güvenilirliği veya tamamlanmayı değil. Gerçek iş yükünü test edin.
Sık sorulan sorular
GLM-5.2 API ne kadar?
Z.ai milyon önbelleksiz girdi token'ı için $1,40, önbellekli girdi için $0,26 ve çıktı için $4,40 listeler. OmniaKey şu anda $0,70, $0,13 ve $2,20 listeler.
GLM-5.2 OmniaKey üzerinden daha ucuz mu?
9 Ağustos 2026 doğrulamasında evet: OmniaKey oranları Z.ai uluslararası liste fiyatlarının %50'sidir. Bu güncel platform fiyatıdır, kalıcı Z.ai değişikliği değildir.
Bir milyon token'lık GLM-5.2 Prompt'u ne kadar?
Bir milyon önbelleksiz girdi token'ı Z.ai'da $1,40 veya OmniaKey'de $0,70 tutar; çıktı ayrıdır. Milyonun tamamı önbellekli girdi olarak raporlanırsa okuma ücretleri $0,26 ve $0,13'tür.
GLM-5.2'nin 1M bağlamı var mı?
Evet. Z.ai bir milyon token bağlam ve 128.000 maksimum çıktı listeler. Kapasite, pencerenin ücretsiz veya her zaman gerekli olduğu anlamına gelmez.
GLM-5.2 araç çağrısı ve structured output destekliyor mu?
Z.ai function calling, MCP, structured output, streaming, thinking modları ve context caching listeler. Production öncesi kesin client ve API rotasının sunduklarını doğrulayın.
Kaynaklar
- Z.ai: API fiyatlandırması
- Z.ai: GLM-5.2 model özeti
- Z.ai: Chat Completions API
- OmniaKey GLM-5.2 model sayfası
- OmniaKey bakiye ve kullanım dokümantasyonu
Bilgiler 9 Ağustos 2026 tarihinde doğrulandı. Sağlayıcı oranları, platform indirimleri, önbellek şartları ve desteklenen özellikler değişebilir. Production bütçesinden önce first-party dokümantasyonu ve canlı OmniaKey kataloğunu kontrol edin.