Ulasan Gemini 4 Argon: peluncuran kuat, API publik belum tersedia
Argon terlihat seperti peningkatan frontier yang serius, tetapi keputusan yang tepat hari ini adalah menilai buktinya dan menunggu kontrak yang dapat dipanggil sebelum memindahkan trafik produksi.
Gemini 4 Argon adalah model frontier pertama Google dalam generasi Gemini 4. Google mengumumkannya pada 2026-09-30 untuk rekayasa perangkat lunak jangka panjang, pekerjaan pengetahuan perusahaan, dan pertahanan siber. Peluncurannya nyata, tetapi aksesnya bertahap: pertama untuk pembela siber tepercaya melalui Fairwind Program, lalu pelanggan API berbayar dan pelanggan Google AI Ultra.
Ini adalah ulasan peluncuran, bukan benchmark API langsung. Google melaporkan hasil kuat pada DeepSWE, AutomationBench, LVBench, dan evaluasi keamanan. Artificial Analysis memiliki snapshot independen awal, tetapi panel kecepatannya belum lengkap. Kami tidak memakai kredensial Gemini atau menjalankan permintaan berbayar; saat diperiksa, Argon tidak ada di katalog publik OmniaKey.
Diperiksa pada 2026-10-01. Fakta peluncuran dan skor penyedia berasal dari pengumuman serta materi keamanan Google. Angka independen diberi label terpisah. Google belum menerbitkan model ID publik yang stabil, kontrak endpoint, panduan migrasi SDK, atau tanggal ketersediaan umum, jadi kami tidak mengarang contoh permintaan atau mengklaim akses produksi.
Jawaban singkat
| Pertanyaan | Jawaban terverifikasi pada 2026-10-01 |
|---|---|
| Apa yang diluncurkan? | Gemini 4 Argon, model frontier untuk coding, pekerjaan pengetahuan perusahaan, dan pertahanan siber. |
| Apakah semua orang bisa memanggilnya hari ini? | Tidak. Akses dimulai dari pembela tepercaya, lalu pelanggan API berbayar dan Google AI Ultra. |
| Apa API model ID-nya? | Nama produk sudah diumumkan, tetapi ID API publik yang stabil belum ada. Jangan menebak gemini-4-argon. |
| Berapa batas konteks atau output? | Google menyebut batas output 1M token, naik dari 64K pada Gemini sebelumnya. Kontrak input final belum ada. |
| Berapa harga pengantar? | $2 per 1M token input dan $10 per 1M token output; input cache mendapat diskon 95%. |
| Setelah periode pengantar? | Google menyebut $4 input dan $20 output per 1M token. |
| Apakah ada benchmark publik yang dapat direproduksi? | Google melaporkan hasil vendor; Artificial Analysis menunjukkan Intelligence Index awal 53. Kami tidak menjalankan benchmark berbayar sendiri. |
| Apakah OmniaKey merutekan Argon? | Argon tidak ada di katalog publik OmniaKey pada tanggal pemeriksaan. Periksa katalog langsung sebelum migrasi. |
Kesimpulan singkatnya menjanjikan, tetapi belum siap untuk perpindahan produksi tanpa pengujian. Setelah akun Anda dapat memanggilnya, letakkan di urutan teratas evaluasi. Sementara itu, gunakan rute teruji seperti Gemini 3.8 Flash sebagai baseline.
Apa yang diumumkan Google
Google menyebut Argon sebagai model frontier barunya dan mengatakan model itu sudah menjalankan alur kerja internal. Kelompok eksternal pertama adalah pembela siber tepercaya dalam Fairwind Program. Akses akan diperluas ke developer, perusahaan, dan konsumen “secepat mungkin”, dimulai dari pelanggan API berbayar dan Google AI Ultra.
Pengumuman membuktikan modelnya ada, tetapi tidak berarti setiap proyek Google AI Studio, wilayah, SDK, gateway, atau akun dapat memanggilnya. Panduan status Gemini 4 sebelumnya benar saat membedakan program pelatihan bernama dari model API yang dapat dipanggil. Argon kini merupakan produk yang diumumkan; ketersediaan luas tetap harus diperiksa.
Profil kemampuan
| Kemampuan | Yang dipublikasikan | Cara membacanya |
|---|---|---|
| Penalaran jangka panjang | Penalaran mendalam untuk alur kompleks dan multi-langkah | Target penggunaan, bukan jaminan untuk setiap prompt panjang. |
| Rekayasa perangkat lunak | DeepSWE v1.1 sebesar 77.9% dalam laporan Google | Hasil vendor dengan harness dan pengaturan tertentu. |
| Pekerjaan perusahaan | Coding, keuangan, riset hukum, penulisan, dan analisis visual | Tetap perlu tes penerimaan per domain. |
| Multimodal | Memahami grafik, dokumen, dan video panjang | Skema input lengkap belum ada di artikel peluncuran. |
| Pertahanan siber | Menemukan, memvalidasi, dan memperbaiki kerentanan | Akses dan guardrail berbeda antara pembela dan pengguna umum. |
| Ruang output | Hingga 1M token menurut Google | Batas atas, bukan anjuran menghasilkan satu juta token. |
Google juga menceritakan contoh internal: Argon melampaui baseline optimasi kuantum yang dipublikasikan sebesar 40%, membebaskan lebih dari 300 TiB memori dalam analisis armada, dan membuat port Rust decoder libgav1 2,7 kali lebih cepat daripada implementasi Rust yang ada. Ini klaim alur kerja Google, bukan pengukuran independen. Penulisan ulang besar melewati audit otomatis dan manual sebelum produksi.
Profil praktisnya jelas: Argon menyasar tugas yang membutuhkan perencanaan, penggunaan alat, pemeriksaan banyak bukti, dan konsistensi dalam banyak langkah. Pertanyaan chat singkat tidak mengukur keunggulan itu.
Benchmark: sinyal kuat dengan batas jelas
| Evaluasi | Gemini 4 Argon | Yang diukur menurut Google |
|---|---|---|
| DeepSWE v1.1 | 77.9% | Rekayasa perangkat lunak jangka panjang |
| AutomationBench | 51.3% | Eksekusi fungsi bisnis end-to-end |
| LVBench | 91.7% | Pemahaman video panjang |
| CWE-bench v1 | 68% | Perbaikan kerentanan, seri di posisi pertama |
| Vals Finance Agent v2 | Klaim hasil terdepan | Riset keuangan multi-langkah |
| Harvey Legal Agent Benchmark | Klaim hasil terdepan | Riset dan penyusunan hukum |
Angka ini mendukung kesimpulan terbatas: Google menargetkan tugas yang membutuhkan konteks panjang, alat, dan penalaran berkelanjutan. Angka tersebut tidak membuktikan peringkat universal. DeepSWE memakai setup Google, sementara prompt, harness, retry, izin alat, dan kriteria berhenti dapat berbeda.
9to5Google mengutip perbandingan DeepSWE Google: Argon 77.9%, Claude Opus 5.5 74.2%, dan GPT-6 Astra 74.1%. Itu konteks peluncuran, bukan tes independen dengan kondisi sama. Artificial Analysis menampilkan Intelligence Index 53 untuk snapshot penalaran tinggi; kecepatan masih belum tersedia.
Untuk keputusan nyata, catat model, pengaturan penalaran, alat, konteks, retry, token output, latensi, hasil yang diterima, dan menit perbaikan manusia. Satu skor tidak memprediksi biaya atau keandalan agen.
Mengapa keamanan siber membatasi peluncuran
Google tidak memperlakukan Argon sebagai peluncuran model biasa. Pembela tepercaya dan tim internal akan mendapat versi tanpa guardrail siber agar dapat memakai kemampuan defensif penuh, sementara perlindungan terhadap penyalahgunaan diperkuat sebelum rilis luas.
Pengumuman menyebut empat area:
- Mencegah penyalahgunaan. Memantau penyalahgunaan siber dan CBRN sambil menjaga riset dual-use yang sah.
- Indirect prompt injection. Red teaming dan pelatihan adversarial terhadap instruksi tersembunyi dalam konten yang diambil.
- Memantau misalignment. Mengawasi penalaran dan tindakan lalu menghentikan eksekusi jika melewati niat pengguna.
- Memperkuat lingkungan. Mengisolasi dan menyegel sandbox sebelum evaluasi berisiko tinggi.
Ini adalah kontrol keamanan dan peluncuran, bukan izin menguji sistem pihak lain secara ofensif. Gunakan kode milik sendiri, kerentanan sintetis, jaringan terisolasi, dan kondisi berhenti yang jelas.
Harga dan status API
| Item penagihan | Harga Argon yang dipublikasikan Google |
|---|---|
| Input pengantar | $2.00 / 1M token |
| Output pengantar | $10.00 / 1M token |
| Input cache | 95% di bawah harga input, atau $0.10 / 1M pada harga pengantar |
| Setelah pengantar | $4.00 input / $20.00 output per 1M token |
Ini harga penyedia, bukan harga OmniaKey. Pengumuman juga belum menetapkan tanggal ketersediaan umum, model ID persis, endpoint yang diterima, batas laju, ketentuan Batch, aturan wilayah, atau kontrak cache final.
Jangan menempelkan gemini-4-argon ke klien dengan asumsi itu ID yang valid. Saat halaman model tersedia, periksa string persis, versi API, perilaku SDK, kontrol thinking, streaming, skema alat, dan perhitungan output bersama-sama. Katalog live menentukan akses dan harga OmniaKey; pada 1 Oktober Argon belum tercantum.
Anda dapat memeriksa kedua katalog tanpa menaruh kunci di URL:
set -o pipefail
curl --fail-with-body --silent --show-error \
https://generativelanguage.googleapis.com/v1beta/models \
-H "x-goog-api-key: $GEMINI_API_KEY" \
| jq -r '.models[]?.name | sub("^models/"; "") | select(. == "gemini-4-argon" or startswith("gemini-4-argon-"))'
set -o pipefail
curl --fail-with-body --silent --show-error https://api.omniakey.com/v1/models \
-H "Authorization: Bearer $OMNIAKEY_API_KEY" \
| jq -r '.data[]?.id | select(. == "gemini-4-argon" or startswith("gemini-4-argon-"))'
Hasil kosong hanya berlaku untuk kredensial dan waktu tersebut. Itu tidak membuktikan tidak adanya akses privat dan bukan alasan membuat alias produksi.
Apa kata snapshot independen awal?
Artificial Analysis mencantumkan Gemini 4 Argon (High) sebagai model penalaran dengan input teks dan gambar, output teks, serta konteks 1M token. Intelligence Index-nya 53, jauh di atas median sekitar 26, dengan estimasi $1.99 per tugas indeks. Evaluasinya menghasilkan 110M token, sedangkan mediannya 82M.
Halaman yang sama menandai kecepatan output tidak tersedia dan harga penyedia masih awal. Ini sinyal awal kualitas dan panjang output, bukan janji latensi atau pengganti tarif Google. Simpan tanggal pemeriksaan saat mengutipnya.
Cara mengevaluasi saat akses dibuka
Gunakan set evaluasi tetap, bukan kumpulan prompt peluncuran:
- Perubahan repositori. Fitur terbatas dengan tes deterministik dan diff yang mudah ditinjau.
- Debug panjang. Kegagalan lintas modul dengan akar masalah yang diketahui tetapi tidak jelas.
- Izin alat. Baca yang diizinkan, tulis yang ditolak, argumen salah, pembatalan, dan retry.
- Pekerjaan pengetahuan. Dokumen finansial atau hukum dengan sumber dan rubrik.
- Konteks multimodal. Video panjang, grafik, atau kumpulan dokumen dengan jawaban yang diketahui.
- Sandbox keamanan. Kerentanan sintetis dan verifikasi bahwa model berhenti di batas.
Simpan ID model dan penyedia, pengaturan penalaran dan alat, token input/cache/penalaran/output, waktu token pertama, latensi total, retry dan error, lulus pada percobaan pertama, menit perbaikan, dan biaya langsung atau gateway.
Bandingkan dengan Gemini 3.8 Flash, Claude Opus 5.5, atau GPT-6 Astra pada commit dan alat yang sama. Skor lebih tinggi dengan lebih banyak retry dapat lebih mahal.
Putusan: masukkan ke antrean, jangan migrasi otomatis
Gemini 4 Argon adalah salah satu pengumuman model terpenting pada 2026. Hasil DeepSWE, pekerjaan perusahaan, video, dan keamanan siber sesuai dengan tujuannya untuk tugas panjang yang menggunakan alat. Saat API dibuka, batas output 1M dan harga awal $2/$10 memungkinkan pilot terukur.
Batasnya jelas: Google mengendalikan tabel utama, model ID dan kontrak SDK publik belum ada, akses bertahap, dan data kecepatan independen belum siap. Tetapkan baseline sekarang, minta akses lewat jalur terdokumentasi, dan beralih hanya setelah set penerimaan yang sama lulus. Lihat katalog model untuk rute OmniaKey; selama Argon diluncurkan, panduan harga Gemini 3.8 Flash tetap menjadi referensi biaya Google.
Pertanyaan umum
Apakah Gemini 4 Argon tersedia untuk semua orang?
Belum. Google memulai dari pembela siber tepercaya Fairwind, kemudian pelanggan API berbayar dan Google AI Ultra. Tanggal ketersediaan umum belum ada.
Apa API model ID Gemini 4 Argon?
Google mengumumkan nama produk, tetapi materi peluncuran belum memberikan ID publik yang stabil. Perlakukan gemini-4-argon sebagai teks pencarian sampai halaman model dan Models API mengembalikan ID persis.
Berapa harga Gemini 4 Argon?
Harga pengantar adalah $2 per 1M token input dan $10 per 1M output; input cache 95% lebih murah. Setelahnya Google menyebut $4 dan $20. Ini bukan harga OmniaKey.
Apakah Argon memiliki konteks satu juta token?
Google menyebut batas output 1M, naik dari 64K. Artificial Analysis mencantumkan konteks 1M. Pastikan kontrak input dan output akhir pada dokumentasi Google sebelum menghitung anggaran.
Haruskah saya mengganti Gemini 3.8 Flash sekarang?
Tidak otomatis. Pertahankan rute yang sudah tervalidasi sebagai baseline dan ulangi tugas yang sama setelah akses, harga, dan perilaku SDK Argon terdokumentasi.
Sumber yang diperiksa
Sumber resmi:
- Google: pengumuman Gemini 4 Argon — cakupan, kemampuan, harga, benchmark, dan rollout keamanan
- Katalog model Google Gemini API — daftar publik
- Referensi Models Google Gemini API — ketersediaan tingkat akun
Sumber independen dan sekunder:
- Artificial Analysis: Gemini 4 Argon (High) — Intelligence Index awal, biaya per tugas, konteks, dan status kecepatan
- 9to5Google: pengumuman Gemini 4 Argon — perbandingan benchmark dan rollout
- Ars Technica: mengapa Argon belum tersedia luas — akses dan keamanan
- TechCrunch: peluncuran Gemini 4 Argon — liputan independen
Diperiksa pada 2026-10-01. Harga, ketersediaan, model ID, dan hasil dapat berubah; periksa halaman model Google terbaru dan katalog live OmniaKey sebelum mengubah konfigurasi produksi.