Ulasan Claude Opus 5.5
Harga lebih rendah membuatnya layak dicoba, tetapi integrasi API perlu diperiksa sebelum beralih.
Claude Opus 5.5 layak diuji untuk coding rumit dan pekerjaan panjang yang memakai banyak tool. Anthropic merilisnya pada 22 September 2026. Harga API standar turun menjadi US$4 per satu juta token input dan US$20 per satu juta token output, sementara hasil evaluasi yang dipublikasikan meningkat dibandingkan Opus 5.
Namun, mengganti nama model saja belum tentu cukup. Request yang sebelumnya valid bisa menghasilkan error 400, dan antarmuka dapat kehilangan pesan progres di antara pemanggilan tool. Mulai dari medium, pengaturan default baru, lalu bandingkan tugas selesai, total tagihan, dan waktu koreksi manusia.
Diperiksa pada 23 September 2026. Ulasan ini memakai pengumuman dan dokumentasi resmi Anthropic. Kami tidak menjalankan benchmark independen atau pengujian latensi berbayar. Angka performa diberi sumber; contoh biaya dihitung dari harga API langsung.
Apa yang baru di Opus 5.5?
Model pertama dalam keluarga Claude 5.5 ini menargetkan migrasi kode besar, debugging sulit, analisis dokumen, dan tugas bertahap. Anthropic juga melaporkan tulisan yang lebih jelas, pemahaman visual yang lebih baik, serta langkah kerja yang lebih sedikit. Contoh pengguna akses awal berguna untuk memilih skenario evaluasi, bukan jaminan waktu pengerjaan repositori Anda.
| Spesifikasi | Opus 5.5 |
|---|---|
| Tanggal rilis | 22 September 2026 |
| ID API | claude-opus-5-5 |
| Konteks / output standar maksimum | 1M / 128K token |
| Input → output | Teks dan gambar → teks |
| Batas pengetahuan andal | Juni 2026 |
| Thinking / effort default | Adaptif selalu aktif / medium |
| Minimum cache | 512 token |
Konteks 1M dan batas output standar 128K tetap sama dengan Opus 5. Opsi output 300K pada Batch API adalah fitur beta terpisah, bukan batas request sinkron. Memahami gambar atau menulis kode grafis juga berbeda dari menghasilkan gambar dan video secara native.
Perbandingan Opus 5.5 dengan Opus 5
Harga input dan output turun 20%, pembacaan cache turun 60%. Agen yang membaca ulang konteks repositori yang stabil bisa memperoleh manfaat lebih besar dari penghematan cache.
Effort default berubah dari high menjadi medium. Pada level bernama sama, 5.5 dapat berpikir lebih banyak per giliran, terutama pada xhigh dan max. Menyalin pengaturan lama tidak membuat anggaran komputasi tetap sama.
Kontrak API berubah. Thinking tidak bisa dimatikan, pemilihan tool tidak bisa dipaksakan, dan penyuntingan riwayat memiliki aturan baru. Lihat ulasan Opus 5 untuk generasi sebelumnya dan panduan model Claude Code untuk pembagian tugas.
Benchmark dan performa coding
Berikut data dari tabel peluncuran Anthropic. Ini bukan pengujian ulang oleh OmniaKey ataupun pemeriksaan baru atas papan peringkat independen.
| Evaluasi | Opus 5.5 | Opus 5 | Fable 5.1 |
|---|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 52.3% | 55.8% |
| FrontierCode v1.1 Main | 54.4% | 48.0% | 50.3% |
| CursorBench 4.0 | 57.8% | 46.6% | 51.8% |
| GDPval-AA v2.1 | 1846 | 1708 | 1735 |
Hasil 5.5 memakai max kecuali disebutkan lain; Terminal-Bench memakai xhigh dengan standard error ±2,6 poin. Perlindungan produksi aktif, dan sebagian tugas keamanan siber, biologi, serta pengembangan model tingkat lanjut diselesaikan oleh model fallback. Jadi, tabel ini tidak menunjukkan semua model berjalan dalam kondisi identik tanpa pembatasan.
Pada default medium, Anthropic melaporkan 54,6% di FrontierCode dan 52,5% di CursorBench. Nilai pertama sedikit lebih tinggi daripada max pada tabel: effort lebih besar tidak menjamin setiap skor naik. Jangan pula membandingkan GDPval-AA v2.1 langsung dengan angka v2 dari artikel lama.
Hasilnya mendukung uji coba pada pekerjaan sulit, tetapi belum menentukan latensi atau biaya per perubahan yang diterima pada aplikasi Anda.
Berapa harga API Claude Opus 5.5?
Semua harga dalam dolar AS per satu juta token untuk API langsung global standar. Biaya tool, pajak, kurs, lokasi pemrosesan, dan gateway pihak ketiga belum termasuk.
| Kategori biaya | Opus 5.5 | Opus 5 | Penurunan tarif |
|---|---|---|---|
| Input tanpa cache | $4 | $5 | 20% |
| Output termasuk thinking yang ditagihkan | $20 | $25 | 20% |
| Baca cache | $0.20 | $0.50 | 60% |
| Tulis cache 5 menit | $5 | $6.25 | 20% |
| Tulis cache 1 jam | $8 | $10 | 20% |
Jumlah output pada contoh berikut mencakup seluruh token yang ditagihkan, termasuk thinking.
| Jumlah token yang sama | Perhitungan 5.5 | Opus 5.5 | Opus 5 |
|---|---|---|---|
| 100K input + 10K output | 0.1 × $4 + 0.01 × $20 | $0.60 | $0.75 |
| 100K input + 900K cache hit + 10K output | 0.1 × $4 + 0.9 × $0.20 + 0.01 × $20 | $0.78 | $1.20 |
Contoh dengan cache menghemat 35%, tetapi belum memasukkan penulisan cache awal. Pastikan cache hit melalui data usage penyedia; mengirim teks yang sama kembali bukan bukti bahwa cache digunakan.
Klaim resmi biaya tugas tipikal turun 40% menggabungkan tarif dan konsumsi token pada pengaturan default. Itu bukan diskon tetap untuk setiap request. Klaim output lebih dari 30% lebih cepat juga bukan jaminan durasi keseluruhan tugas berkurang sebesar itu.
Fast mode adalah pratinjau riset dengan harga input/output $8/$40 dan kecepatan yang diiklankan hingga 2,5×; opsi API hanya tersedia pada platform milik Anthropic. Batch asinkron berharga $2/$10. Langganan Claude dan penagihan API terpisah; baca panduan harga Claude Code untuk memilih jalur pembayaran.
Cara memakai API: enam pemeriksaan migrasi
- Hapus pengaturan thinking lama.
thinking.type: "disabled"dan"enabled"denganbudget_tokensmenghasilkan 400. Hilangkanthinkingatau gunakanadaptive, lalu aturoutput_config.effort. - Ganti pemilihan tool paksa.
tool_choicetidak mendukunganyatautool. Gunakanautoataunone.strict: truememvalidasi argumen, bukan memaksa pemanggilan. Untuk JSON sesuai schema, pertimbangkan structured outputs. - Pertahankan riwayat. Pada akun yang dibuat sejak 31 Agustus 2026 pukul 00:00 UTC, memutar ulang blok thinking setelah mengubah system, tools, atau pesan sebelumnya dapat memicu 400. Utamakan penambahan giliran dan ikuti aturan preserved thinking saat perlu mengedit.
- Baca blok berdasarkan type. Progres di antara tool kini masuk ke blok
thinking. Defaultdisplay: "omitted"membuat teks kosong. Panduan menjelaskan"summarized"dan beta"updates". Kirim kembali blok thinking tanpa perubahan dalam loop tool. - Periksa computer use per platform. Claude API dan Google Cloud memerlukan
computer_toolset_20260801. Tool lamacomputer_20251124tetap bekerja pada Amazon Bedrock. - Tangani penolakan dan pergantian model. HTTP 200 dengan
stop_reason: "refusal"bukan tugas yang berhasil. Kembali ke Opus 5 tidak mempertahankan thinking 5.5; Fable 5.1 dan Mythos 5.1 pada Claude API adalah pengecualian terdokumentasi yang dapat membacanya.
Contoh minimal ini memakai API langsung Anthropic dan membutuhkan kunci Anthropic. Ini bukan konfigurasi OmniaKey; kami tidak mengeksekusi request berbayar tersebut.
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-opus-5-5",
"max_tokens": 4096,
"output_config": {"effort": "medium"},
"messages": [{"role": "user", "content": "Tinjau rencana migrasi ini dan sebutkan tiga risiko utamanya."}]
}'
Sisakan max_tokens untuk thinking sekaligus jawaban terlihat. Kumpulkan blok text, jangan menganggap content[0] selalu berisi jawaban.
Siapa yang sebaiknya beralih dan di mana tersedia?
Pengguna Opus 5 dapat memulai dari refactoring besar, bug sulit, dan kegagalan yang mahal. Samakan tool, izin, dan kriteria penerimaan. Bandingkan medium dengan high, catat keberhasilan, pengulangan, token, durasi, dan koreksi manusia. Gunakan percakapan baru untuk perbandingan yang bersih.
Sonnet bisa tetap lebih ekonomis untuk edit singkat atau ekstraksi. Pengguna Fable dapat memeriksa apakah 5.5 memenuhi standar kualitas dengan biaya lebih rendah. Anthropic mencantumkan Claude, Claude Code, Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud, dan Microsoft Foundry; kuota dan syarat wilayah mengikuti masing-masing platform.
Artikel ini tidak memverifikasi rute Opus 5.5 yang aktif di OmniaKey. Sebelum memasang gateway, periksa ID dan harga tepatnya di katalog model terbaru.
Pertanyaan umum
Kapan Claude Opus 5.5 dirilis?
22 September 2026. Ini rilis resmi dengan ID claude-opus-5-5.
Apakah lebih bagus dari Opus 5 untuk coding?
Evaluasi yang dipublikasikan Anthropic menunjukkan peningkatan dengan tarif token lebih rendah. Tetap verifikasi loop tool dan tes penerimaan sendiri sebelum memindahkan trafik produksi.
Apakah thinking bisa dimatikan?
Tidak. Adaptive thinking selalu aktif. Turunkan effort jika biaya atau waktu tunggu menjadi masalah, kemudian ukur kualitasnya kembali.
Apakah konteks 1M berarti penggunaan tanpa batas?
Tidak. Itu kapasitas, bukan token gratis. Biaya input, output, cache, tool, dan batas akun tetap berlaku.