Ulasan Claude Sonnet 5.5
Model harian yang lebih cepat, dengan perubahan kontrak API yang perlu diuji sebelum upgrade.
Claude Sonnet 5.5 adalah peningkatan praktis untuk pekerjaan harian dalam keluarga Claude 5.5 dari Anthropic. Model ini dirilis pada 28 September 2026. Harga token API standarnya sama dengan Sonnet 5, tetapi Anthropic menyatakan bahwa generasinya lebih dari 30% lebih cepat dan biaya per tugas bisa turun hingga 30% karena model memakai lebih sedikit token. Nilai yang dipublikasikan untuk coding dan pekerjaan pengetahuan juga mendekati Opus 5.5.
Itu tidak berarti Sonnet 5.5 menggantikan Opus untuk semua pekerjaan. Model ini paling cocok untuk fitur yang ruang lingkupnya jelas, bug yang dapat direproduksi, dokumen, spreadsheet, dan siklus agent yang cepat. Bagi developer, perubahan terpenting ada pada kontrak API: client Sonnet 5 yang mematikan thinking, memaksa pemanggilan tool, memakai computer use lama, atau hanya membaca content[0] harus diuji sebelum ID model diganti.
Diperiksa 29 September 2026. Ulasan ini memakai pengumuman Anthropic dan dokumentasi Claude Platform terbaru. Benchmark, kecepatan, dan klaim penghematan berasal dari Anthropic; kami tidak menjalankan benchmark berbayar independen atau pengukuran latensi. Contoh biaya memakai harga API langsung global dengan jumlah token yang sama.
Spesifikasi Claude Sonnet 5.5
| Spesifikasi | Claude Sonnet 5.5 |
|---|---|
| Tanggal rilis | 28 September 2026 |
| ID model Claude API | claude-sonnet-5-5 |
| Jendela konteks | 1M token |
| Output maksimum standar | 128K token |
| Input / output | $2 / $10 per juta token |
| Tulis / baca cache | $2.50 / $0.20 per juta token |
| Thinking | Adaptive secara default |
| Effort default | high |
| Latensi relatif | Fast |
| Batas pengetahuan tepercaya | Juni 2026 |
| Input dan output | Teks dan gambar → teks |
Model tersedia di Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, dan Claude Platform on AWS. ID dapat berbeda menurut platform, jadi periksa tabel ketersediaan penyedia sebelum mengubah produksi. Messages API sinkron menyediakan konteks 1M dan output 128K; Batch API dapat mencapai 300K dengan beta header yang didokumentasikan.
Apa yang membaik dari Sonnet 5?
Anthropic menonjolkan kecepatan generasi lebih dari 30% dan biaya per tugas hingga 30% lebih rendah. Harga per token tidak dipotong; penghematannya berasal dari output yang lebih pendek dan langkah tool yang lebih sedikit.
Pengumuman mencantumkan hasil berikut dibandingkan Sonnet 5:
| Evaluasi | Sonnet 5.5 | Sonnet 5 | Yang diukur |
|---|---|---|---|
| Terminal-Bench 4.0 | 70,6% | 10,3% | Coding terminal multi-langkah |
| CursorBench 4.0 | 55,5% | 34,1% | Tugas coding-agent yang ambigu |
| GDPval-AA v2.1 | 1844 | 1449 | Pekerjaan pengetahuan lintas profesi |
| AA-Briefcase v1.1 | 1811 | 1359 | Pekerjaan pengetahuan jangka panjang |
| Humanity’s Last Exam | 64,5% | 54,9% | Penalaran multidisiplin dengan tool |
| OSWorld 2.1 | 80,1% partial | 57,0% partial | Computer use |
| Chartography | 61,6% | 15,6% | Pengenalan grafik visual |
Angka ini adalah sinyal dari kondisi pengujian, bukan tingkat keberhasilan di repository Anda. CursorBench mendekati 57,8% milik Opus 5.5 dan GDPval mendekati 1846, tetapi Anthropic tetap menilai Opus lebih kuat untuk pekerjaan terbuka yang membutuhkan penilaian berkelanjutan. Kesimpulan yang aman: jarak menyempit pada pekerjaan berulang, bukan kebutuhan terhadap model eskalasi hilang.
Grafik biaya Anthropic memasukkan effort, tool, dan seluruh token tugas. Saat membandingkan dengan halaman model Opus 5.5 atau rute Sonnet yang sekarang, samakan prompt, izin, commit, tool, dan tes penerimaan.
Harga API tidak berubah
Sonnet 5.5 memakai harga API langsung Sonnet 5:
| Komponen | Harga |
|---|---|
| Input tanpa cache | $2 / MTok |
| Output, termasuk token thinking yang ditagihkan | $10 / MTok |
| Tulis cache 5 menit | $2.50 / MTok |
| Tulis cache 1 jam | $4 / MTok |
| Baca cache | $0.20 / MTok |
| Batch API | Diskon 50% untuk input dan output |
Tugas tanpa cache dengan 100K token input dan 20K output berharga 0.1 × $2 + 0.02 × $10 = $0.40. Jika 80K input menjadi cache hit, jumlah token yang sama berharga 0.02 × $2 + 0.08 × $0.20 + 0.02 × $10 = $0.376, belum termasuk penulisan cache pertama. Thinking, tool, retry, dan jumlah putaran mengubah tagihan sebenarnya.
Karena itu, “hingga 30% lebih murah per tugas” bukan diskon tetap pada setiap invoice. Ukur biaya total per perubahan yang diterima setelah tes atau review. Harga gateway OmniaKey adalah jalur terpisah; buka katalog model terbaru sebelum membuat anggaran.
Enam hal yang harus diperiksa saat migrasi
ID baru adalah claude-sonnet-5-5, tetapi semua pengaturan Sonnet 5 tidak bisa dipindahkan begitu saja.
- Thinking default adalah Adaptive. Hilangkan
thinkingatau gunakan{"type":"adaptive"}. Untuk mematikan thinking di awal, pakaithinking: {"type":"between_tools"}.{"type":"disabled"}danbudget_tokensmanual menghasilkan 400. - Pemanggilan tool secara paksa tidak didukung.
tool_choicebertipeanyatautoolmenghasilkan 400. Gunakanautoataunone, lalu strict tools atau structured outputs untuk schema. - Thinking block terikat pada model dan percakapan. Sonnet 5.5 dapat membaca block Sonnet 5, tetapi Opus 5 dan Opus 5.5 tidak dapat membaca block yang dibuat Sonnet 5.5. Pergantian model di tengah percakapan mengubah konteks yang terlihat.
- Jangan mengedit riwayat lalu mengirim ulang block tanpa pemeriksaan. Mengubah system, tools, atau pesan lama dapat menghasilkan 400 dengan pemeriksaan binding baru. Tambahkan instruksi atau gunakan kontrol binding yang didokumentasikan.
- Perbarui computer use sesuai platform. Claude API dan Google Cloud memerlukan
computer_toolset_20260801; Bedrock masih menerimacomputer_20251124. - Baca respons berdasarkan tipe block. Progress di antara tool dapat masuk sebagai
thinking. Client yang hanya merendertextdapat terlihat diam walaupun permintaan berhasil.
Contoh request adaptive minimal:
{
"model": "claude-sonnet-5-5",
"max_tokens": 4096,
"output_config": {"effort": "high"},
"messages": [
{"role": "user", "content": "Tinjau migrasi ini dan sebutkan tiga risiko terbesarnya."}
]
}
Periksa kembali temperature, top_p, dan top_k non-default; endpoint saat ini dapat menolaknya. Sisakan ruang di max_tokens untuk thinking dan jawaban yang terlihat.
Posisi dalam workflow nyata
Mulailah dengan Sonnet 5.5 untuk fitur yang terdefinisi, bug yang dapat direproduksi, tes untuk interface yang dikenal, code review terbatas, draft dokumen, atau langkah agent bervolume tinggi. Test, typecheck, build, dan screenshot membantu menunjukkan apakah model yang lebih murah sudah cukup.
Naikkan effort atau pindah ke model yang lebih kuat saat pekerjaan melintasi beberapa layanan, membutuhkan keputusan arsitektur yang sulit dibalik, atau kekurangan informasi. Jika Sonnet sudah diberi file dan tool yang tepat tetapi tetap salah menemukan akar masalah, itu sinyal kemampuan. Jika konteks yang kurang menjadi masalah, perbaiki konteks terlebih dahulu.
Di Claude Code, bandingkan sesi baru dengan commit, prompt, izin, dan tes penerimaan yang sama. Catat waktu hingga output berguna pertama, waktu total, token, retry, tool gagal, dan menit perbaikan manusia. Generasi token yang cepat bisa hilang karena satu putaran review tambahan.
Kesimpulan
Claude Sonnet 5.5 layak menjadi kandidat pertama untuk coding dan pekerjaan pengetahuan sehari-hari. Harganya tetap, kecepatannya dan hasil publiknya meningkat, sehingga pekerjaan yang ruang lingkupnya jelas punya alasan kuat untuk pindah dari Sonnet 5.
Jangan deploy hanya dengan mengganti satu string. Uji thinking, tool choice, parser block, dan computer use. Simpan Opus 5.5 untuk arsitektur ambigu, debugging sulit, dan keputusan berisiko tinggi. Untuk perbandingan model, lihat perbandingan Opus 5.5 dan Sonnet 5.
Pertanyaan umum
Kapan Claude Sonnet 5.5 dirilis?
Anthropic merilisnya pada 28 September 2026. ID Claude API langsungnya adalah claude-sonnet-5-5.
Apakah Sonnet 5.5 lebih murah dari Sonnet 5?
Harga per token sama: $2 per juta input, $10 per juta output, dan $0.20 per juta cache read. Anthropic melaporkan biaya per tugas hingga 30% lebih rendah karena konsumsi yang lebih kecil.
Apakah Sonnet 5.5 lebih baik dari Opus 5.5?
Tergantung tugasnya. Sonnet lebih cepat dan murah untuk pekerjaan terarah; Opus lebih kuat untuk penilaian kompleks dan terbuka. Bandingkan hasil yang diterima, biaya total, dan waktu perbaikan.
Bisakah thinking dinonaktifkan?
thinking: {"type":"disabled"} lama tidak dapat dipakai. Gunakan Adaptive atau thinking: {"type":"between_tools"} pada effort yang didukung.
Apakah konteksnya 1M?
Ya, dengan output standar maksimum 128K. Itu batas kapasitas, bukan kredit gratis atau penggunaan tanpa batas.