CompileDaily
AI

Anthropic Rilis Claude Opus 5.5, Diklaim Lebih Murah 40 Persen dan Lebih Cepat dari Pendahulunya

Admin CompileDaily ·
Bagikan WhatsApp X Facebook Threads
Anthropic Rilis Claude Opus 5.5, Diklaim Lebih Murah 40 Persen dan Lebih Cepat dari Pendahulunya

Original:AdminCompileDaily

Anthropic resmi meluncurkan Claude Opus 5.5 pada Selasa (22/9) waktu Amerika Serikat, model andalan baru yang diklaim mengungguli Fable 5.1 di berbagai benchmark coding agentic sekaligus memangkas biaya operasional hingga 40 persen dibanding Opus 5.

Peluncuran ini datang di tengah persaingan ketat industri AI yang kian sengit soal efisiensi biaya, bukan sekadar skor benchmark semata.

Harga Turun, Performa Naik

Opus 5.5 dibanderol $4 per satu juta token input dan $20 per satu juta token output — turun dari $5 dan $25 pada Opus 5. Anthropic mengklaim penghematan riil bisa mencapai 40 persen karena model baru ini juga membutuhkan token yang jauh lebih sedikit untuk menyelesaikan satu tugas dibanding pendahulunya.

Biaya cache pun ikut dipangkas signifikan. Cache write turun dari $6,25 menjadi $5 per juta token, sementara cache read anjlok dari $0,50 menjadi hanya $0,20 per juta token. Ada juga mode cepat (fast mode) seharga $8 untuk input dan $40 untuk output, dengan kecepatan hingga 2,5 kali lipat lebih tinggi.

Dibandingkan Fable 5.1, Opus 5.5 diklaim 60 persen lebih murah — sekaligus mencatat performa lebih unggul di sejumlah pengujian.

Unggul di Benchmark Coding

Di Terminal-Bench 4.0, Opus 5.5 mencetak skor 66,4 persen, jauh di atas Fable 5.1 (55,8 persen) dan Opus 5 (52,3 persen). Pola serupa terlihat di FrontierCode v1.1 (54,4 persen berbanding 50,3 persen) dan CursorBench 4.0 (57,8 persen berbanding 51,8 persen).

Untuk pekerjaan pengetahuan umum, Opus 5.5 meraih 1846 Elo di GDPval-AA v2.1, mengalahkan Fable 5.1 yang berada di angka 1735. Di ranah computer use, skornya juga naik ke 81,8 persen di OSWorld 2.0, dibanding 74 persen milik Opus 5.

Kecepatan output Opus 5.5 diklaim 30 persen lebih tinggi dari Opus 5, dengan tugas-tugas agentic yang bisa diselesaikan dalam langkah dan token yang jauh lebih sedikit.

Klaim Kinerja di Dunia Nyata

Lihat Layanan Kami

Anthropic membagikan beberapa contoh pengujian yang cukup mencolok. Satu penguji disebut berhasil menuntaskan migrasi kode sebanyak 680.000 baris dalam waktu kurang dari sehari — pekerjaan yang biasanya memakan waktu berminggu-minggu bagi tim insinyur.

Contoh lain, audit dan perbaikan basis kode sebesar 200.000 baris rampung dalam kurang dari tiga jam, padahal Opus 5 membutuhkan lebih dari 20 jam untuk tugas serupa. Untuk pekerjaan menerjemahkan kode HAProxy dari bahasa C ke Rust, Opus 5.5 menyelesaikannya dalam 9,5 jam dengan biaya 51 persen lebih rendah, dibanding 12 jam yang dibutuhkan Fable 5.1.

Chief Product Officer GitHub bahkan menyebut Opus 5.5 memakai "salah satu jumlah token dan langkah tersedikit" di antara model yang diuji di platform mereka.

Klaim Keamanan Juga Meningkat

Anthropic menyebut Opus 5.5 sebagai "model dengan performa terkuat yang pernah kami uji" dalam audit perilaku otomatis yang mencakup hampir 2.000 skenario. Perusahaan mengklaim model ini 85 persen lebih jarang mencoba menerobos batasan keamanan (containment boundary) dibanding Opus 5, serta lebih tahan terhadap serangan prompt injection.

Untuk area sensitif seperti keamanan siber dan biologi, Anthropic tetap menerapkan pembatasan — tugas terkait siber otomatis dialihkan ke model Opus 4.8, sementara akses penuh untuk praktisi terverifikasi disediakan lewat program verifikasi khusus. Model ini juga sudah diuji pihak eksternal sebelum rilis, termasuk oleh Frontier Design dan METR.

Anthropic turut menaikkan batas penggunaan lima jam (5-hour usage limits) untuk paket Pro, Max, Team, dan Enterprise, memberi pengguna lebih banyak keleluasaan dalam memakai model ini.

Persaingan Kian Sengit

Peluncuran Opus 5.5 nyaris berbarengan dengan langkah OpenAI merilis GPT-6 Sol seharga $2/$10 per juta token — persis setengah dari tarif Opus 5.5 — serta model yang lebih murah, Luna, di harga $0,10/$0,50. Persaingan ini menggeser fokus industri dari sekadar unggul di benchmark, menuju pertanyaan yang makin krusial bagi perusahaan: seberapa banyak pekerjaan otonom yang bisa diselesaikan model untuk setiap dolar yang dikeluarkan.

Dengan Opus 5.5, Anthropic tampaknya berupaya menjawab tantangan itu — menggabungkan klaim performa lebih tinggi dengan struktur biaya yang jauh lebih ramah, di saat pasar model AI kelas atas semakin padat pemain.

Komentar (0)

Masuk untuk menulis komentar.

Belum ada komentar.

Kami memakai cookie untuk analisis kunjungan. Baca Kebijakan Privasi kami.