CompileDaily
AI

OpenAI Rilis GPT-5.6 Tiga Tingkat, Langsung Klaim Ungguli Claude Fable 5 di Sejumlah Benchmark

Admin CompileDaily ·
Bagikan WhatsApp X Facebook Threads

Persaingan model AI kelas flagship kembali memanas, kali ini lewat rilis mendadak yang langsung disusul klaim saling unggul dari kedua raksasa AI ini.

OpenAI resmi merilis keluarga model barunya, GPT-5.6, pada 9 Juli 2026. Berbeda dari skema penamaan sebelumnya yang memakai akhiran "Pro" atau "Mini", kali ini OpenAI memperkenalkan tiga tingkatan dengan nama bertema langit: Sol sebagai model andalan (flagship), Terra sebagai opsi kelas menengah yang seimbang, dan Luna sebagai tingkatan tercepat sekaligus termurah.

CEO OpenAI, Sam Altman, mengumumkan peluncuran ini lewat siaran langsung, dan model langsung tersedia secara global hanya dalam hitungan menit setelah pengumuman, tanpa tahap pratinjau bertahap seperti rilis-rilis sebelumnya.

Tiga Tingkatan dengan Kegunaan Berbeda

Sol dirancang untuk menangani reasoning kompleks dan pekerjaan agentic jangka panjang yang berjalan secara mandiri. Terra diposisikan sebagai model seimbang dengan performa setara GPT-5.5 namun dengan biaya separuh lebih murah. Sementara Luna menjadi pilihan paling hemat biaya untuk kebutuhan volume tinggi.

Dari sisi harga, Sol dalam mode Fast (dengan kecepatan hingga 750 token per detik) dibanderol 12,5 dolar AS per juta token input dan 75 dolar AS per juta token output. Terra dipatok 2,5 dolar AS per juta token input dan 15 dolar AS per juta token output, sementara Luna hanya 1 dolar AS per juta token input dan 6 dolar AS per juta token output.

Selain model barunya, OpenAI turut memperkenalkan sejumlah fitur baru, termasuk mode reasoning "Max", Ultra Mode untuk koordinasi banyak agent secara paralel, kemampuan Programmatic Tool Calling yang memungkinkan model menulis kode JavaScript untuk mengatur pemanggilan berbagai tools, hingga sistem prompt caching yang lebih dapat diprediksi. Bersamaan dengan itu, OpenAI juga meluncurkan ChatGPT Work, aplikasi desktop yang menggabungkan fitur Chat, Work, dan Codex dalam satu tampilan.

Klaim Saling Unggul di Berbagai Benchmark

Menurut data yang dipublikasikan OpenAI sendiri, Sol berhasil mengungguli Claude Fable 5 milik Anthropic sebesar 13,1 poin pada benchmark Agents' Last Exam. Sol juga mencatatkan skor 88,8 persen pada Terminal-Bench 2.1, dengan mode Ultra-nya bahkan mencapai 91,9 persen.

Lihat Layanan Kami

Namun Claude Fable 5 tidak sepenuhnya kalah. Berdasarkan data yang dipublikasikan Anthropic, Fable 5 tetap memimpin pada benchmark SWE-Bench Pro dengan skor 80 persen, jauh di atas skor Sol yang tercatat 64,6 persen pada benchmark yang sama. Perbedaan hasil ini menunjukkan bahwa keunggulan salah satu model sangat bergantung pada jenis benchmark dan kasus penggunaan yang diuji, bukan dominasi mutlak di semua lini.

Menanggapi rilis GPT-5.6, Anthropic memperluas akses promosi untuk Claude Fable 5. Selama periode promosi tersebut, pengguna bisa memakai Fable 5 hingga 50 persen dari batas langganan mingguan mereka tanpa biaya tambahan, langkah yang tampak dirancang untuk mempertahankan minat pengguna di tengah gempuran rilis model baru dari kompetitor.

Proses Peninjauan Pemerintah AS

Peluncuran GPT-5.6 sempat melewati proses yang tidak biasa. Merujuk pada perintah eksekutif Presiden Donald Trump yang diterbitkan 2 Juni 2026 soal proses penilaian keamanan model AI baru sebelum rilis luas, OpenAI awalnya membatasi akses model ini hanya untuk sekitar 20 organisasi mitra tepercaya, sebelum akhirnya merilisnya secara global pada 9 Juli.

Meski demikian, seorang pejabat Gedung Putih menegaskan kepada CNBC bahwa pemerintah tidak memberikan "lampu hijau, persetujuan, atau izin resmi" atas peluncuran ini, dan keputusan rilis sepenuhnya berada di tangan masing-masing perusahaan. OpenAI sendiri mengeklaim telah mengalokasikan sekitar 700 ribu jam pemrosesan GPU khusus untuk pengujian keamanan otomatis (red-teaming) terhadap GPT-5.6 sebelum resmi dirilis ke publik.

Latar Belakang Fable 5

Sebagai catatan, Claude Fable 5 sendiri pertama kali dirilis Anthropic pada 9 Juni 2026, sebagai model publik pertama dari kelas Mythos yang sebelumnya hanya tersedia untuk mitra terbatas. Model ini sempat mengalami penangguhan akses akibat kontrol ekspor pemerintah AS pada 12 Juni 2026, sebelum akhirnya dipulihkan secara global pada 1 Juli 2026 dengan classifier keamanan tambahan.

Untuk ranah keamanan siber, OpenAI memposisikan GPT-5.6 Sol lebih sebagai alat bantu bagi tim pertahanan (defender) dalam menemukan dan memperbaiki kerentanan sistem, ketimbang alat yang dapat mengeksekusi serangan siber penuh secara mandiri dan andal, sejalan dengan kekhawatiran otoritas AS soal potensi penyalahgunaan model AI kelas tinggi untuk aktivitas berbahaya.

Dengan kedua model kini sama-sama tersedia luas dan saling mengklaim keunggulan di benchmark berbeda, pemilihan model yang tepat bagi pengembang dan perusahaan kemungkinan besar akan lebih bergantung pada jenis pekerjaan spesifik yang dikerjakan, ketimbang sekadar mengikuti klaim benchmark tertinggi dari masing-masing vendor.

Komentar (0)

Masuk untuk menulis komentar.

Belum ada komentar.

Kami memakai cookie untuk analisis kunjungan. Baca Kebijakan Privasi kami.