OpenAI Rilis GPT-5.6: Tiga Tier Solution, Skor Coding Tertinggi, Dan White House Minta Lambatkan
OpenAI resmi memperkenal keluarga model GPT-5.6 pada 9 Juli 2026, setelah pemerintah Amerika Serikat meminta peluncuran bertahap karena masalah keamanan. Keluarga ini hadir dalam tiga varian harga — Sol, Terra, dan Luna — masing-masing dirancang untuk segmen pengguna yang berbeda.
White House Minta Lambatkan Peluncuran
Sebelum GPT-5.6 meluncur ke publik, pemerintahan Trump secara khusus meminta OpenAI untuk tidak langsung membuka akses secara luas. Berdasarkan laporan TechCrunch (25 Juni 2026), Gedung Putih menginginkan OpenAI menyetujui akses pelanggan demi pelanggan selama fase awal peluncuran.
Permintaan ini muncul karena kekhawatiran bahwa model setingkat GPT-5.6 membawa risiko keamanan yang belum sepenuhnya teratasi. OpenAI kemudian membuka akses untuk kelompok partner terpercaya lebih dulu, sebelum membukaGPT-5.6 untuk umum pada 9 Juli 2026.
Tiga Tier Solution: Sol, Terra, Luna
GPT-5.6 hadir sebagai keluarga model dengan tiga level performa dan harga:
| Varian | Harga Input | Harga Output | Posisi |
|---|---|---|---|
| Sol | $5 per 1M token | $30 per 1M token | Flagship, paling powerful |
| Terra | $2,50 per 1M token | $15 per 1M token | Mid-tier, seimbang |
| Luna | $1 per 1M token | $6 per 1M token | Budget-friendly, paling murah |
Semua varian mendukung mode Ultra (max reasoning) dan mode dasar, sehingga pengguna bisa menyesuaikan antara kedalaman analisis dan biaya yang dikeluarkan.
Skor Coding Tertinggi Sepanjang Masa
Performa coding GPT-5.6 Sol menjadi sorotan utama. Model ini mencetak 91,9% pada Terminal-Bench 2.1 dalam mode Ultra, dan 88,8% dalam mode dasar — skor coding tertinggi yang pernah tercatat di benchmark tersebut.
Untuk perbandingan, skor kompetitor terdekat:
- Claude Mythos 5: 88,0%
- GPT-5.5: 83,4%
Selisih 3,9 poin persentase antara Sol dan kompetitor tertinggi kedua menunjukkan jarak yang cukup lebar di segmen coding.
Di benchmark Intelligence Index dari Artificial Analysis, GPT-5.6 Sol mencetak 59 poin — hanya terpaut 1 poin dari Claude Fable 5. Ini menunjukkan bahwa untuk tugas umum pun, Sol sudah mengapit posisi Claude.
Efisiensi Biaya: Luna Menang Telak
Di luar performa, cerita paling menarik justru muncul dari efisiensi biaya. Luna, varian termurah, menghasilkan sekitar 24 poin benchmark per dolar API — dibandingkan Claude Opus 4.8 yang hanya menghasilkan 4,5 poin per dolar, dan Claude Fable 5 di angka 3,2 poin per dolar.
Untuk setiap tugas Intelligence Index, biaya yang dikeluarkan:
- Sol: $1,05 per tugas
- Terra: $0,55 per tugas (sekitar 50% lebih murah dari Sol)
- Luna: $0,21 per tugas (sekitar 80% lebih murah dari Sol)
Artinya, untuk aplikasi yang tidak membutuhkan performa tertinggi, Luna menawarkan nilai sangat kompetitif.
Kontroversi Benchmark Gaming
Momen peluncuran GPT-5.6 tidak sepenuhnya mulus. Beberapa pengamat mendapati bahwa OpenAI mencapai skor tinggi di benchmark dengan cara yang dinilai tidak representatif terhadap penggunaan nyata. Engincan Veske menulis di newsletternya bahwa GPT-5.6 “launched with record numbers and got flagged for record benchmark gaming.”
Ini bukan masalah baru di industri AI — model sering dioptimalkan khusus untuk pola-pola yang muncul di benchmark tertentu — tapiGPT-5.6 menjadicontoh tertinggi yang terlihat sejauh ini.
Konteks Regulatori
Permintaan White House untuk menunda peluncuran GPT-5.6 menandai momen langka où regulator pemerintah ikut campur dalam jadwal rilis model AI. Berbeda dengan Uni Eropa yang sudah memiliki AI Act sebagai kerangka hukum formal, Amerika Serikat selama ini lebih banyak mengandalkan tanggung jawab vendor secara sukarela.
intervensimasuk ini menunjukkan bahwa pemerintah AS mulai menganggap model frontier sebagai infrastruktur strategis yang butuh pengawasan lebih ketat. BagaimanaOpenAI merespons tekanan ini ke depan akan menjadi precedent penting bagi industri.
Sumber
- TechCrunch — “The White House is asking OpenAI to slow roll the release of its new model over safety concerns” (25 Juni 2026)
- The Decoder — “GPT-5.6 Sol nearly matches Fable 5 on aggregated benchmarks at one-third the cost” (9 Juli 2026)
- Artificial Analysis — “GPT-5.6 has landed” (9 Juli 2026)
- EdenAI — “GPT-5.6 Sol: Benchmarks, Pricing & API Access Guide 2026” (Juli 2026)
- Vellum — “GPT-5.6 Sol vs Terra vs Luna: Which Tier Should You Choose” (9 Juli 2026)
- Engincan Veske Newsletter — “This Week in AI #5 — July 9-15, 2026” (Juli 2026)