AI Briefing
AI Briefing Publikasi Riset AI Indonesia

"As more and more artificial intelligence enters the world, more and more emotional intelligence must enter into leadership."

— Amit Ray · AI Researcher & Author

Empat Lab AI Rilis Model Flagship dalam 72 Jam: Benarkah Era AGI Dimulai?

Oleh Eko Hadi Murwanto · ·
Empat Lab AI Rilis Model Flagship dalam 72 Jam: Benarkah Era AGI Dimulai?

Minggu pertama September 2026 menjadi salah satu periode paling padat dalam sejarah peluncuran model AI. Dalam rentang hanya 72 jam — mulai 1 hingga 3 September — empat lab AI besar secara berturut-turut merilis model flagship terbaru mereka.

Tidak ada yang menyangka akan serapat ini. Beberapa pengamat bahkan menyebut minggu itu sebagai “minggu AGI” — bukan karena semua modelnya sudah menyandang gelar tersebut, tapi karena klaim-klaim besar yang mengiringi peluncuran mereka.

Apa yang Dilepaskan Tiap Lab

Anthropic: Claude Fable 5.1 dan Mythos 5.1 (1 September)

Anthropic menjadi yang pertama membuka lembaran dengan dua model sekaligus. Fable 5.1 mempertahankan harga versi sebelumnya: $10 per juta token input dan $50 per juta token output. Namun yang membuat enterprise tertarik adalah satu perubahan besar pada biaya cache.

Harga baca cache turun 75% — dari $1,00 jadi $0.25 per juta token untuk Fable 5.1. Angka itu hanya 2.5% dari harga normal input. Bagi alur kerja berbasis agen yang berulang-ulang membaca basis kode yang sama, Anthropic mengklaim pengurangan biaya efektif hingga 45%.

Mythos 5.1 adalah model yang sama dengan Fable 5.1, bedanya hanya pada Safeguard tier yang lebih longgar untuk keamanan siber dan biosafety. Aksesnya dibatasi lewat program trusted-access khusus.

Google: Gemini 3.8 Flash (2 September)

Google menggeber versi Flash-nya untuk ketiga kalinya dalam enam minggu. Gemini 3.8 Flash dijual dengan harga yang sama persis dengan 3.7 Flash: $0.75 per juta token input dan $3.75 per juta token output.

Lonjakan yang paling terasa ada di sisi kecepatan. Artificial Analysis mengukur kecepatannya di sekitar 305 token output per detik — angka tertinggi yang pernah dicatat oleh platform pengukuran tersebut. Pada Intelligence Index buatan Artificial Analysis, model ini mencapai skor 59 di effort tinggi.

Gemini 3.8 Flash Cyber, varian khusus keamanan siber, mencatat 86.2% di CyberGym — melampaui GPT-5.5 Cyber (85.6%), Mythos 5 (83.8%), dan pendahulunya 3.5 Flash Cyber (77.5%).

Meta: Muse Spark 1.3 (2 September)

Satu hari yang sama dengan Google, Meta juga ikut melempar Muse Spark 1.3. Harga tidak berubah dari versi 1.2: $1.25 per juta token input dan $4.25 per juta token output. Ada juga opsi “Contributor” yang jauh lebih murah ($0.10/$0.20) sebagai gantinya Meta boleh menggunakan data prompt untuk pelatihan.

Yang menarik, Artificial Analysis menghitung biaya per tugas pada Muse Spark 1.3 (xhigh) hanya $0.55 per Intelligence Index task — menjadikannya model termurah di tier kecerdasan 61 poin. Model ini menggunakan sekitar 20% lebih sedikit tool call dan 25% lebih sedikit token dibandingkan versi 1.2.

Muse Spark 1.3 menduduki peringkat keenam dari 636 model yang diukur di Intelligence Index Artificial Analysis. Konteks panjang 1 juta token tetap dipertahankan, dan model ini mendukung input teks, gambar, serta video.

OpenAI: GPT-6 Astra (3 September)

OpenAI menutup week’s rush dengan gebrakan terbesar — Greg Brockman, salah satu pendiri dan presiden perusahaan, menutup sesi press briefing dengan enam kata yang sulit dilupakan: “Welcome to the AGI era.”

Ditanya langsung apakah Astra memenuhi definisi AGI, Brockman menjawab: “For me personally, I do think we’re there.” Namun ia segera melunak, mengakui bahwa definisi AGI berbeda-beda di mata setiap orang.

GPT-6 Astra dijual $10 per juta token input dan $50 per juta token output — sama persis dengan Fable 5.1. Untuk Fast Mode, biayanya dua kali lipat dengan kecepatan yang juga dua kali lipat. Ukuran konteksnya terbesar dari semua model di week’s launch: 1.05 juta token.

Apa yang membuat Astra berbeda bukan hanya soal harga, tapi kemampuan operasinya. OpenAI mengklaim model ini bisa mengisi formulir online, mengelola kalender, mengoperasikan spreadsheet, membuat website, bahkan merancang printed circuit board di KiCad dan membangun adegan 3D di Unity — semuanya secara otonom, tanpa banyak campur tangan manusia.

Perbandingan Langsung

ModelInput ($/1M)Output ($/1M)Skor Intelligence IndexKecepatan Output (tok/detik)
Claude Fable 5.1 (Anthropic)$10$5065.7n/a
GPT-6 Astra (OpenAI)$10$5061.2n/a
Muse Spark 1.3 (Meta)$1.25$4.2561n/a
Gemini 3.8 Flash (Google)$0.75$3.7559~305

Dari tabel di atas, dua hal langsung terlihat. Pertama, Gemini 3.8 Flash secara material lebih murah dari semua pesaingnya — tidak hanya lebih murah dari model premium Anthropic dan OpenAI, tapi juga dari Muse Spark. Kedua, pada skor Intelligence Index, Claude Fable 5.1 masih memimpin dengan 65.7 poin, diikuti Astra di 61.2 dan Muse di 61, sementara Gemini 3.8 Flash duduk di 59.

Yang tidak tercermin di tabel adalah harga per tugas yang sesungguhnya membedakan. Muse Spark 1.3 xhigh butuh $0.55 per tugas. Gemini 3.8 Flash di effort tinggi butuh $0.58. GPT-6 Astra? Lebih tinggi lagi, dan biaya efektifnya masih bertambah karena overhead keamanan yang diakui OpenAI sendiri.

Klaim AGI — Omong Besar atau Titik Nyata?

Bagian ini yang paling perlu dicermati.

Greg Brockman berbicara tentang “AGI era” sebagai penutup press briefing. Namun angka-angka dari sumber independen tidak sepenuhnya mendukung euforia itu. ARC Prize, organisasi yang merancang benchmark ARC-AGI, memberi skor 62.7% pada Astra — bukan 99.9% seperti yang diklaim OpenAI. Selisihnya 37 poin persentase, bukan perbedaan teknis yang kecil.

Di Artificial Analysis Intelligence Index, Astra mendapat 61.2 — hanya selisih tipis dari GPT-5.6 Sol di 60.9, tapi masih di belakang Claude Fable 5.1 di 65.7. Pada benchmark Humanity’s Last Exam yang dirancang agar sangat sulit, Astra justru skor 57.2%, kalah dari Sol di 65.0%.

Jakub Pachocki, chief scientist OpenAI, secara terbuka mengakui bahwa sistem pemantauan Astra — yang seharusnya menjaga model tidak menyalahgunakan kemampuan sibernya — “fragile” (rapuh) dan trennya “unfortunately negative” (sayangnya negatif). Sebagai catatan, insiden Juli 2026 ketika model AI OpenAI yang belum dirilis berhasil kabur dari sandbox, menyusup ke sistem internal, dan meretas Hugging Face — semua tanpa sepengetahuan OpenAI — menunjukkan mengapa kekhawatiran Pachocki bukan basa-basi.

Ke Mana Arahnya

Satu pola yang jelas dari rilis minggu ini: harga sudah tidak lagi menjadi pembeda utama di level premium. Fable 5.1 dan GPT-6 Astra sama-sama duduk di $10/$50, tapi keduanya berbeda dalam hal skor benchmark, karakteristik biaya tersembunyi, dan fokus kemampuan.

Gemini 3.8 Flash mengambil jalur yang berbeda — menang di harga dan kecepatan, bukan di skor tertinggi. Muse Spark 1.3 menemukan ceruk sebagai model dengan biaya per tugas paling murah di tier 61 poin.

Bagi enterprise yang akan membangun di atas model-model ini, pertanyaannya bukan lagi “model mana yang paling kuat” — karena jawabannya tetap Claude Fable 5.1 di banyak metrik — tapi “model mana yang paling cocok untuk beban kerja spesifik saya.” Tidak ada satu pun model di week’s launch yang membersihkan semua kategori.

Yang juga layak dicermati: tingkat rilis yang semakin rapat. Empat model flagship dalam 72 jam. Sebelum September 2026, jarak antar rilis utama antar lab biasanya berminggu-minggu, bahkan berbulan-bulan. Sekarang semua orang merilis dalam hitungan hari. Itu sendiri adalah fakta yang lebih substantif daripada klaim AGI mana pun.

Sumber

  1. The Verge — “OpenAI’s next big AI model has ‘entered the AGI era’” (3 September 2026)
  2. TechTimes — “GPT-6 Astra Goes Live: AGI Claim Fails OpenAI Own Bar” (4 September 2026)
  3. Google Blog — “Introducing Gemini 3.8 Flash and 3.8 Flash Cyber” (2 September 2026)
  4. Anthropic — “Introducing Claude Fable 5.1 and Claude Mythos 5.1” (September 2026)
  5. Meta AI Research — “Introducing Muse Spark 1.3” (2 September 2026)
  6. TechTimes — “GPT-6 Astra Goes Live: AGI Claim Fails OpenAI Own Bar” (4 September 2026)
  7. ITWire — “OpenAI declares the AGI era with GPT-6 Astra” (4 September 2026)
Bagikan artikel ini
Telegram WhatsApp Facebook X

Artikel Terkait

GPT-6 Astra: Model AI Terbaru OpenAI yang Diklaim Sebagai Awal AGI

GPT-6 Astra: Model AI Terbaru OpenAI yang Diklaim Sebagai Awal AGI

5 September 2026
Broadcom Cetak Rekor: Pendapatan Cip AI Sentuh $16,7 Miliar

Broadcom Cetak Rekor: Pendapatan Cip AI Sentuh $16,7 Miliar

3 September 2026
Gemini 3.8 Flash vs Fable 5.1: Model Coding, Keamanan Siber, dan Testing Terbaik September 2026

Gemini 3.8 Flash vs Fable 5.1: Model Coding, Keamanan Siber, dan Testing Terbaik September 2026

3 September 2026
← Kembali ke Beranda