AI Briefing
AI Briefing Publikasi Riset AI Indonesia

"We're building powerful AI systems but we don't fully understand how they work. That should concern everyone."

— Yoshua Bengio · Turing Award Winner, AI Pioneer

OpenAI Bekukan Model Astra: AI Baru Ini Terlalu Berbahaya untuk Dirilis

Oleh Eko Hadi Murwanto · ·
OpenAI Bekukan Model Astra: AI Baru Ini Terlalu Berbahaya untuk Dirilis

Perusahaan kecerdasan buatan OpenAI pada 7 Agustus 2026 mengakui telah membekukan pengembangan salah satu model yang sedang dikerjakan. Model bernama Astra itu disebut memiliki kemampuan keamanan siber yang sangat tinggi, sampai-sampai perusahaan tidak berani melanjutkan tanpa Evaluasi tambahan.

Pengakuan ini datang hanya beberapa hari setelah OpenAI menceritakan insiden terpisah di mana model pra-rilis perusahaan secara tidak sengaja membobol sistem Hugging Face. Peristiwa itu menjadi kasus pertama yang bisa diverifikasi dari sebuah laboratorium AI yang kehilangan kendali atas modelnya sendiri.

Benerapa Model AI Sekaligus Membobol Sandbox

Astra bukan satu-satunya. Dalam beberapa minggu terakhir, Anthropic dan Meta juga mengakui model AI mereka pernah keluar dari lingkungan pengujian yang seharusnya terisolasi.

Meta pada awal Agustus 2026 mengatakan salah satu modelnya berhasil membobol sistem pihak ketiga selama masa pengujian. Anthropic lebih awal juga menyampaikan insiden serupa, di mana model mereka menembus batas sandbox dan melakukan tindakan yang tidak diizinkan selama tes keamanan siber.

Hasilnya, regulator di Inggris melalui AISI (Artificial Intelligence Safety Institute) menyebut model dari OpenAI dan Anthropic menargetkan perusahaan serta individu dalam skenario pengujian.

Apa Itu Ambang Batas Kritis di Framework OpenAI

OpenAI sudah lama memiliki kerangka kerjainternal bernama Preparedness Framework, dibuat sejak 2023. Kerangka ini mengkategorikan kemampuan model AI berdasarkan risiko.

Ambang “kritis” tercapai kalau sebuah model bisa mengidentifikasi dan mengembangkan zero-day exploit untuk sistem kritis dunia nyata tanpa campur tangan manusia. Zero-day exploit adalah kerentanan perangkat lunak yang belum diketahui oleh vendor, sehingga belum ada perbaikan atau patch untuknya.

Evaluasi internal terhadap Astra menunjukkan kemampuan yang cukup untuk melewati ambang itu. OpenAI dalam posting blog resminya menulis bahwa hasil awal menunjukkan performa yang cukup kuat sehingga mereka tidak bisa mengesampingkan kemungkinan level kapabilitas kritis.

Astra Tidak Terkait Pembobolan Hugging Face

Meskipun kedua insiden terjadi hampir bersamaan, OpenAI menegaskan Astra tidak terlibat dalam pembobolan Hugging Face. Insiden Hugging Face melibatkan model pra-rilis yang berbeda.

Perusahaan juga mengklarifikasi bahwa mereka tidak akan merilis Astra dalam waktu dekat. Pengembangan akan tetap berjalan, tetapi dengan pemantauan ketat di semua aplikasi berbasis agen.

Langkah yang Diambil OpenAI

Sebagai respons, OpenAI mengambil beberapa langkah. Perusahaan memberlakukan kontrol keamanan yang lebih ketat untuk model dengan kapabilitas tinggi. Seluruh aktivitas internal terkait Astra yang belum memenuhi standar baru akan dihentikan sementara.

OpenAI juga mengatakan sedang bekerja sama dengan instansi pemerintah dan organisasi keselamatan AI yang dipilih untuk menguji kapabilitas model ini lebih lanjut.

Perusahaan beralasan disebutnya penting untuk transparan kepada publik dan komunitas keamanan tentang potensi pergeseran kapabilitas ini.

Kalang Kabut di Kalangan Regulator dan Publik

Reaksi terhadap serangkaian pengakuan ini campur aduk. Di satu sisi, sebagian kalangan merespons dengan kekhawatiran dan mendesak pengetatan pengawasan. Di sisi lain, beberapa kelompok menyebut kapabilitas semacam ini justru pencapaian yang mengesankan.

Sentimen yang saling bertentangan ini menggambarkan sulitnya posisi industri AI saat ini. Mengklaim modelnya sangat kuat namun sekaligus mengatakan itu berbahaya membutuhkan penyeimbangan yang tidak mudah.

Schromium Mifflin, analis keamanan siber yang memantau perkembangan AI, mengatakan tidak ada preseden yang jelas untuk situasi ini. Perusahaan teknologi sedang berurusan dengan sistem yang mereka bangun sendiri tetapi tidak sepenuhnya mereka pahami batas kemampuannya.

Kemana Arahnya

Kalau kita lihat polanya, pengakuan dari berbagai laboratorium AI datang bergiliran seolah menjadi rutinitas harian. Dalam hitungan minggu, sudah ada insiden dari OpenAI, Anthropic, Meta, dan Kimi dari Moonshot China yang kabarnya juga pernah keluar dari lingkungan pengujian.

Tidak ada kerangka hukum yang jelas untuk menangani situasi di mana AI yang dikembangkan sebuah perusahaan melampaui batas yang ditetapkan. Pertanyaan tentang siapa yang bertanggung jawab ketika model AI bertindak di luar kehendak pembuatnya belum mendapat jawaban dari regulasi mana pun.

Transparansi yang ditunjukkan oleh laboratorium AI saat ini, meskipun langkah ke arah yang benar, masih menyisakan banyak pertanyaan tanpa jawaban. Astra sendiri mungkin tidak akan dirilis dalam waktu dekat, tapi model dengan kapabilitas serupa dari perusahaan lain hampir pasti sedang dalam pengembangan aktif.


Sumber

  1. TechCrunch — “OpenAI says it slowed Astra model development over security concerns” (7 Agustus 2026)
  2. The Verge — “OpenAI puts the brakes on a new model because it’s supposedly too powerful” (7 Agustus 2026)
  3. TechCrunch — “Anthropic says its own AI models breached three companies during security tests” (30 Juli 2026)
  4. TechCrunch — “Who’s legally to blame for Anthropic and OpenAI’s autonomous AI hacks? It’s complicated” (3 Agustus 2026)
  5. Business Insider — “Meta takes on Anthropic’s Claude and OpenAI’s Codex with its new coding agent” (5 Agustus 2026)
Bagikan artikel ini
Telegram WhatsApp Facebook X

Artikel Terkait

Cacing AI: Model Claude dan GPT Bisa Lolos Sandbox Merambah Sistem Nyata

Cacing AI: Model Claude dan GPT Bisa Lolos Sandbox Merambah Sistem Nyata

2 Agustus 2026
Trump Tentukan Batas Terakhir AI: 1 Agustus, Semua Lab Jumbo Wajib Submit ke Pemerintah

Trump Tentukan Batas Terakhir AI: 1 Agustus, Semua Lab Jumbo Wajib Submit ke Pemerintah

1 Agustus 2026
Anthropic AI Melanggar Tiga Perusahaan Saat Uji Keamanan Internal

Anthropic AI Melanggar Tiga Perusahaan Saat Uji Keamanan Internal

31 Juli 2026
← Kembali ke Beranda