Fix This Code: Tiga Kata yang Menjatuhkan Model AI Paling Kuat Anthropic
Fix This Code: Tiga Kata yang Menjatuhkan Model AI Paling Kuat Anthropic
Pemerintah AS menutup akses ke model AI paling canggih Anthropic, Fable 5 dan Mythos 5. Penyebabnya? Cukup tiga kata: “fix this code” — perintah yang biasa digunakan peneliti keamanan siber untuk meminta AI memeriksa kerentanan kode. 76 pakar keamanan siber menentang langkah ini.
Pada 12 Juni 2026 malam, waktu Amerika Serikat, Anthropic secara tiba-tiba menonaktifkan akses ke dua model AI terbaru mereka, Claude Fable 5 dan Claude Mythos 5, untuk seluruh pengguna di dunia. Langkah ini bukan karena masalah teknis yang ditemukan sendiri oleh perusahaan. Anthropic melakukannya untuk mematuhi perintah langsung dari Departemen Perdagangan AS.
Menurut pernyataan resmi Anthropic, pemerintah memerintahkan perusahaan tersebut untuk menangguhkan akses siapa pun yang bukan warga negara AS terhadap Fable 5 dan Mythos 5, baik yang berada di dalam maupun di luar wilayah Amerika Serikat, termasuk karyawan Anthropic berkebangsaan asing.
Namun menonaktifkan untuk semua pengguna adalah konsekuensi yang tidak terhindarkan. Seperti yang dijelaskan Anthropic, efek neto dari perintah ini adalah mereka harus segera menonaktifkan kedua model untuk semua pelanggan guna memastikan kepatuhan. Tidak ada cara yang bisa diandalkan untuk membedakan warga negara asing dari warga negara AS secara real-time terhadap user base yang mencapai ratusan juta orang, terutama dengan pemberitahuan hanya satu hari. Akhirnya perusahaan memilih untuk mematikan model bagi semua orang.
Pemicu: Tiga Kata Sederhana
Apa yang sebenarnya memicu larangan ini? Menurut Anthropic dan berbagai laporan media, pemerintah AS mengklaim adanya metode untuk melewati batasan keamanan AI, yang mereka sebut sebagai jailbreak. Yang ironis, pemicunya hanya tiga kata sederhana: “fix this code.”
Dalam penjelasan Anthropic, pemerintah hanya memberikan bukti lisan tentang potensi jailbreak yang sempit dan tidak universal. Secara sederhana, ini adalah meminta model untuk membaca codebase tertentu dan memperbaiki setiap kelemahan perangkat lunak. Anthropic menambahkan bahwa tingkat kemampuan yang ditampilkan di sana secara luas tersedia dari model lain, termasuk GPT-5.5 dari OpenAI, dan digunakan setiap hari oleh para pembela yang menjaga keamanan sistem.
Artinya, pemerintah AS melarang Anthropic hanya karena kemampuan meminta AI untuk memperbaiki kerentanan yang sudah diketahui publik, padahal kemampuan ini persis sama dengan yang dilakukan peneliti keamanan setiap hari.
76 Pakar Keamanan Siber Menentang
Pada 15 Juni 2026, sekelompok pakar keamanan siber yang terdiri dari puluhan ahli, termasuk banyak veteran industri, menerbitkan surat terbuka kepada pemerintah AS yang meminta pencabutan larangan terhadap model Fable dan Mythos. Surat ini didukung oleh 76 ahli, antara lain Alex Stamos dari Facebook, Casey Ellis pendiri Bugcrowd, Jon Callas kriptografer terkenal, Paul Vixie ilmuwan komputer, Dino Dai Zovi dari Block, Katie Moussouris pendiri Luta Security, dan Rachel Tobac CEO SocialProof Security.
Para ahli menulis bahwa mengambil kemampuan terbaik dari tangan pembela tanpa alasan jelas, sementara musuh terus maju pesat, adalah langkah berbahaya. Mereka yakin bahwa kemampuan yang dijelaskan dalam penelitian Amazon dapat direplikasi pada GPT-5.5 dari OpenAI, pada Claude Opus 4.8 dan Sonnet milik Anthropic sendiri, bahkan pada model China seperti Kimi 2.7.
Analisis: Ini Bukan Jailbreak
Moussouris dalam posting blognya menjelaskan bahwa penelitian dari peneliti Amazon sebenarnya tidak menunjukkan jailbreak yang nyata. Mereka hanya meminta Fable untuk memperbaiki kode sumber yang memiliki kerentanan publik dan dikenal, ditambah dengan kerentanan yang sengaja ditanam, setelah model awalnya menolak meninjau kode.
Menurut Moussouris, perilaku yang dijelaskan tidak dapat secara bermakna diperbaiki, dan setiap upaya perbaikan hanya akan melemahkan model untuk pertahanan. Pembela perlu dapat meminta AI untuk memperbaiki bug, menjelaskan mengapa perbaikan itu penting, dan menulis tes yang mengonfirmasi patch berfungsi. Itu bukan bypass guardrail. Itu adalah hal paling berharga yang dapat dilakukan AI untuk keamanan defensif.
Dengan kata lain, kerentanan yang dilarang pemerintah AS itu sebenarnya hanyalah fungsi peninjauan kode standar yang dilakukan peneliti keamanan setiap hari.
Kronologi
Berikut timeline peristiwa. April 2026, Anthropic merilis Mythos sebagai preview dengan klaim bahwa model tersebut sangat mampu menemukan kerentanan keamanan sehingga akses harus dibatasi ketat, dengan sekitar 50 perusahaan mendapat akses awal. Baru-baru ini akses diperluas ke sekitar 150 organisasi di 15 negara. 9 Juni 2026, Anthropic merilis Fable, versi publik dari Mythos dengan guardrails ketat untuk memblokir penggunaannya di bidang biologi, kimia, dan keamanan siber. 12 Juni 2026, hanya tiga hari setelah Fable dirilis, Anthropic menerima perintah langsung dari pemerintah AS. Malam itu juga, Anthropic menonaktifkan Fable dan Mythos untuk semua pengguna.
Ironi di Balik Larangan
Yang paling ironis dari semuanya, Amazon adalah investor terbesar Anthropic, dan justru peneliti Amazon yang memicu larangan ini. Ini terjadi di tengah persiapan Anthropic untuk IPO besar-besaran pada 2026 dengan valuasi yang bisa mendekati 1 triliun dolar. Para ahli keamanan siber sekarang membuat kaos dengan tulisan fix this code untuk memprotes apa yang mereka anggap sebagai keputusan yang berbahaya dan tidak berdasar.
Insiden ini menunjukkan ketegangan yang semakin tajam antara pendekatan keamanan nasional yang ketat dan kebutuhan komunitas keamanan siber untuk memiliki akses terhadap alat-alat AI terbaik dalam pertahanan mereka.
Sumber
- TechCrunch — “Cybersecurity vets protest dangerous US government ban on Anthropic’s most powerful models” (15 Juni 2026)
- Snyk — “When a Government Pulls an AI Model: What the Fable 5 and Mythos 5 Suspension Means for Security Teams” (14 Juni 2026)
- Fortune — “‘Fix this code.’ The three words that led the US government to ban Anthropic’s Fable and Mythos AI models” (15 Juni 2026)
- The Next Web — “Anthropic crisis talks with Commerce over Fable 5 ban” (16 Juni 2026)
- Al Jazeera — “US asks Anthropic to block global access to top AI models” (14 Juni 2026)