AI Briefing
AI Briefing Publikasi Riset AI Indonesia

"We're building AI that we hope will benefit humanity, but we must plan for the possibility that it won't."

β€” Elon Musk Β· Founder of xAI

DeepSeek V4 Rilis Resmi: Harga $0,14 Per Juta Token, Lebih Murah 89 Kali Dari Claude Opus

Oleh Eko Hadi Murwanto Β· Β·
DeepSeek V4 Rilis Resmi: Harga $0,14 Per Juta Token, Lebih Murah 89 Kali Dari Claude Opus

DeepSeek resmi membawa keluarga model V4 ke tahap ketersediaan umum pada 20 Juli 2026, dan langsung mengubah perhitungan biaya bagi siapa pun yang membayar AI berdasarkan token. Dengan harga mulai dari $0,14 per juta token input, V4-Flash β€” varian ringan keluarga V4 β€” mengklaim posisi sebagai model AI termurah di segmen frontier, jauh di bawah harga yang diminta oleh Anthropic, Google, maupun OpenAI.

Dari Preview ke Produksi dalam Tiga Bulan

Perjalanan V4 dimulai pada 24 April 2026, ketika DeepSeek seringkles dua model secara bersamaan dalam preview: DeepSeek-V4-Pro sebagai model andalan yang lebih besar, dan DeepSeek-V4-Flash sebagai varian yang lebih ringan dan cepat, dirancang khusus untuk beban kerja bervolume tinggi.

Kedua model langsung diluncurkan dengan open weights dan akses API sejak hari pertama β€” berbeda dari cara kompetitor yang sering menahan akses di balik daftar tunggu pribadi. Selama musim panas utara, DeepSeek menyempurnakan model terhadap lalu lintas produksi nyata sebelum akhirnya mendorong versi GA pada 20 Juli 2026.

Pembaruan GA menambahkan kemampuan agen, penalaran matematika yang lebih kuat, dan peningkatan khusus untuk generasi kode. Pada saat yang sama, DeepSeek juga mematikan alias model lama β€” deepseek-chat dan deepseek-reasoner β€” yang berarti siapa pun yang belum memperbarui kode mereka sejak 24 Juli 2026 pukul 15:59 UTC akan menerima pesan error alih-alih respons AI.

Arsitektur: 1,6 Triliun Parameter, Aktif Hanya 49 Miliar

DeepSeek-V4-Pro adalah model mixture-of-experts dengan total 1,6 triliun parameter, tetapi hanya 49 miliar yang aktif untuk setiap token yang diproses. Jarak antara total dan aktif adalah kunci desain MoE β€” model bisa menyimpan kapasitas besar sambil menjaga biaya komputasi per permintaan tetap dekat dengan model yang jauh lebih kecil.

V4-Flash menjalankan versi lebih kecil dari arsitektur yang sama: 284 miliar parameter total dengan 13 miliar aktif per token, dibuat untuk beban kerja yang sensitif terhadap latensi. Konteks window bersama untuk keduanya adalah 1 juta token, dan output per respons bisa mencapai 384.000 token.

GPT-5 high-reasoning dari OpenAI, sebagai perbandingan, memiliki konteks window maksimal 400.000 token menurut tabel perbandingan model 2026, kurang dari setengah dari yang ditawarkan DeepSeek V4.

Struktur Harga Baru: Puncak dan Non-Puncak

Ini adalah pertama kalinya DeepSeek menerapkan penetapan harga berdasarkan waktu operasi. Harga dasar berlaku di luar jam sibuk, sementara jam puncak β€” 09:00 hingga 12:00 dan 14:00 hingga 18:00 waktu Beijing (UTC+8) β€” membawa pengali 2x dari harga dasar.

Untuk bisnis yang menjalankan batch job, evaluasinya, atau beban kerja yang tidak perlu terjadi secara real time, insentifnya jelas: pindahkan pekerjaan di luar jam sibuk dan tagihan berkurang setengah. Untuk tim di Indonesia (UTC+7), jam puncak DeepSeek jatuh sekitar 08:00 hingga 11:00 dan 13:00 hingga 17:00 WIB.

Input yang di-cache mendapat diskon lebih besar: prompts berulang atau pesan sistem bersama yang ditagih melalui tier cache-hit V4-Flash hanya berharga $0,014 per juta token β€” diskon 90% dari harga input standar $0,14.

Perbandingan Harga: V4-Flash versus Kompetitor

Di sinilah angka-angka menjadi menarik. V4-Flash berharga $0,14 per juta token input dan $0,28 per juta token output. Claude Opus 4.8 dari Anthropic β€” yang oleh sebagian besar perbandingan Juli 2026 dinobatkan sebagai sistem frontier all-round terkuat β€” menagih $5,00 input dan $25,00 output per juta token. Artinya, V4-Flash sekitar 36 kali lebih murah di input dan 89 kali lebih murah di output.

Sebagai perbandingan, beberapa model lain yang relevan:

ModelInput ($/1M token)Output ($/1M token)Konteks
DeepSeek V4-Flash$0,14$0,281 juta token
DeepSeek V4-Pro$0,435$0,871 juta token
Claude Haiku 4.5$1,00$5,00Tidak dipublikasikan
Gemini 3.5 Flash$1,50$9,00Tidak dipublikasikan
Claude Opus 4.8$5,00$25,001 juta token

Claude Haiku 4.5 β€” model terkecil dan termurah dari Anthropic β€” masih tujuh kali lebih mahal di input dibanding V4-Flash. Gemini 3.5 Flash dari Google, yang paling dekat menjadi pesaing langsung V4-Flash, dihargai $1,50 input dan $9,00 output per juta token, atau sekitar 10 kali lebih mahal di input dari V4-Flash.

Perang Harga AI Semakin Panas

DeepSeek bukan satu-satunya yang bermain di harga. Qwen 3.7 Max dari Alibaba saat ini menjadi model termurah di sebagian besar ranking top-10, menandai bahwa perang harga di antara model open-weight kini semakin intensif.

Dengan memasuki GA, DeepSeek V4 secara efektif memaksa seluruh pasar untuk memikirkan kembali strategi harga. Pertanyaan besarnya sekarang adalah apakah kompetitor seperti Anthropic dan Google akan merespons dengan menurunkan harga, atau mempertahankan margin demi keuntungan yang lebih tinggi sembari membiarkan DeepSeek merebut pangsa pasar yang sensitif terhadap biaya.

Sumber

  1. Tech Insider β€” β€œDeepSeek V4 Hits GA: 1M Context, Old API Dies Today” (24 Juli 2026)
  2. Nikkei Asia β€” β€œDeepSeek releases beta version of V4 models as AI price war heats up”
Bagikan artikel ini
Telegram WhatsApp Facebook X

Artikel Terkait

DeepSeek Bikin Chip AI Sendiri: Kurangi Ketergantungan pada Nvidia dan Huawei

DeepSeek Bikin Chip AI Sendiri: Kurangi Ketergantungan pada Nvidia dan Huawei

20 Juli 2026
DeepSeek Rilis DSpark: Speculative Decoding Bikin V4 85 Persen Lebih Cepat

DeepSeek Rilis DSpark: Speculative Decoding Bikin V4 85 Persen Lebih Cepat

5 Juli 2026
DeepSeek Rilis DSpark: V4 Makin Cepat 85 Persen, Paper Perdana Setelah Pendanaan $7 Miliar

DeepSeek Rilis DSpark: V4 Makin Cepat 85 Persen, Paper Perdana Setelah Pendanaan $7 Miliar

28 Juni 2026
← Kembali ke Beranda