AI Briefing
AI Briefing Publikasi Riset AI Indonesia

"Mitigating the risk of extinction from AI should be a global priority alongside other societal-scale risks such as pandemics and nuclear war."

— Sam Altman · CEO of OpenAI

NVIDIA Rilis Nemotron 3.5 Lightning: Model 30B Open-Weight Tercepat untuk AI Agents

Oleh Eko Hadi Murwanto · ·
NVIDIA Rilis Nemotron 3.5 Lightning: Model 30B Open-Weight Tercepat untuk AI Agents

NVIDIA resmi merilis Nemotron 3.5 Lightning pada 11 Agustus 2026 — model open-weight 30 miliar parameter yang didesain khusus untuk beban kerja agent AI jangka panjang.

Kenapa Model Kecil Lebih Unggul untuk Agents

Bedanya dengan model frontier besar seperti GPT-5.6 atau Nemotron 3 Ultra: model-model besar itu bagus untuk perencanaan dan orkestrasi alur kerja. Tapi untuk tugas-tugas berulang volume tinggi — review kode, pantau keamanan, jawab pertanyaan tagihan — butuh model yang lebih kecil, lebih cepat, dan bisa dijalankan secara lokal tanpa ongkos inference mahal.

Nemotron 3.5 Lightning masuk di segmen itu. Arsitekturnya MoE (mixture-of-experts) 30B, tapi cuma mengaktifkan 3 miliar parameter per token. Hasilnya: kecepatan output 4x lipat dibanding model seukurannya, dan waktu penyelesaian tugas agentik 30% lebih singkat.

“Nemotron 3.5 Lightning mendefinisikan frontier efisiensi untuk model kecil open-weight di Artificial Analysis Intelligence Index,” tulis tim NVIDIA di blog developer mereka (11 Agustus 2026).

Angka Benchmark

Di benchmark PinchBench, Nemotron 3.5 Lightning mencapai akurasi 86% sambil menyelesaikan 10.000 tugas 30% lebih cepat dibanding Qwen3.6 35B pada tingkat akurasi serupa. Model ini juga memimpin frontier efisiensi di Artificial Analysis Intelligence Index — artinya tidak ada model lain di kelasnya yang menawarkan kombinasi kecepatan dan akurasi seperti ini.

Di papan pemimpin EXO Labs local.ai untuk AI lokal, Nemotron 3.5 Lightning juga duduk di frontier Pareto — menunjukkan bahwa model ini tidak cuma kencang di cloud, tapi juga efisien saat dijalankan di RTX PC atau DGX Spark tanpa koneksi internet.

Kustomisasi dan Ekosistem

Yang membedakan Nemotron 3.5 Lightning dari model open-weight lainnya adalah kemudahannya untuk dikustomisasi. NVIDIA menyediakan toolkit lengkap:

  • NeMo Automodel — LoRA atau fine-tune penuh
  • NeMo RL — reinforcement learning untuk adaptasi domain
  • Nemotron-RL-Agentic-Terminal-Pivot — dataset RL yang dirilis bersamaan untuk kapabilitas coding agent
  • Speculative decoding, DFlash, DSpark — semua teknik inference optimization terbaru sudah included

Perusahaan yang sudah mengadopsi model ini untuk workload mereka meliputi CrowdStrike untuk cybersecurity, Harvey untuk layanan hukum, dan CodeRabbit dengan Baseten untuk review kode otomatis.

Lisensi dan Ketersediaan

Nemotron 3.5 Lightning dirilis bajo lisensi OpenMDW (Open Model Development Workflow) — lisensi open-source yang mengizinkan penggunaan komersial, modifikasi, dan distribusi tanpa batasan pendapatan atau revenue sharing. Ini berbeda dari lisensi model AI proprietary lain yang sering membatasi deployment enterprise.

Model tersedia di:

  • Hugging Face (NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4)
  • ModelScope
  • OpenRouter
  • build.nvidia.com (sebagai NIM microservice)
  • Langsung bisa dijalankan via LM Studio, llama.cpp, Ollama, dan Unsloth

Spesifikasi Teknis Singkat

AspekDetail
Parameter30B MoE (3B aktif per token)
ArsitekturAdaptive 3-Block (A3B)
QuantizationNVFP4 + BF16
Kecepatan4x lebih cepat dari model sekelas
BenchmarkPinchBench 86%, 30% lebih cepat dari Qwen3.6 35B
LisensiOpenMDW (komersial bebas)
ToolingNeMo, LoRA, RL, speculative decoding

Nemotron 3.5 Lightning bukan model yang mengejar skor benchmark tertinggi secara absolut. Ia dibuat untuk satu tujuan spesifik: menjadi tulang punggung agent AI yang jalan terus-menerus — murah, cepat, dan bisa dikustomisasi untuk tiap domain. Bagi enterprise yang ingin deploy AI agents tanpa bergantung ke API pihak ketiga, model ini jadi opsi open-weight paling menarik di kelas 30B saat ini.

Sumber

  1. NVIDIA Blog — “Nemotron 3.5 Lightning and NeMo Switchyard Deliver Faster, Smarter, More Efficient Agentic AI” (11 Agustus 2026)
  2. NVIDIA Technical Blog — “NVIDIA Nemotron 3.5 Lightning Delivers Fast, Accurate Specialized Task Execution for Long-Running Agents” (11 Agustus 2026)
  3. Emergent — “NVIDIA Nemotron 3.5 Lightning 30B A3B Released” (14 Agustus 2026)
Bagikan artikel ini
Telegram WhatsApp Facebook X
← Kembali ke Beranda