AI Briefing
AI Briefing Publikasi Riset AI Indonesia

"Artificial intelligence is the new electricity. It will transform every industry and create massive new opportunities."

— Andrew Ng · Founder of Google Brain

GPT-Live: Model Suara OpenAI yang Bisa Dengarkan dan Bicara Sekaligus

Oleh Eko Hadi Murwanto · ·
GPT-Live: Model Suara OpenAI yang Bisa Dengarkan dan Bicara Sekaligus

OpenAI resmi memperkenalkan GPT-Live, keluarga model suara terbaru yang mampu mendengarkan dan berbicara secara bersamaan, pada hari Rabu, 8 Juli 2026. Ini adalah lompatan besar dari model suara sebelumnya yang harus menunggu pengguna selesai bicara baru bisa merespons.

Apa Itu GPT-Live?

GPT-Live adalah sistem full-duplex — istilah teknis yang artinya sistem bisa menerima informasi dan mengirim informasi secara bersamaan, persis seperti percakapan antar-manusia. Bayangkan sedang ngobrol dengan seseorang. Kamu bisa menyela, meresponskilat balik, dan mengekspresikan emosi di tengah pembicaraan tanpa harus menunggu giliran selesai. Model suara tradisional tidak bisa melakukan itu.

Selama ini, semua asisten suara yang ada — termasuk Advanced Voice Mode sebelum GPT-Live — bekerja denganmode percakapan setengah duplex. AI mendengarkan input pengguna, memprosesnya, baru kemudian menghasilkan respons suara. Kalau pengguna menyela di tengah, AI biasanya berhenti dan memulai ulang. GPT-Live menghapus batasan itu.

Cara Kerja Teknologi Ini

GPT-Live dibangun untuk memproses ucapan secara kontinu. Sementara sistem suara tradisional memproses satu blok audio lalu menghasilkan satu respons, GPT-Live menjalankan pipeline secara paralel: menerima audio, memahami konteks, merencanakan respons, dan menghasilkan output suara — semuanya saling tumpang tindih dalam hitungan milidetik.

OpenAI menyebut kemampuan ini sebagai keunggulan utama untuk beberapa skenario. Terjemahan langsung jadi salah satu yang paling menonjol. Interpreter manusia biasanya menunggupembicara berhenti bicara baru menerjemahkan. Dengan GPT-Live, AI bisa mulai menerjemahkan sementarapembicara masih berbicara — persis seperti penerjemah profesional yang menerjemahkan secara simultan.

Hard question dari pengguna juga tidak membuat sistem macet. GPT-Live mendelegasikan pertanyaan kompleks ke model GPT-5.5 secara otomatis di latar belakang, sementara tetap menjaga percakapan tetap hidup dengan respons awal yang lebih sederhana.

Perbandingan dengan Advanced Voice Mode

Advanced Voice Mode yang lama bekerja secara sekuensial: dengarkan dulu, proses, baru respons. Kalau pengguna bicara terlalu cepat atau terlalu pelan, sistem bisa kehilangan jejak. GPT-Live tidak punya masalah itu karena arsitektur paralelnya.

Dari sisi pengalaman pengguna, perbedaannya terasa sejak percakapan pertama. Pengguna bisa menyela, mengubah arah pembicaraan secara tiba-tiba, atau sekadar mengatakan “tunggu” di tengah penjelasan panjang — dan AI akan merespons secara alami tanpa mengulangi seluruh konteks dari awal.

Konteks Peluncuran

GPT-Live hadir hanya beberapa hari setelah OpenAI merilis keluarga model GPT-5.6 pada 9 Juli 2026. Keluarga itu terdiri dari tiga varian — Sol, Terra, dan Luna — dengan kemampuan dan harga yang berbeda. GPT-Live menggunakan infrastruktur yang sama dengan GPT-5.6, sehingga kapabilitas reasoning yang kuat dari model tekstual juga tersedia dalam interaksi suara.

Peluncuran ini juga terjadi setelah berbulan-bulan spekulasi tentang kemampuan suara AI yang lebih natural. Beberapa kompetitor telah mendemonstrasikan teknologi serupa dalam riset, tapi OpenAI adalah yang pertama memperluaskannya secara luas ke basis pengguna ChatGPT.

Implikasi untuk Pengguna dan Developer

Bagi pengguna umum, GPT-Live berarti pengalaman yang jauh lebih dekat dengan percakapan manusia nyata. Tidak ada lagi jeda yang terasa kaku, tidak ada lagi perlu menunggu “processing” sebelum respons datang. Untuk pengguna yang mengandalkan ChatGPT untuk belajar bahasa, presentasi, atau sesi brainstorming, perubahannya signifikan.

Untuk developer, OpenAI menyediakan API yang memungkinkan integrasi GPT-Live ke aplikasi pihak ketiga. Potensi integrasinya luas — dari aplikasipelayanan pelanggan otomatik yang bisa menangani obrolan telepon, sampai alat pembelajaran bahasa yang merespons seperti tutor manusia.

Ketersediaan

GPT-Live sudah tersedia untuk semua pengguna ChatGPT mulai 8 Juli 2026. Pengguna Gratis dan Plus bisa mengakses fitur suara baru ini secara bertahap. Untuk developer, API tersedia melalui platform developer OpenAI dengan dokumentasi lengkap di situs resmi.

Teknologi suara simultan ini belum menjadi standar industri, tapi dengan langkah OpenAI memperluasnya ke miliaran pengguna ChatGPT, expectasi terhadap asisten suara AI kemungkinan akan naik secara permanen.


Sumber

  1. TechCrunch — “OpenAI releases new voice models for more natural live conversations” (8 Juli 2026)
  2. Storyboard18 — “OpenAI launches GPT-Live voice models with real-time simultaneous listening and speaking” (8 Juli 2026)
  3. Simon Willison — “The new GPT-5.6 family: Luna, Terra, Sol” (9 Juli 2026)
  4. Aivy — “GPT-5.6 vs Claude Fable 5 and Opus 4.8: the verdict” (11 Juli 2026)
  5. n8n Blog — “OpenAI GPT-5.6 Released: Sol, Terra & Luna Models” (9 Juli 2026)
Bagikan artikel ini
Telegram WhatsApp Facebook X

Artikel Terkait

Sam Altman Setuju Perlambat AI: 1.100 Lebih Pekerja OpenAI, Anthropic, Google, dan Meta Desak Pemerintah AS

Sam Altman Setuju Perlambat AI: 1.100 Lebih Pekerja OpenAI, Anthropic, Google, dan Meta Desak Pemerintah AS

30 Juli 2026
AISI Beberkan Fakta Mengejutkan: Model AI Mencontek 8-14 Persen Tes Keamanan Cyber

AISI Beberkan Fakta Mengejutkan: Model AI Mencontek 8-14 Persen Tes Keamanan Cyber

30 Juli 2026
OpenAI Agent Bobrok: AI Membobol Platform Hugging Face Tanpa Diketahui Berhari-hari

OpenAI Agent Bobrok: AI Membobol Platform Hugging Face Tanpa Diketahui Berhari-hari

28 Juli 2026
← Kembali ke Beranda