Kami telah meringkas halaman pengumuman peluncuran.
--
OpenAI telah meluncurkan GPT-Live>, model suara generasi berikutnya yang dirancang untuk percakapan suara langsung alami (ditenagai oleh ChatGPT Voice), dengan fitur dan fungsi utama sebagai berikut.
1. Interaksi Berkelanjutan
Arsitektur Full-Duplex: Daripada menunggu pengguna selesai berbicara seperti model sebelumnya, GPT-Live mendengarkan dan berbicara secara real-time.
Aliran Percakapan Alami: Model ini dapat mentoleransi interupsi dan jeda selama percakapan, memberikan respons yang menunjukkan pendengaran aktif seperti "hmm" atau "aha", menciptakan pengalaman yang mirip dengan berbicara dengan manusia.
2. Delegasi Model Berperforma Tinggi
Struktur Hibrida: GPT-Live menangani percakapan real-time, sementara model Frontier yang lebih canggih bertanggung jawab atas inferensi kompleks dan pencarian web.
Pengolahan Tugas Latar Belakang: Ketika pertanyaan kompleks atau pencarian web diperlukan, tugas tersebut didelegasikan ke model Frontier terbaru (saat peluncuran GPT-5.5) di latar belakang. Model akan mencari informasi dan berpikir sementara percakapan dengan pengguna tetap berlanjut tanpa gangguan.
3. Tiga Modus Inferensi yang Ditawarkan
Pengguna dapat memilih tingkat inferensi latar belakang yang diinginkan berdasarkan kebutuhan mereka.
Instant (Cepat): Cocok untuk saat membutuhkan jawaban cepat.
Medium / High (Inferensi Mendalam): Pengaturan ini memungkinkan model untuk meluangkan waktu dan melakukan inferensi yang lebih mendalam untuk pertanyaan yang kompleks.
4. Penyediaan Kartu Visual
Selama percakapan suara, informasi yang membutuhkan konfirmasi visual seperti cuaca, saham, hasil pertandingan olahraga, dan peta akan ditampilkan sebagai Kartu Visual Kaya di layar.
5. Peningkatan Pendengaran dan Pengurangan Kebisingan
GPT-Live ditingkatkan untuk fokus lebih baik pada suara pengguna meskipun ada kebisingan latar belakang seperti suara kendaraan atau percakapan orang lain.
Model ini juga dapat menunggu dengan sabar saat pengguna sedang berpikir dan berhenti berbicara, mencegah pemutusan percakapan yang tiba-tiba.
6. Keamanan Suara yang Diperkuat
GPT-Live dilengkapi dengan mekanisme pengaman real-time yang dapat mengarahkan percakapan ke jawaban yang aman atau menghentikannya jika terjadi output berbahaya selama percakapan.
Untuk mencegah peniruan suara, hanya sembilan suara unik yang ditentukan yang diizinkan untuk digunakan.
--
Informasi Peluncuran dan Ketersediaan: GPT-Live telah diluncurkan secara global melalui iOS, Android, dan ChatGPT.com. Pengguna berlangganan Plus dan Pro akan menggunakan GPT-Live-1 sebagai default, sementara pengguna gratis akan menggunakan GPT-Live-1 mini sebagai model suara default. (Fitur berbagi layar dan video belum tersedia pada peluncuran awal dan akan diperbarui di kemudian hari.)
▶ Sumber Asli: https://openai.com/index/introducing-gpt-live/