Mode suara baru ChatGPT akan melambat jika Anda menyuruhnya

OpenAI hari ini merilis dua model suara baru yang disebut GPT-Live-1 dan GPT-Live-1 mini yang menurut perusahaan membawa peningkatan besar pada fungsi suara ChatGPT. Anda mungkin ingat perusahaan meluncurkan Mode Suara Tingkat Lanjut pada musim panas 2024. Saat dirilis, fitur ini sangat mengesankan dan terasa seperti peningkatan besar dibandingkan asisten suara lama seperti Siri dan Alexa, tetapi seiring waktu, keterbatasannya mulai terasa lebih jelas. Secara khusus, Mode Suara Tingkat Lanjut menggunakan apa yang digambarkan OpenAI sebagai model suara “berbasis giliran”, yang berfungsi persis seperti suaranya. Model harus menunggu pengguna berhenti berbicara sebelum dapat merespons. Seperti yang mungkin Anda bayangkan, hal ini sering kali mengakibatkan gerakan maju mundur yang kaku. Terlebih lagi, karena model tersebut menggunakan keheningan sebagai isyarat untuk mulai berbicara, model tersebut sering salah mengartikan jeda singkat sebagai akhir dari sebuah pertanyaan atau pertanyaan, sehingga menyebabkan interupsi yang canggung. Sebaliknya, rangkaian model GPT-Live-1 dibangun di atas arsitektur dupleks. Mereka dapat secara bersamaan memproses masukan sekaligus menghasilkan keluaran pada saat yang bersamaan. “Hal ini memungkinkan model untuk melakukan proses bolak-balik yang lebih alami, mempertahankan pemahaman waktu yang lebih baik, dan bahkan melakukan terjemahan langsung,” jelas OpenAI. Pada saat yang sama, perusahaan telah merancang GPT-Live untuk mendelegasikan tugas. Jika model suara baru menentukan bahwa pertanyaan atau perintah Anda akan mendapatkan manfaat dari penalaran, penelusuran web, atau kemampuan agenik lainnya, model tersebut dapat beralih ke model OpenAI lainnya, termasuk GPT-5.5, untuk mendapatkan bantuan. Sistem ini akan bekerja di latar belakang, memungkinkan Anda melanjutkan percakapan dengan GPT-Live. Secara bersama-sama, perubahan-perubahan ini menghasilkan pengalaman suara yang menurut OpenAI akan lebih berguna bagi banyak orang. Anda dapat menginterupsi model suara baru kapan saja, dan bahkan meminta mereka untuk memperlambat jika Anda merasa mereka berbicara terlalu cepat. Saat Anda berbicara, mereka juga akan mengonfirmasi bahwa mereka mendengarkan dengan pengakuan verbal seperti “mhmm” dan “mengerti”, dan OpenAI mengatakan hal itu telah membuat model baru ini lebih baik dalam memfokuskan ketika ada suara-suara yang mengganggu di latar belakang. ChatGPT Voice kini juga dapat menghasilkan visual, dalam bentuk kartu seperti widget, untuk topik seperti cuaca, olahraga, saham, dan lainnya. Seperti sebelumnya, dukungan untuk unggahan gambar dan file sudah ada di dalam fitur ini, dan Anda juga dapat menggunakannya untuk mencari di web. Pada saat yang sama, OpenAI mengatakan telah membangun perlindungan baru pada ChatGPT Voice. “Ketika sistem mendeteksi keluaran yang berpotensi tidak aman, sistem dapat mengarahkan model ke arah respons yang lebih aman, memunculkan pesan keselamatan tambahan, atau mengakhiri percakapan suara dalam kasus-kasus berisiko tinggi,” kata perusahaan tersebut. Orang tua dan wali dapat menggunakan kontrol orang tua OpenAI yang baru-baru ini diperkenalkan untuk menonaktifkan Suara ChatGPT untuk remaja mereka. Jika mereka telah memberi anak mereka akses ke ChatGPT Voice dan sistem mendeteksi bahwa mereka mencoba mengarahkan percakapan ke arah yang merugikan diri sendiri, sistem akan memberi tahu orang tua tersebut. OpenAI mulai meluncurkan GPT-Live ke ChatGPT di Android, iOS, dan web, mulai hari ini. GPT-Live 1 akan menjadi model pilihan bagi mereka yang membayar langganan Go, Plus, dan Pro, sementara akun Gratis akan menggunakan model mini Live-1 yang lebih kecil secara default.


Diterbitkan : 2026-07-08 17:00:00

sumber : www.engadget.com