Blog Metlivi

Ketika Suara Teman AI Berubah: Cara Mengenali Perbedaannya dan Menyesuaikannya

Jika suara teman AI terdengar berbeda, kenali perubahannya sebelum memutuskan apa yang harus dilakukan: bandingkan nada, tempo, pelafalan, dan jeda di sekitar giliran bicara Anda. Jika aplikasi menyediakan pilihan suara atau pratinjau, dengarkan dan pilih opsi yang sesuai untuk Anda; jika didukung, berikan instruksi sederhana seperti “bicara sedikit lebih lambat.” Pembaruan suara dapat mengubah lebih dari sekadar warna suara (timbre). Misalnya, OpenAI menyatakan bahwa pengalaman ChatGPT Voice terbarunya telah me-remaster suara-suaranya dan mengubah cara penanganan interupsi serta jeda. Ini adalah detail khusus produk, tetapi hal ini menggambarkan mengapa percakapan yang akrab tiba-tiba bisa terdengar berbeda. Pengumuman GPT‑Live OpenAI

30 September 20267 min readMembaca, seni, dan budayaOleh Metlivi Editorial Team
Bagian 1

Mengapa suara AI yang familier bisa terasa berbeda?

“Suara” bukanlah satu fitur bunyi tunggal. Pendengar mungkin mengenali suara sebagian dari rentang nada atau timbrenya, tetapi tempo, penekanan, pelafalan, dan penentuan waktu giliran bicara juga membentuk kesan keseluruhan. Pembaruan produk dapat mengubah beberapa hal ini sekaligus. Halaman bantuan Voice OpenAI saat ini, misalnya, mencantumkan suara yang dapat dipilih dan menyebutkan bahwa pengguna dapat meminta sistem untuk mengubah nada bicara, tempo, atau gaya responsnya; catatan rilisnya menjelaskan perubahan pada pengalaman Voice dari waktu ke waktu. Kontrol dan perilaku yang tersedia bergantung pada produk, versi, dan akun, jadi periksalah pengaturan aplikasi saat ini daripada berasumsi bahwa menu lama masih berlaku. Bantuan ChatGPT Voice

Perubahan juga bisa bersifat halus. Suara tersebut mungkin memiliki nada yang mirip tetapi melafalkan nama secara berbeda, berpindah antarklausa dengan kecepatan lain, atau memberikan jeda berbeda sebelum menjawab. Jika detail-detail tersebut sebelumnya membuat suara yang familier itu mudah diikuti, versi baru mungkin membutuhkan sedikit perhatian untuk membiasakan diri. Ini adalah penjelasan praktis, bukan klaim bahwa setiap pendengar akan bereaksi dengan cara yang sama.

Bagian 2

Hal yang perlu didengarkan: empat perbedaan yang dapat diamati

Gunakan perintah singkat atau topik yang sama untuk perbandingan sederhana, jika aplikasi memungkinkan Anda memutar ulang atau mempratinjau suara. Dengarkan satu fitur dalam satu waktu daripada mencoba menilai seluruh suara sekaligus.

Nada dan kualitas vokal. Apakah suaranya terdengar lebih tinggi atau lebih rendah, lebih cerah atau lebih beresonansi? Ini adalah kesan subjektif, jadi Anda tidak perlu menyebutkan ukuran akustik. Catat perbandingannya dalam bahasa sederhana, seperti “lebih rendah di akhir kalimat.”

Tempo dan pemenggalan frasa. Apakah ia berbicara lebih cepat, memberikan jeda lebih pendek di dalam kalimat, atau memberi penekanan pada kata-kata yang berbeda? Penyampaian yang lebih cepat dapat membuat jawaban yang familier terasa lebih padat meskipun kata-katanya tidak berubah.

Pelafalan. Dengarkan bunyi yang memengaruhi pengenalan kata: nama orang, tempat, kata serapan, atau kata dalam bahasa yang sering Anda gunakan. Catat satu contoh jika perbedaan pelafalan membuat suara tersebut lebih sulit dipahami.

Penentuan waktu giliran bicara (turn timing). Perhatikan apakah suara tersebut mulai berbicara lebih cepat setelah Anda berhenti, menunggu lebih lama, atau merespons saat Anda masih menambahkan pemikiran. Dalam studi tentang percakapan manusia, penentuan waktu giliran bicara dibentuk oleh isyarat seperti tata bahasa dan prosodi, dan jeda antar-giliran bervariasi tergantung jenis interaksinya. Bukti tersebut berkaitan dengan percakapan manusia; hal itu tidak menetapkan bagaimana sistem AI tertentu mengatur waktu jawabannya. Namun, ini membantu menjelaskan mengapa jeda yang berubah bisa sangat terasa sebagai bagian tersendiri dari sebuah percakapan lisan. Stivers et al., “Universals and cultural variation in turn-taking in conversation”

Bagian 3

Cara menggunakan pilihan suara atau pratinjau

Pertama, temukan kontrol yang benar-benar tersedia di aplikasi Anda. Cari bagian suara atau audio di pengaturan, atau buka layar percakapan suara dan periksa menunya. Jika ada opsi bernama, dengarkan setiap pratinjau yang disediakan. Nama atau deskripsi singkat dapat mempersempit pilihan, tetapi mendengarkan sampelnya jauh lebih berguna untuk menilai tempo, pelafalan, dan kualitas vokal. Ketersediaan, label, dan kontrol dapat berbeda di setiap produk dan berubah seiring pembaruan.

Halaman bantuan ChatGPT saat ini, sebagai salah satu contoh khusus produk, mengarahkan pengguna ke Pengaturan → Suara untuk memilih suara yang disukai dari opsi yang tersedia. Disebutkan juga bahwa mengubah suara yang dipilih selama percakapan suara aktif akan memulai panggilan suara baru dalam obrolan yang sama. Halaman tersebut menyatakan pengguna dapat meminta perubahan nada, tempo, atau gaya respons selama percakapan, dan dapat meminta ChatGPT untuk berbicara lebih cepat atau lebih lambat, meskipun kontrol kecepatan pemutaran yang presisi saat ini belum tersedia. Petunjuk ini tidak boleh disamaratakan untuk aplikasi teman AI lainnya. Bantuan ChatGPT Voice

Saat membandingkan opsi, gunakan daftar periksa mendengarkan sederhana daripada bertanya mana yang “terbaik” secara abstrak:

Suara mana yang paling mudah Anda pahami pada volume pendengaran biasa?

Apakah temponya memberi Anda cukup waktu untuk mencerna setiap pemikiran?

Apakah kata-kata atau nama-nama yang penting bagi Anda dilafalkan dengan jelas?

Apakah jedanya memberi Anda ruang untuk menyelesaikan pembicaraan?

Jika pratinjau terlalu pendek untuk menjawab pertanyaan-pertanyaan tersebut, cobalah percakapan singkat dan santai menggunakan topik yang Anda ketahui dengan baik. Konten yang familier memudahkan Anda memperhatikan penyampaiannya daripada menghabiskan perhatian untuk memahami arti dari jawaban tersebut. Perlakukan ini sebagai perbandingan pribadi, bukan tes formal.

Bagian 4

Cara mendeskripsikan perubahan dan menyatakan preferensi

Preferensi yang jelas menyebutkan fitur yang terdengar dan tindakannya. Misalnya: “Tolong bicara sedikit lebih lambat dan berikan jeda singkat setelah saya selesai.” Atau: “Pertahankan suara yang sama, tetapi lafalkan kedua nama ini seperti yang saya tulis.” Jika layanan tersebut memiliki pengaturan pelafalan khusus atau instruksi kustom, gunakanlah jika tersedia; jangan berasumsi setiap aplikasi memilikinya. Permintaan langsung dapat mengarahkan respons dalam sebuah percakapan, tetapi mungkin tidak mengubah suara default secara permanen atau memengaruhi sesi-sesi berikutnya.

Pisahkan apa yang Anda dengar dari cara Anda menilainya. “Suara tersebut sekarang memberi penekanan lebih pada kata terakhir” adalah sebuah observasi. “Saya lebih suka penyampaian sebelumnya yang lebih stabil” adalah sebuah preferensi. Memisahkan kedua hal ini membantu Anda memutuskan apakah pengaturan, suara yang berbeda, atau permintaan tempo sederhana dapat mengatasi perbedaan yang sebenarnya Anda rasakan.

Bagian 5

Rutinitas penyesuaian singkat

Pilih perintah yang familier. Gunakan satu atau dua kalimat yang memancing respons lisan normal, bukan demonstrasi teknis yang tidak biasa.

Dengarkan satu fitur dalam satu waktu. Pada putaran pertama, perhatikan tempo; pada putaran lain, periksa pelafalan atau waktu giliran bicara. Ini mencegah satu perbedaan mencolok mengaburkan seluruh aspek suara.

Coba pratinjau atau pengaturan yang tersedia. Bandingkan hanya pilihan yang disediakan aplikasi. Jika tidak ada pratinjau, gunakan percakapan singkat daripada menebak-nebak dari nama suara.

Berikan satu instruksi spesifik. Mintalah tempo yang lebih lambat, pelafalan yang lebih jelas untuk kata tertentu, atau waktu lebih lama sebelum menjawab. Satu permintaan mempermudah Anda mengetahui apakah penyesuaian tersebut membantu.

Nilai kembali setelah beberapa kali percakapan biasa. Pendengar dapat beradaptasi dengan beberapa pola bicara yang asing melalui paparan berulang, tetapi penelitian tidak menjamin bahwa suara AI tertentu pasti akan menjadi nyaman atau bahwa perubahan akan terjadi sesuai jadwal yang pasti. Studi tentang adaptasi jangka pendek terhadap ucapan manusia beraksen asing menemukan adanya peningkatan pemahaman setelah mendapat paparan dalam tugas eksperimental tertentu, termasuk beberapa transfer pemahaman ke pembicara lain; hal tersebut merupakan latar belakang yang berguna tentang cara mendengar, bukan bukti langsung tentang pembaruan suara AI. Xie et al., “Rapid adaptation to foreign-accented speech and its transfer to an unfamiliar talker”

Bagian 6

Kapan perubahan pengaturan menjadi pilihan yang lebih praktis

Jika suara baru tetap sulit dipahami setelah mencoba meminta tempo atau pelafalan yang jelas, pilihlah suara lain yang tersedia jika Anda mau. Jika tidak ada opsi yang mengatasi masalah spesifik tersebut, teks mungkin lebih nyaman untuk percakapan tersebut. Ini adalah cara wajar untuk menyesuaikan antarmuka dengan kebutuhan; tidak perlu memaksakan diri menggunakan pengaturan suara yang tidak cocok dengan apa yang sedang Anda lakukan.

Memeriksa apakah aplikasi baru-baru ini memperbarui pengalaman suaranya juga bisa membantu. Catatan rilis mungkin menjelaskan bahwa suatu produk telah mengubah suara atau waktu percakapannya, meskipun catatan tersebut tidak dapat memberi tahu Anda secara pasti apa yang Anda dengar atau pengaturan mana yang paling cocok untuk Anda. OpenAI, misalnya, menjelaskan pembaruan fitur ChatGPT Voice dan perilaku suaranya di dalam catatan rilisnya. Untuk layanan lain, periksalah dokumentasi resmi terbaru dari layanan tersebut. Catatan rilis ChatGPT

Tujuan praktisnya sederhana: sebutkan perbedaan bunyi yang terdengar, uji kontrol yang Anda miliki, lalu gunakan suara atau gaya interaksi yang berfungsi baik untuk percakapan sehari-hari Anda. Pratinjau dapat membantu membandingkan opsi, dan permintaan spesifik dapat memperjelas preferensi Anda; keduanya tidak menuntut Anda memperlakukan perubahan suara lebih dari sekadar perubahan cara bicara produk tersebut.

Bacaan terkait

Lanjutkan topik ini