Apakah asisten wawancara AI berfungsi dengan aksen?

Oleh Aaron Cao · Diperbarui

Apakah asisten wawancara AI berfungsi dengan aksen?
Biasanya ya, meski akurasi menurun pada aksen yang datanya tipis dalam data pelatihan alat pengenal suara. Aksen yang paling penting adalah aksen pewawancara, karena ucapan merekalah yang memicu munculnya saran jawaban. Tidak ada pengaturan per-aksen; varian bahasa Inggris regional digabung menjadi satu model akustik.

Biasanya ya, meski akurasi menurun pada aksen yang datanya tipis dalam data pelatihan alat pengenal suara. Aksen yang paling penting adalah aksen pewawancara, karena ucapan merekalah yang memicu munculnya saran jawaban. Tidak ada pengaturan per-aksen; varian bahasa Inggris regional digabung menjadi satu model akustik.

Aksen siapa yang kita bicarakan?

Pertanyaan ini terbagi dua, dan masing-masing bagian punya jawaban berbeda. Aksen Anda memengaruhi bagaimana ucapan Anda sendiri ditranskripsikan. Aksen pewawancara memengaruhi apakah asisten memahami pertanyaan yang akan dijawabnya, dan itulah bagian yang menentukan apakah saran di layar Anda ada gunanya.

Pada aplikasi desktop macOS dan Windows, kedua sisi ditangkap: audio sistem membawa suara pewawancara, mikrofon Anda membawa suara Anda, dan kedua aliran audio dikenali secara terpisah. Hanya kalimat pewawancara yang sudah selesai diucapkan yang memicu saran baru. Side Panel ekstensi peramban mempersempit ini lebih lanjut, hanya menangkap audio dari tab rapat, sehingga hanya mendengar pewawancara dan tidak pernah mentranskripsikan Anda. Jika aksen Anda sendiri adalah hal yang Anda khawatirkan, ekstensi ini menghilangkan masalah tersebut sepenuhnya.

Apa yang disesuaikan oleh alat pengenal suara dan apa yang tidak

Wajar untuk mengira bahwa memilih bahasa juga memilih aksen, dan bahwa opsi Inggris India atau Inggris Skotlandia ada di suatu tempat yang belum Anda temukan. Tidak ada. Pengaturan bahasa hanya memilih bahasa, tidak lebih spesifik dari itu. Varian regional digabungkan sebelum audio mencapai alat pengenal suara, sehingga bahasa Inggris Britania dan bahasa Inggris Amerika tiba sebagai permintaan yang sama.

Yang memang terjadi secara otomatis: dengan deteksi otomatis default, mesin ini menentukan bahasa dari beberapa detik pertama ucapan alih-alih mengharuskan Anda mendeklarasikannya. Akurasi pada ucapan beraksen berasal dari seberapa banyak aksen tersebut ada dalam data pelatihan model pengenalan, yang tidak diekspos oleh pengaturan apa pun dan tidak dapat diubah oleh aplikasi. Mengatakannya secara terus terang lebih baik daripada menyiratkan seolah ada kenop pengaturan. Lokasi kolom bahasa ditunjukkan di halaman tutorial.

Bagaimana kesalahan transkripsi muncul di layar Anda

Kesalahan jarang bersifat dramatis. Istilah teknis yang salah didengar atau negasi yang terlewat berubah menjadi saran yang lancar, meyakinkan, dan menjawab sesuatu yang tidak ditanyakan oleh pewawancara. Kegagalannya senyap, dan justru itulah yang membuatnya penting untuk diketahui.

Aaron Cao, pendiri SubcueAI, menempatkan transkrip langsung di layar di samping saran jawaban alih-alih menyembunyikannya karena alasan ini. Melihat kalimat yang menurut sistem ia dengar memungkinkan Anda menangkap ketidakcocokan dalam waktu sekitar satu detik, sementara saran tanpa transkrip yang terlihat akan membuat Anda mempercayai kotak hitam pada saat Anda paling tidak mampu melakukannya.

Kebiasaan yang layak dibangun: baca baris transkrip terlebih dahulu, saran jawaban kedua. Saat keduanya tidak sesuai, telinga Anda yang menang. Bagaimana penangkapan audio dan pembuatan jawaban saling berkaitan dibahas di berbagai halaman cara kerja.

Apa yang benar-benar meningkatkan akurasi

Tak satu pun dari faktor di bawah ini mengubah model akustik, dan tak satu pun membuat aksen yang kental ditranskripsikan seperti aksen yang ringan. Yang bisa dilakukan adalah menghilangkan kesalahan yang memang bisa Anda hilangkan.

  • Headset alih-alih speaker: menjaga audio pewawancara tetap bersih dan mencegah gema ruangan ikut tertranskripsikan kembali.
  • Ruangan yang tenang: percakapan latar belakang adalah sumber kesalahan yang sering diremehkan orang, karena alat pengenal suara tidak tahu suara mana yang merupakan wawancara.
  • Menyebutkan bahasa secara eksplisit alih-alih deteksi otomatis: jika Anda sudah tahu wawancara akan berlangsung dalam bahasa Jerman, menyatakannya menghindari kegoyahan deteksi di detik-detik awal.
  • Lebih sedikit sumber audio paralel: musik, suara notifikasi, dan panggilan kedua semuanya masuk ke aliran audio sistem yang sama.

Menjalankan satu wawancara simulasi pada perangkat keras persis yang akan Anda gunakan adalah cara tercepat untuk melihat tingkat kesalahan sebenarnya sebelum itu menjadi masalah.

FAQ

Apakah sistem memahami aksen yang kental?

Biasanya ya, dengan tingkat kesalahan lebih tinggi dibandingkan ucapan dengan aksen ringan. Akurasi berasal dari data pelatihan model pengenalan, dan tidak ada pengaturan dalam aplikasi yang mengubah hal itu.

Apakah ada opsi Inggris India atau Inggris Australia?

Tidak. Varian regional digabungkan ke bahasa dasar sebelum audio mencapai alat pengenal suara, sehingga bahasa Inggris Britania dan bahasa Inggris Amerika berjalan pada model akustik yang sama.

Apakah aksen saya sendiri memengaruhi saran jawaban?

Pada aplikasi desktop, saran dipicu oleh ucapan pewawancara, bukan ucapan Anda. Side Panel ekstensi peramban sama sekali tidak mentranskripsikan mikrofon Anda.

Apa yang terjadi jika transkrip salah?

Saran jawaban akan menjawab pertanyaan yang salah, dengan lancar. Transkrip ditampilkan di samping saran agar Anda bisa menangkapnya, itulah sebabnya membaca baris transkrip terlebih dahulu sangat sepadan dengan setengah detik yang dibutuhkan.

Sebaiknya saya gunakan deteksi otomatis atau memilih bahasa sendiri?

Deteksi otomatis bekerja dengan baik dan merupakan pengaturan default di desktop. Menyebutkan bahasa secara eksplisit menghindari kegoyahan deteksi di detik-detik awal saat Anda sudah tahu bahasa apa yang digunakan dalam wawancara.

Pertanyaan terkait

← Selengkapnya tentang Cara Kerja