Apakah asisten wawancara AI berfungsi dengan aksen?
Oleh Aaron Cao · Diperbarui

Biasanya ya, meski akurasi menurun pada aksen yang datanya tipis dalam data pelatihan alat pengenal suara. Aksen yang paling penting adalah aksen pewawancara, karena ucapan merekalah yang memicu munculnya saran jawaban. Tidak ada pengaturan per-aksen; varian bahasa Inggris regional digabung menjadi satu model akustik.
Aksen siapa yang kita bicarakan?
Pertanyaan ini terbagi dua, dan masing-masing bagian punya jawaban berbeda. Aksen Anda memengaruhi bagaimana ucapan Anda sendiri ditranskripsikan. Aksen pewawancara memengaruhi apakah asisten memahami pertanyaan yang akan dijawabnya, dan itulah bagian yang menentukan apakah saran di layar Anda ada gunanya.
Pada aplikasi desktop macOS dan Windows, kedua sisi ditangkap: audio sistem membawa suara pewawancara, mikrofon Anda membawa suara Anda, dan kedua aliran audio dikenali secara terpisah. Hanya kalimat pewawancara yang sudah selesai diucapkan yang memicu saran baru. Side Panel ekstensi peramban mempersempit ini lebih lanjut, hanya menangkap audio dari tab rapat, sehingga hanya mendengar pewawancara dan tidak pernah mentranskripsikan Anda. Jika aksen Anda sendiri adalah hal yang Anda khawatirkan, ekstensi ini menghilangkan masalah tersebut sepenuhnya.
Apa yang disesuaikan oleh alat pengenal suara dan apa yang tidak
Wajar untuk mengira bahwa memilih bahasa juga memilih aksen, dan bahwa opsi Inggris India atau Inggris Skotlandia ada di suatu tempat yang belum Anda temukan. Tidak ada. Pengaturan bahasa hanya memilih bahasa, tidak lebih spesifik dari itu. Varian regional digabungkan sebelum audio mencapai alat pengenal suara, sehingga bahasa Inggris Britania dan bahasa Inggris Amerika tiba sebagai permintaan yang sama.
Yang memang terjadi secara otomatis: dengan deteksi otomatis default, mesin ini menentukan bahasa dari beberapa detik pertama ucapan alih-alih mengharuskan Anda mendeklarasikannya. Akurasi pada ucapan beraksen berasal dari seberapa banyak aksen tersebut ada dalam data pelatihan model pengenalan, yang tidak diekspos oleh pengaturan apa pun dan tidak dapat diubah oleh aplikasi. Mengatakannya secara terus terang lebih baik daripada menyiratkan seolah ada kenop pengaturan. Lokasi kolom bahasa ditunjukkan di halaman tutorial.
Bagaimana kesalahan transkripsi muncul di layar Anda
Kesalahan jarang bersifat dramatis. Istilah teknis yang salah didengar atau negasi yang terlewat berubah menjadi saran yang lancar, meyakinkan, dan menjawab sesuatu yang tidak ditanyakan oleh pewawancara. Kegagalannya senyap, dan justru itulah yang membuatnya penting untuk diketahui.
Aaron Cao, pendiri SubcueAI, menempatkan transkrip langsung di layar di samping saran jawaban alih-alih menyembunyikannya karena alasan ini. Melihat kalimat yang menurut sistem ia dengar memungkinkan Anda menangkap ketidakcocokan dalam waktu sekitar satu detik, sementara saran tanpa transkrip yang terlihat akan membuat Anda mempercayai kotak hitam pada saat Anda paling tidak mampu melakukannya.
Kebiasaan yang layak dibangun: baca baris transkrip terlebih dahulu, saran jawaban kedua. Saat keduanya tidak sesuai, telinga Anda yang menang. Bagaimana penangkapan audio dan pembuatan jawaban saling berkaitan dibahas di berbagai halaman cara kerja.
Apa yang benar-benar meningkatkan akurasi
Tak satu pun dari faktor di bawah ini mengubah model akustik, dan tak satu pun membuat aksen yang kental ditranskripsikan seperti aksen yang ringan. Yang bisa dilakukan adalah menghilangkan kesalahan yang memang bisa Anda hilangkan.
- Headset alih-alih speaker: menjaga audio pewawancara tetap bersih dan mencegah gema ruangan ikut tertranskripsikan kembali.
- Ruangan yang tenang: percakapan latar belakang adalah sumber kesalahan yang sering diremehkan orang, karena alat pengenal suara tidak tahu suara mana yang merupakan wawancara.
- Menyebutkan bahasa secara eksplisit alih-alih deteksi otomatis: jika Anda sudah tahu wawancara akan berlangsung dalam bahasa Jerman, menyatakannya menghindari kegoyahan deteksi di detik-detik awal.
- Lebih sedikit sumber audio paralel: musik, suara notifikasi, dan panggilan kedua semuanya masuk ke aliran audio sistem yang sama.
Menjalankan satu wawancara simulasi pada perangkat keras persis yang akan Anda gunakan adalah cara tercepat untuk melihat tingkat kesalahan sebenarnya sebelum itu menjadi masalah.
FAQ
Apakah sistem memahami aksen yang kental?
Apakah ada opsi Inggris India atau Inggris Australia?
Apakah aksen saya sendiri memengaruhi saran jawaban?
Apa yang terjadi jika transkrip salah?
Sebaiknya saya gunakan deteksi otomatis atau memilih bahasa sendiri?
Pertanyaan terkait
- Bagaimana cara kerja speech-to-text wawancara real-time?
- Apa itu generator jawaban wawancara AI dan bagaimana cara kerjanya?
- Apakah rekruter dapat menggunakan asisten wawancara AI saat melamar peran baru?
- Bagaimana asisten wawancara AI merekam audio sistem di iOS?
- Bisakah asisten AI membantu Anda menegosiasikan gaji?
- Apa keterbatasan nyata dari interview copilot atau AI interview assistant?