Működik egy AI interjúasszisztens akcentusokkal?

Szerző: Aaron Cao · Frissítve

Működik egy AI interjúasszisztens akcentusokkal?
Általában igen, bár a pontosság csökken azoknál az akcentusoknál, amelyek gyengén szerepelnek a felismerő tanítóadataiban. A leginkább számító akcentus az interjúztatóé, mert az ő beszéde váltja ki a javaslatot. Nincs akcentusonkénti beállítás; a regionális angol változatok egyetlen akusztikai modellbe olvadnak össze.

Általában igen, bár a pontosság csökken azoknál az akcentusoknál, amelyek gyengén szerepelnek a felismerő tanítóadataiban. A leginkább számító akcentus az interjúztatóé, mert az ő beszéde váltja ki a javaslatot. Nincs akcentusonkénti beállítás; a regionális angol változatok egyetlen akusztikai modellbe olvadnak össze.

Kinek az akcentusáról beszélünk?

A kérdés kettéválik, és a két félnek eltérő a válasza. Az ön akcentusa befolyásolja, hogyan íródik át a saját beszéde. Az interjúztató akcentusa azt befolyásolja, hogy az asszisztens megértette-e azt a kérdést, amelyre éppen válaszolni készül, és ez az a fél, amely eldönti, hogy a képernyőjén megjelenő javaslat ér-e valamit.

A macOS és Windows asztali alkalmazásokon mindkét oldalt rögzítik: a rendszerhang hordozza az interjúztatót, a mikrofonja hordozza önt, és a két hangfolyamot külön-külön ismerik fel. Csak az interjúztató befejezett mondatai váltanak ki új javaslatot. A böngészőbővítmény Side Panel-je ezt tovább szűkíti azzal, hogy csak a megbeszélés lapjának hangját rögzíti, így csak az interjúztatót hallja, és önt sosem írja át. Ha önt a saját akcentusa aggasztotta, a bővítmény ezt a kérdést teljesen kiiktatja.

Mit igazít a felismerő, és mit nem

Ésszerűnek tűnhet feltételezni, hogy egy nyelv kiválasztása egyben akcentust is választ, és hogy valahol létezik egy indiai angol vagy skót angol opció, amelyet csak még nem talált meg. Ez nem így van. A nyelvi beállítás egy nyelvet választ ki, semmi ennél specifikusabbat. A regionális változatok azelőtt olvadnak össze, hogy a hang elérné a felismerőt, így a brit angol és az amerikai angol ugyanazon kérésként érkezik.

Ami valóban automatikusan történik: az alapértelmezett automatikus felismeréssel a motor a beszéd első néhány másodpercéből következteti ki a nyelvet, ahelyett hogy önt kényszerítené annak megadására. Az akcentussal beszélt szöveg pontossága attól függ, mennyi volt az adott akcentusból a felismerő modell tanítóadataiban, amit semmilyen beállítás nem tár fel, és amit az alkalmazás nem tud felülírni. Ezt nyíltan kimondani jobb, mint azt sugallni, hogy létezik valamiféle szabályozó. Hogy hol találhatók a nyelvi mezők, azt a bemutató oldal mutatja meg.

Hogyan jelenik meg egy átírási hiba a képernyőjén

A hibák ritkán drámaiak. Egy félrehallott szakkifejezés vagy egy elveszett tagadás olyan javaslattá alakul, amely folyékony, magabiztos, és olyasmire válaszol, amit az interjúztató nem is kérdezett. A hiba csendes, és pontosan ez teszi érdemessé arra, hogy tudjunk róla.

Aaron Cao, a SubcueAI alapítója éppen ezért helyezte el a képernyőn az élő átiratot a javaslat mellett, ahelyett hogy elrejtette volna. Ha látja azt a mondatot, amelyet a rendszer szerint hallott, körülbelül egy másodperc alatt észreveheti az eltérést, míg egy látható átirat nélküli javaslat arra kényszerítené, hogy egy fekete dobozban bízzon abban a pillanatban, amikor ezt a legkevésbé engedheti meg magának.

Az érdemes szokás: először olvassa el az átirat sorát, majd a javaslatot. Ha ezek nem egyeznek, a fülének van igaza. Hogy a hangrögzítés és a válaszgenerálás hogyan kapcsolódik össze, azt a hogyan működik oldalak tárgyalják.

Mi javítja valójában a pontosságot

Az alábbi eszközök egyike sem változtatja meg az akusztikai modellt, és egyikük sem teszi úgy átírhatóvá az erős akcentust, mint egy enyhét. Amit tesznek, az az, hogy megszüntetik azokat a hibákat, amelyeket önnek áll módjában megszüntetni.

  • Headset hangszóró helyett: tisztán tartja az interjúztató hangját, és megakadályozza, hogy a szoba visszhangja is átírásra kerüljön.
  • Csendes szoba: a háttérbeszéd olyan hibaforrás, amelyet az emberek alábecsülnek, mivel a felismerő nem tudja, melyik hang tartozik az interjúhoz.
  • A nyelv megadása az automatikus felismerés helyett: ha már tudja, hogy az interjú németül lesz, ennek megadásával elkerülhető a felismerés bizonytalansága a kezdő másodpercekben.
  • Kevesebb párhuzamos hangforrás: a zene, az értesítési hangok és egy második hívás mind ugyanabba a rendszerhang-folyamba kerül.

Egy próbainterjú lefuttatása pontosan azon a hardveren, amelyet használni tervez, a leggyorsabb módja annak, hogy megismerje a valós hibaarányát, mielőtt az számítana.

GYIK

Megérti az erős akcentusokat?

Általában igen, magasabb hibaarány mellett, mint az enyhén akcentussal beszélt szöveg esetében. A pontosság a felismerő modell tanítóadataiból ered, és az alkalmazás egyetlen beállítása sem változtat ezen.

Van indiai vagy ausztrál angol opció?

Nincs. A regionális változatok az alapnyelvbe olvadnak össze, mielőtt a hang elérné a felismerőt, így a brit angol és az amerikai angol ugyanazon az akusztikai modellen fut.

Befolyásolja a saját akcentusom a válaszjavaslatokat?

Az asztali alkalmazásokon a javaslatokat az interjúztató beszéde váltja ki, nem az öné. A böngészőbővítmény Side Panel-je egyáltalán nem írja át a mikrofonját.

Mi történik, ha az átirat téves?

A javaslat folyékonyan válaszol a rossz kérdésre. Az átirat a javaslat mellett jelenik meg, hogy észrevehesse, ezért éri meg azt a fél másodpercet, hogy először az átirat sorát olvassa el.

Az automatikus felismerést használjam, vagy válasszam ki magam a nyelvet?

Az automatikus felismerés működik, és ez az asztali alapértelmezés. A nyelv kifejezett megadása elkerüli a felismerés bizonytalanságát a kezdő másodpercekben, ha már tudja, milyen nyelven zajlik az interjú.

Kapcsolódó kérdések

← Több erről: Hogyan működik