Werkt een AI-interviewassistent met accenten?

Door Aaron Cao · Bijgewerkt op

Werkt een AI-interviewassistent met accenten?
Meestal wel, hoewel de nauwkeurigheid afneemt bij accenten die dun vertegenwoordigd zijn in de trainingsdata van de spraakherkenner. Het accent dat het meest telt is dat van de interviewer, omdat diens spraak een suggestie triggert. Er is geen instelling per accent; regionale Engelse varianten vallen samen tot één akoestisch model.

Meestal wel, hoewel de nauwkeurigheid afneemt bij accenten die dun vertegenwoordigd zijn in de trainingsdata van de spraakherkenner. Het accent dat het meest telt is dat van de interviewer, omdat diens spraak een suggestie triggert. Er is geen instelling per accent; regionale Engelse varianten vallen samen tot één akoestisch model.

Over wiens accent hebben we het?

De vraag splitst zich in tweeën, en beide helften hebben een ander antwoord. Uw accent beïnvloedt hoe uw eigen spraak wordt getranscribeerd. Het accent van de interviewer beïnvloedt of de assistent de vraag begreep die hij op het punt staat te beantwoorden, en dat is de helft die bepaalt of de suggestie op uw scherm ergens toe dient.

Op de macOS- en Windows-desktopapps worden beide kanten vastgelegd: systeemaudio draagt de interviewer, uw microfoon draagt u, en de twee streams worden apart herkend. Alleen de afgeronde zinnen van de interviewer triggeren een nieuwe suggestie. Het Side Panel van de browserextensie beperkt dit verder, doordat het alleen de audio van het meetingtabblad vastlegt, waardoor het alleen de interviewer hoort en u nooit transcribeert. Als uw eigen accent was wat u zorgen baarde, verwijdert de extensie dat vraagstuk volledig.

Wat de herkenner wel en niet aanpast

Het is redelijk om aan te nemen dat het kiezen van een taal ook een accent kiest, en dat er ergens een optie voor Indiaas-Engels of Schots-Engels bestaat die u nog niet heeft gevonden. Dat is niet zo. De taalinstelling selecteert een taal en niets specifiekers. Regionale varianten vallen samen voordat de audio de herkenner bereikt, dus UK English en US English komen aan als hetzelfde verzoek.

Wat wel automatisch gebeurt: met de standaard automatische detectie leidt de engine de taal af uit de eerste seconden spraak in plaats van u te dwingen deze op te geven. Nauwkeurigheid bij geaccentueerde spraak komt voort uit hoeveel van dat accent aanwezig was in de trainingsdata van het herkenningsmodel, iets wat geen enkele instelling blootlegt en de app niet kan overschrijven. Dat gewoon zo zeggen is beter dan doen alsof er een knop bestaat. Waar de taalvelden zich bevinden, wordt getoond op de pagina tutorial.

Hoe een transcriptiefout op uw scherm verschijnt

Fouten zijn zelden dramatisch. Een verkeerd verstane technische term of een weggevallen ontkenning verandert in een suggestie die vloeiend, zelfverzekerd is en iets beantwoordt wat de interviewer niet vroeg. De storing is stil, en dat is precies wat het de moeite waard maakt om te weten.

Aaron Cao, oprichter van SubcueAI, plaatste hierom het live transcript op het scherm naast de suggestie in plaats van het te verbergen. Door de zin te zien die het systeem denkt te hebben gehoord, kunt u de mismatch in ongeveer een seconde opmerken, terwijl een suggestie zonder zichtbaar transcript u op het moment dat u het zich het minst kunt veroorloven, zou laten vertrouwen op een black box.

De gewoonte die de moeite waard is om aan te leren: lees eerst de transcriptregel, dan de suggestie. Als ze niet overeenkomen, winnen uw oren. Hoe het vastleggen en het genereren van antwoorden samenhangen, wordt behandeld op de pagina's hoe het werkt.

Wat de nauwkeurigheid daadwerkelijk verbetert

Geen van de onderstaande hendels verandert het akoestische model, en geen ervan zorgt ervoor dat een sterk accent wordt getranscribeerd als een licht accent. Wat ze wel doen, is de fouten wegnemen die u zelf kunt wegnemen.

  • Een headset in plaats van speakers: houdt de audio van de interviewer schoon en voorkomt dat kamerecho weer wordt getranscribeerd.
  • Een stille ruimte: achtergrondgesprekken zijn een foutbron die mensen onderschatten, omdat de herkenner niet weet welke stem het interview is.
  • De taal benoemen in plaats van automatisch detecteren: als u al weet dat het interview in het Duits is, voorkomt dit benoemen een detectiewiebel in de openingsseconden.
  • Minder parallelle audiobronnen: muziek, meldingsgeluiden en een tweede oproep komen allemaal in dezelfde systeemaudiostream terecht.

Eén proefinterview draaien op precies de hardware die u van plan bent te gebruiken, is de snelste manier om uw echte foutpercentage te zien voordat het ertoe doet.

FAQ

Begrijpt het sterke accenten?

Meestal wel, met een hoger foutpercentage dan licht geaccentueerde spraak. Nauwkeurigheid komt voort uit de trainingsdata van het herkenningsmodel, en geen enkele instelling in de app verandert dat.

Is er een optie voor Indiaas-Engels of Australisch-Engels?

Nee. Regionale varianten vallen samen tot de basistaal voordat de audio de herkenner bereikt, dus UK English en US English draaien op hetzelfde akoestische model.

Beïnvloedt mijn eigen accent de antwoordsuggesties?

Op de desktopapps worden suggesties getriggerd door de spraak van de interviewer, niet de uwe. Het Side Panel van de browserextensie transcribeert uw microfoon helemaal niet.

Wat gebeurt er als het transcript fout is?

De suggestie beantwoordt vloeiend de verkeerde vraag. Het transcript staat naast de suggestie zodat u het kunt opmerken, en daarom is het de halve seconde waard om eerst de transcriptregel te lezen.

Moet ik automatische detectie gebruiken of de taal zelf kiezen?

Automatische detectie werkt en is de standaard op desktop. De taal expliciet benoemen voorkomt een detectiewiebel in de openingsseconden wanneer u al weet in welke taal het interview plaatsvindt.

Gerelateerde vragen

← Meer over Hoe het werkt