XENOM rannsóknir og þróun nær fremstu stöðu í óífarandi raddskimun

Tal ber meira en orð. Áfengisvíma skilur eftir mælanleg ummerki í framburði, hraða og litrófsbreytileika — merki sem mannseyrað skráir í besta falli óáreiðanlega.

Rannsóknar- og þróunarteymi XENOM hefur þjálfað eigið djúpt námslíkan til að greina þessi hljóðrænu lífmerki og metið það á Alcohol Language Corpus, stöðluðu opinberu viðmiðunarsafni fyrir þetta verkefni.

Strangt skorað eins og á við um sambærileg verk — vegið meðaltal næmni án atkvæðagreiningar, ein ákvörðun á hverja segð án atkvæðagreiðslu, nákvæmlega eins og fyrri vinna er mæld — nær viðmiðunartengda útfærslan 86,3% UAR. Viðmiðunarlausa útfærslan, sem krefst engra skráðra grunnlína og tekur ákvörðun út frá einu töluðu sýni, nær 81,9%. Við notkunarstarfspunktinn, þar sem kerfið sameinar nokkra glugga upptöku í samstöðuákvörðun, hækka þessar tölur í 87,6% og 82,5% í þessari röð.

Til samhengis: opinbera Interspeech 2011 Speaker-State Challenge grunnlínan fyrir þetta safn stendur í 65,9% UAR, áður birt fremstu niðurstöður ná hámarki um það bil 73–75%, og óþjálfaðir hlustendur skora um 60–65%.

Kerfið keyrir sem óvirkt lag ofan á hefðbundna talstöðvarumferð. Starfsmenn tala eins og þeir gera alltaf; engin viðbótaraðferð, engin truflun á verkinu, engin sérstök eftirlitsstöð.

Hvað kerfið er — og er ekki. Það mælir ekki áfengisstyrk í blóði og getur ekki þjónað sem grundvöllur fyrir því að víkja starfsmanni frá vinnu. Það er fyrsta stigs skimunartæki sem gefur til kynna hverjir eiga skilið athygli, til staðfestingar með viðurkenndum aðferðum. Viðeigandi samanburður er ekki við áfengismæli, heldur við það sem notað er í dag: eftirlitsathugun yfirmanna, sem skilar árangri á svipuðu stigi og óþjálfuð hlustun.

Við höfum birt fullar niðurstöður þvert á hljóðaðstæður — þar á meðal þær þar sem nákvæmni rýrnar — ásamt fyrirvörum um samanburðarhæfi og þekktum takmörkunum aðferðarinnar.