Runa nes vairāk nekā vārdus. Alkohola intoksikācija atstāj izmērāmas pēdas artikulācijā, tempā un spektrālajā mikrovariācijā — signālos, kurus cilvēka auss uztver labākajā gadījumā neuzticami.
XENOM R&D komanda ir apmācījusi patentētu dziļās mācīšanās modeli, lai atklātu šos akustiskos biomarķierus, un novērtējusi to Alcohol Language Corpus — standarta publiskajā etalonā šim uzdevumam.
Vērtējot stingri pēc vienādiem principiem — vidējais nesvērtais atsaukums pa logiem, viens lēmums katram izteikumam bez balsošanas, tieši tā, kā mēra iepriekšējos darbos — uz atsauci balstītā konfigurācija sasniedz 86.3% UAR. Bezatsauces konfigurācija, kurai nav nepieciešams reģistrēts bāzes līmenis un kura lemj no viena runas parauga, sasniedz 81.9%. Izvēršanas darbības punktā, kur sistēma apvieno vairākus ieraksta logus konsensa lēmumā, šie rādītāji pieaug attiecīgi līdz 87.6% un 82.5%.
Kontekstam: oficiālais Interspeech 2011 Speaker-State Challenge bāzes līmenis šajā korpusā ir 65.9% UAR, iepriekš publicētie pasaules līmeņa rezultāti sasniedz aptuveni 73–75%, un neapmācīti cilvēku klausītāji sasniedz aptuveni 60–65%.
Sistēma darbojas kā pasīvs slānis pār parasto radio satiksmi. Darbinieki runā tāpat kā vienmēr; nav papildu procedūras, nav uzdevuma pārtraukuma, nav atsevišķa kontrolpunkta.
Kas sistēma ir — un kas nav. Tā nemēra alkohola koncentrāciju asinīs un nevar kalpot par pamatu darbinieka atstādināšanai no pienākumiem. Tā ir pirmās līnijas skrīninga rīks, kas norāda, kam nepieciešama uzmanība, verifikācijai ar noteiktiem līdzekļiem. Attiecīgais salīdzinājums nav ar alkometru, bet gan ar mūsdienās izmantoto alternatīvu: vadītāja novērojumu, kas darbojas aptuveni neapmācītas klausīšanās līmenī.
Mēs esam publicējuši pilnus rezultātus dažādos akustiskos apstākļos — tostarp tajos, kur precizitāte pasliktinās — kopā ar salīdzināmības iebildēm un zināmajiem metodes ierobežojumiem.