XENOM MTEP pasiekia pažangiausią lygį neinvazinio balso patikros srityje

Kalba neša daugiau nei žodžius. Apsvaigimas nuo alkoholio palieka išmatuojamus pėdsakus artikuliacijoje, tempe ir spektrinėse mikro variacijose — signalus, kuriuos žmogaus ausis geriausiu atveju registruoja nepatikimai.

XENOM MTEP komanda apmokė patentuotą gilaus mokymosi modelį aptikti šiuos akustinius biomarkerius ir įvertino jį naudojant Alcohol Language Corpus, standartinį viešą šios užduoties etaloną.

Vertinant griežtai analogiškai — pagal lango nesvertinį vidutinį atšaukimą, vienas sprendimas vienam pasisakymui be balsavimo, tiksliai taip, kaip matuojami ankstesni darbai — referencinė konfigūracija pasiekia 86,3% UAR. Be referencijos konfigūracija, kuriai nereikia užregistruoto pradinio taško ir kuri nusprendžia iš vieno ištarto pavyzdžio, pasiekia 81,9%. Diegimo veikimo taške, kai sistema sujungia kelis įrašo langus į konsensuso sprendimą, šie rodikliai pakyla atitinkamai iki 87,6% ir 82,5%.

Kontekstui: oficialus Interspeech 2011 Speaker-State Challenge pradinis lygis šiame tekstyne yra 65,9% UAR, anksčiau paskelbti pažangiausi rezultatai pasiekia maždaug 73–75%, o neapmokyti žmonės klausytojai pasiekia apie 60–65%.

Sistema veikia kaip pasyvus sluoksnis per įprastą radijo eismą. Darbuotojai kalba taip, kaip visada; jokios papildomos procedūros, jokio užduoties pertraukimo, jokio atskiro patikros punkto.

Ką sistema yra — ir ko nėra. Ji nematuoja alkoholio koncentracijos kraujyje ir negali būti pagrindas nušalinti darbuotoją nuo pareigų. Tai pirmosios linijos patikros įrankis, nurodantis, kam reikia dėmesio, kad būtų patikrinta nustatytais metodais. Atitinkamas palyginimas yra ne su alkotesteriu, o su šiandien naudojama alternatyva: vadovo stebėjimu, kuris veikia maždaug neapmokyto klausymo lygiu.

Paskelbėme išsamius rezultatus įvairiomis akustinėmis sąlygomis — įskaitant tas, kuriose tikslumas mažėja — kartu su palyginamumo išlygomis ir žinomais metodo apribojimais.