Речта носи повече от думи. Алкохолното опиянение оставя измерими следи в артикулацията, темпото и спектралните микровариации — сигнали, които човешкото ухо регистрира в най-добрия случай ненадеждно.
R&D екипът на XENOM обучи собствен модел за дълбоко обучение за откриване на тези акустични биомаркери и го оцени върху Alcohol Language Corpus, стандартния публичен бенчмарк за тази задача.
Оценен строго едно към едно — непретеглена средна чувствителност по прозорци, едно решение на изказване без гласуване, точно както се измерва предишната работа — референтната конфигурация достига 86.3% UAR. Конфигурацията без референция, която не изисква записан изходен профил и решава от една изговорена проба, достига 81.9%. При работната точка на внедряване, където системата комбинира няколко прозореца от запис в консенсусно решение, тези стойности нарастват съответно до 87.6% и 82.5%.
За контекст: официалният базов резултат от Interspeech 2011 Speaker-State Challenge върху този корпус е 65.9% UAR, предишните публикувани най-добри резултати достигат около 73–75%, а нетренираните човешки слушатели постигат около 60–65%.
Системата работи като пасивен слой върху рутинния радиотрафик. Работниците говорят както винаги; без допълнителна процедура, без прекъсване на задачата, без отделен контролен пункт.
Какво е системата — и какво не е. Тя не измерва концентрацията на алкохол в кръвта и не може да служи като основание за отстраняване на работник от дежурство. Това е инструмент за първичен скрининг, който показва кой заслужава внимание, за проверка чрез установени средства. Релевантното сравнение не е с дрегер, а с алтернативата, използвана днес: наблюдение от супервайзор, което се представя приблизително на нивото на нетренирано слушане.
Публикувахме пълни резултати в различни акустични условия — включително тези, при които точността се влошава — заедно с уговорките за сравнимост и известните ограничения на метода.