R&D на XENOM постига най-съвременно ниво в неинвазивен гласов скрининг

Речта носи повече от думи. Алкохолното опиянение оставя измерими следи в артикулацията, темпото и спектралните микровариации — сигнали, които човешкото ухо регистрира в най-добрия случай ненадеждно.

R&D екипът на XENOM обучи собствен модел за дълбоко обучение за откриване на тези акустични биомаркери и го оцени върху Alcohol Language Corpus, стандартния публичен бенчмарк за тази задача.

Оценен строго едно към едно — непретеглена средна чувствителност по прозорци, едно решение на изказване без гласуване, точно както се измерва предишната работа — референтната конфигурация достига 86.3% UAR. Конфигурацията без референция, която не изисква записан изходен профил и решава от една изговорена проба, достига 81.9%. При работната точка на внедряване, където системата комбинира няколко прозореца от запис в консенсусно решение, тези стойности нарастват съответно до 87.6% и 82.5%.

За контекст: официалният базов резултат от Interspeech 2011 Speaker-State Challenge върху този корпус е 65.9% UAR, предишните публикувани най-добри резултати достигат около 73–75%, а нетренираните човешки слушатели постигат около 60–65%.

Системата работи като пасивен слой върху рутинния радиотрафик. Работниците говорят както винаги; без допълнителна процедура, без прекъсване на задачата, без отделен контролен пункт.

Какво е системата — и какво не е. Тя не измерва концентрацията на алкохол в кръвта и не може да служи като основание за отстраняване на работник от дежурство. Това е инструмент за първичен скрининг, който показва кой заслужава внимание, за проверка чрез установени средства. Релевантното сравнение не е с дрегер, а с алтернативата, използвана днес: наблюдение от супервайзор, което се представя приблизително на нивото на нетренирано слушане.

Публикувахме пълни резултати в различни акустични условия — включително тези, при които точността се влошава — заедно с уговорките за сравнимост и известните ограничения на метода.