XENOM R&D инвазивті емес дауыстық скринингте озық деңгейге қол жеткізді

Сөйлеу тек сөздерді ғана емес, одан да көп нәрсені жеткізеді. Алкогольдік масаңдық артикуляцияда, қарқында және спектрлік микро-вариацияда өлшенетін іздер қалдырады — адам құлағы бұл сигналдарды сенімсіз тіркейді.

XENOM компаниясының R&D тобы осы акустикалық биомаркерлерді анықтау үшін меншікті терең оқыту моделін үйретіп, оны осы тапсырма үшін стандартты ашық эталон болып табылатын Alcohol Language Corpus корпусында бағалады.

Қатаң түрде бірдей салыстыру бойынша — терезе бойынша өлшенбеген орташа толықтық, дауыс үзіндісіне бір шешім, дауыс берусіз, бұрынғы жұмыстар дәл осылай өлшенген — тірек негізіндегі конфигурация 86.3% UAR көрсеткішіне жетеді. Тіркелген бастапқы үлгіні қажет етпейтін және бір ғана айтылған үлгіден шешім қабылдайтын тірексіз конфигурация 81.9% көрсеткішіне жетеді. Іске қосу жұмыс нүктесінде, жүйе жазбаның бірнеше терезесін келісілген шешімге біріктіргенде, бұл көрсеткіштер сәйкесінше 87.6% және 82.5% дейін көтеріледі.

Анықтама үшін: Interspeech 2011 Speaker-State Challenge ресми бастапқы көрсеткіші осы корпуста 65.9% UAR құрайды, бұрын жарияланған ең үздік нәтижелер шамамен 73–75% деңгейінде, ал оқытылмаған адам тыңдаушылары шамамен 60–65% көрсетеді.

Жүйе кәдімгі радиобайланыс трафигінің үстінен пассив қабат ретінде жұмыс істейді. Жұмысшылар әдеттегідей сөйлейді; қосымша рәсім, тапсырманы үзу, бөлек бақылау нүктесі жоқ.

Жүйе не істейді — және не істемейді. Ол қандағы алкоголь концентрациясын өлшемейді және жұмысшыны қызметтен шеттетуге негіз бола алмайды. Бұл — бекітілген әдістермен тексеру үшін кімге назар аудару керектігін көрсететін бірінші деңгейдегі сүзгілеу құралы. Тиісті салыстыру алкотестермен емес, бүгінде қолданылатын баламамен: оқытылмаған тыңдау деңгейінде шамамен жұмыс істейтін жетекшінің бақылауымен жүргізіледі.

Біз акустикалық жағдайлар бойынша толық нәтижелерді — дәлдік төмендейтін жағдайларды қоса — салыстыруға қатысты ескертулермен және әдістің белгілі шектеулерімен бірге жарияладық.