SafeVoice — bir necha soniya oddiy nutqdan ehtimoliy alkogol ta'sirini belgilaydigan xususiy nutq intellekti dvigateli. Invaziv bo‘lmagan, nol ixtisoslashgan apparat, faqat aytilgan iboradan boshqa hech narsa talab qilmaydi.
Holati buzilgan xodimlar oldini olish mumkin bo‘lgan sanoat hodisalarining yetakchi va yetarlicha asboblashtirilmagan omili bo‘lib qolmoqda. Alkogol reaksiya tezligini, fazoviy mulohazani va nozik motor nazoratini alomatlar vizual ko‘rinishidan ancha oldin pasaytiradi. An'anaviy nazoratlar — davriy alkotesterlar va vizual nazoratchi tekshiruvlari — uzluksiz emas, invaziv, smena darvozalarida tirbandlik va chetlab o‘tish oson. Natijada operatsion ko‘r nuqta: yuqori xavf holatlari uzluksiz ushlab qolish eng qiyin bo‘lib qoladi.
Ovoz bu bo‘shliqni yo‘q qilish uchun ideal signaldir. Ishchilar smena davomida tabiiy ravishda Push-to-Talk radiolaridan, interkomlardan va ovozli interfeyslardan foydalanadilar. Alkogol akustik biomexanikani izchil o‘zgartiradi — artikulyatsiya tezligi, fonatsiya vaqtini, prosodiyani va spektral ovoz sifatini buzadi — ixtisoslashgan model bir necha soniya audiodan ajratib oladigan biobelgilar.
SafeVoice ikkita bir-birini to‘ldiruvchi arxitekturada joylashtiriladi.
SafeVoice-Ref real vaqt ovozini ishchining ro‘yxatga olingan hushyor boshlang‘ich namunasi bilan taqqoslaydi — smena boshida kirish tekshiruvi uchun ideal.
SafeVoice-Solo nol namunaviy ishlaydi, smena davomida muntazam radio aloqalari paytida yakka nutq portlashlarini baholaydi.
Standart ochiq benchmark bo‘lgan German Alcohol Language Corpusning ajratilgan test bo‘limi, o‘rtacha vaznlanmagan eslab qolish (UAR) bilan baholanadi. Avvalgi ishlar bilan taqqoslashlar har oyna metrikasidan foydalanadi — har aytimda bitta qaror, ovoz berishsiz — chunki avvalgi ishlar ovoz bermaydi.
Audioni alohida tasniflash o‘rniga, SafeVoice-Ref nutqni shaxsning boshlang‘ich profiliga solishtiradi. So‘zlovchilararo akustik dispersiyani yo‘q qilish, O‘rtacha vaznlanmagan eslab qolish (UAR) da darhol ~5 ball yutuq beradi — bizning eng ta'sirli arxitektura bosqichimiz.
Ikkala Ref va Solo ham bir xil past darajadagi akustik tasvirlardan foydalanadi. SafeVoice-Ref tezkor bir martalik ro‘yxatdan o‘tish orqali aniqlikni maksimal darajaga ko‘taradi, SafeVoice-Solo esa nol operatsion ishqalanishni birinchi o‘ringa qo‘yadi, tarixiy ma'lumotlarsiz har qanday so‘zlovchini darhol tekshiradi.
Standart amaliyot kichik korpuslarda oldindan o‘qitilgan magistrallarni muzlatishni taklif qiladi. Bizning empirik tekshiruvlarimiz buning aksini isbotladi: tekshiruv aniqligi nozik sozlash chuqurligi bilan oshdi, qisman qatlam muzlatishga nisbatan to‘liq uchi-uchigacha magistral moslashuvda ~7 ball sakrash.
Akustik biobelgilar turli vaqt o‘lchamlarida mavjud. Pastki magistral qatlamlar nozik artikulyatsiya va vokal trakt dinamikasini saqlaydi, yuqori qatlamlar esa prosodik oqim va ibora ritmini modellashtiradi. Ko‘p darajali birlashma va e'tiborli birlashtirish eng tashxisli kadrlarni dinamik vaznlaydi.
Biz sintetik oq shovqinni keng sanoat audio o‘quv dasturlari foydasiga chetlab o‘tdik — og‘ir mashinalar, avtomobil g‘uvullashi, atrof-muhit olomon shovqini va strukturaviy aks sado. Bu toza boshlang‘ich aniqlikni pasaytirmasdan og‘ir maydon sharoitlarida ishlash farqini yopdi.
Vaqtinchalik cho‘qqilar yoki tomoq qirish noto‘g‘ri signalni qo‘zg‘atishining oldini olish uchun, xulosa quvuri har bir aytimda bir nechta bir-birini qoplaydigan tahlil oynalarini baholaydi. Konsensus ovoz berish 1–2 ball UAR qo‘shadi va aniqlashni real dunyo akustik cho‘qqilariga juda chidamli qiladi.
Konsensus UAR (MV@5), namunaga asoslangan / namunasiz. Aniqlik pasayadigan sharoitlar bilan birga chop etilgan.
SafeVoice qondagi alkogol konsentratsiyasini o'lchamaydi va ishchini vazifadan chetlatish uchun asos bo'lib xizmat qila olmaydi. Bu birinchi darajali skrining vositasi bo'lib, kim e'tiborga loyiqligini ko'rsatadi va tasdiqlangan usullar bilan tekshiriladi. Tegishli taqqoslash alkotester bilan emas, balki bugungi kunda qo'llanilayotgan muqobil bilan: nazoratchi kuzatuvi bilan bo'lib, u taxminan o'qitilmagan tinglash darajasida ishlaydi.
Barcha natijalar bitta korpusdan olingan — nemis alkogol tili korpusi, 162 so'zlovchidan har bir so'zlovchi uchun qon va nafas alkogol asosiy haqiqati bilan yozib olingan. Bu ushbu vazifa uchun mos yozuvlar benchmarkidir, lekin bu yagona korpus va yuqoridagi har bir taqqoslash uning ajratilgan test bo'limida amalga oshirilgan.
Biz aniqlik pasayadigan sharoitlarni asosiy ko'rsatkichlar bilan birga e'lon qilamiz va rad etganlarimizni ham e'lon qilamiz: yordamchi emotsiya va qon-alkogol-regressiya boshlari (salbiy ta'sir), qisman magistral muzlatish (taxminan yetti ball yomonroq), qaror chegarasini sozlash (0,2 ballga arziydigan simptom tuzatish) va referenssiz model uchun so'zlovchi-embedding konditsiyalash — haqiqiy 0,6 ball yutuq, ammo foydalanuvchi uchun ro'yxatdan o'tishni talab qilgani va Solo'ning nol-ishqalanish afzalligini yo'q qilgani uchun rad etilgan.
Smena boshlanishida xizmatga yaroqlilik tekshiruvi: ro'yxatdan o'tgan bazaviy namunaga nisbatan qisqa og'zaki kirish
Muntazam radio trafigi ustidan uzluksiz passiv monitoring, ro'yxatdan o'tishsiz
Tegishli nazoratchiga inson qarori uchun yo'naltirilgan kalibrlangan ogohlantirish
CPUda ishlaydi, har bir tahlil oynasi uchun bir soniyadan kam kechikish bilan
Demografik kontekst mavjud bo'lmaganda muammosiz pasayadi
XENOM platformasi orqali saytning boshqa operatsion signallari bilan birga taqdim etiladi