XENOM R&D બિન-આક્રમક વૉઇસ સ્ક્રીનિંગમાં અત્યાધુનિક સ્તર હાંસલ કરે છે

વાણી શબ્દો કરતાં વધુ વહન કરે છે. આલ્કોહોલનો નશો ઉચ્ચારણ, ગતિ અને સ્પેક્ટ્રલ સૂક્ષ્મ-ભિન્નતામાં માપી શકાય તેવા નિશાન છોડે છે — સંકેતો જે માનવ કાન શ્રેષ્ઠ રીતે પણ અવિશ્વસનીય રીતે નોંધે છે.

XENOM ની R&D ટીમે આ ધ્વનિ બાયોમાર્કર્સ શોધવા માટે માલિકીનું ડીપ લર્નિંગ મોડેલ તાલીમ આપ્યું છે અને તેનું મૂલ્યાંકન Alcohol Language Corpus પર કર્યું છે, જે આ કાર્ય માટે પ્રમાણભૂત જાહેર બેન્ચમાર્ક છે.

સખત રીતે સરખામણી કરતાં — પ્રતિ-વિન્ડો અનવેઇટેડ સરેરાશ રિકોલ, પ્રતિ ઉચ્ચારણ એક જ નિર્ણય કોઈ મતદાન વિના, બરાબર જેમ અગાઉનું કાર્ય માપવામાં આવે છે — સંદર્ભ-આધારિત રૂપરેખાંકન 86.3% UAR સુધી પહોંચે છે. સંદર્ભ-મુક્ત રૂપરેખાંકન, જેને કોઈ નોંધાયેલ બેઝલાઇનની જરૂર નથી અને એક જ બોલાયેલા નમૂનામાંથી નિર્ણય લે છે, 81.9% સુધી પહોંચે છે. જમાવટ ઓપરેટિંગ પોઇન્ટ પર, જ્યાં સિસ્ટમ રેકોર્ડિંગની ઘણી વિન્ડોઝને સર્વસંમતિ નિર્ણયમાં જોડે છે, આ અનુક્રમે 87.6% અને 82.5% સુધી વધે છે.

સંદર્ભ માટે: આ કોર્પસ પર સત્તાવાર Interspeech 2011 સ્પીકર-સ્ટેટ ચેલેન્જ બેઝલાઇન 65.9% UAR પર છે, અગાઉ પ્રકાશિત અત્યાધુનિક પરિણામો લગભગ 73–75% પર ટોચે છે, અને અપ્રશિક્ષિત માનવ શ્રોતાઓ લગભગ 60–65% સ્કોર કરે છે.

સિસ્ટમ નિયમિત રેડિયો ટ્રાફિક પર નિષ્ક્રિય સ્તર તરીકે ચાલે છે. કામદારો જેમ હંમેશા બોલે છે તેમ બોલે છે; કોઈ વધારાની પ્રક્રિયા નહીં, કાર્યમાં કોઈ વિક્ષેપ નહીં, કોઈ અલગ ચેકપોઇન્ટ નહીં.

સિસ્ટમ શું છે — અને શું નથી. તે લોહીમાં આલ્કોહોલ સાંદ્રતા માપતી નથી અને કામદારને ફરજ પરથી દૂર કરવા માટેના આધાર તરીકે કામ કરી શકતી નથી. તે પ્રથમ-પંક્તિનું સ્ક્રીનિંગ સાધન છે જે સૂચવે છે કે કોને ધ્યાન આપવાની જરૂર છે, સ્થાપિત માધ્યમો દ્વારા ચકાસણી માટે. સંબંધિત સરખામણી બ્રેથલાઇઝર સાથે નથી, પરંતુ આજે ઉપયોગમાં લેવાતા વિકલ્પ સાથે છે: સુપરવાઇઝર નિરીક્ષણ, જે લગભગ અપ્રશિક્ષિત સાંભળવાના સ્તરે પ્રદર્શન કરે છે.

અમે ધ્વનિ પરિસ્થિતિઓમાં સંપૂર્ણ પરિણામો પ્રકાશિત કર્યા છે — જેમાં તે પણ સામેલ છે જ્યાં ચોકસાઈ ઘટે છે — સાથે સરખામણીની ચેતવણીઓ અને પદ્ધતિની જાણીતી મર્યાદાઓ.