XENOM R&D ले गैर-आक्रामक आवाज जाँचमा अत्याधुनिक अवस्था हासिल गर्दछ

बोलीमा शब्दहरू भन्दा बढी हुन्छ। मद्यपानको नशाले उच्चारण, गति र स्पेक्ट्रल सूक्ष्म-भिन्नतामा मापनयोग्य निशानहरू छोड्छ — मानव कानले अविश्वसनीय रूपमा मात्र दर्ता गर्ने संकेतहरू।

XENOM को R&D टोलीले यी ध्वनिक बायोमार्करहरू पत्ता लगाउन एक स्वामित्वको गहिरो शिक्षण मोडेललाई तालिम दिएको छ र यसलाई Alcohol Language Corpus मा मूल्याङ्कन गरेको छ, यस कार्यका लागि मानक सार्वजनिक बेन्चमार्क।

कडा रूपमा जस्ताको-तस्तै स्कोर गरिएको — प्रति-विन्डो अनवेटेड औसत रिकल, प्रति उच्चारण एकल निर्णय बिना मतदान, ठ्याक्कै अघिल्लो काम कसरी मापन गरिन्छ — सन्दर्भ-आधारित कन्फिगरेसन 86.3% UAR मा पुग्छ। सन्दर्भ-रहित कन्फिगरेसन, जसलाई कुनै दर्ता गरिएको बेसलाइन आवश्यक पर्दैन र एकल बोलिएको नमूनाबाट निर्णय गर्दछ, 81.9% मा पुग्छ। परिनियोजन सञ्चालन बिन्दुमा, जहाँ प्रणालीले रेकर्डिङका धेरै विन्डोहरूलाई सहमति निर्णयमा संयोजन गर्दछ, यी क्रमशः 87.6% र 82.5% मा बढ्छन्।

सन्दर्भका लागि: यस कर्पसमा आधिकारिक Interspeech 2011 Speaker-State Challenge बेसलाइन 65.9% UAR मा छ, पहिले प्रकाशित अत्याधुनिक नतिजाहरू लगभग 73-75% मा शिखरमा छन्, र अप्रशिक्षित मानव श्रोताहरूले लगभग 60-65% स्कोर गर्छन्।

प्रणाली नियमित रेडियो ट्राफिकमा एक निष्क्रिय तहको रूपमा चल्छ। कामदारहरू सधैं जस्तै बोल्छन्; कुनै अतिरिक्त प्रक्रिया छैन, कार्यमा कुनै अवरोध छैन, कुनै छुट्टै चेकपोइन्ट छैन।

प्रणाली के हो — र के होइन। यसले रगतमा अल्कोहल सांद्रता मापन गर्दैन र कामदारलाई ड्युटीबाट हटाउने आधारको रूपमा काम गर्न सक्दैन। यो एक पहिलो-पङ्क्तिको जाँच उपकरण हो जसले स्थापित माध्यमहरूद्वारा प्रमाणीकरणका लागि कसलाई ध्यान दिनुपर्छ भनी संकेत गर्दछ। सान्दर्भिक तुलना ब्रेथलाइजरसँग होइन, तर आज प्रयोग हुने विकल्पसँग हो: पर्यवेक्षक अवलोकन, जसले लगभग अप्रशिक्षित सुनाइको स्तरमा प्रदर्शन गर्दछ।

हामीले ध्वनिक अवस्थाहरूमा पूर्ण नतिजाहरू प्रकाशित गरेका छौं — जसमा शुद्धता घट्नेहरू पनि समावेश छन् — तुलनात्मकता चेतावनीहरू र विधिका ज्ञात सीमाहरू सहित।