XENOM R&D نے غیر حملہ آور آواز کی اسکریننگ میں جدید ترین کارکردگی حاصل کی

تقریر صرف الفاظ سے زیادہ رکھتی ہے۔ الکحل کا نشہ تلفظ، رفتار اور طیفی خرد تغیرات میں قابل پیمائش نشانات چھوڑتا ہے — ایسے اشارے جنہیں انسانی کان زیادہ سے زیادہ غیر معتبر طریقے سے درج کرتا ہے۔

XENOM کی R&D ٹیم نے ان صوتی حیاتیاتی نشانات کا پتہ لگانے کے لیے ایک ملکیتی ڈیپ لرننگ ماڈل تربیت دی ہے اور اس کا جائزہ Alcohol Language Corpus پر لیا ہے، جو اس کام کے لیے معیاری عوامی بینچ مارک ہے۔

سختی سے یکساں طریقے سے اسکور کیا گیا — فی ونڈو غیر وزنی اوسط ریکال، ہر utterance کے لیے ایک واحد فیصلہ بغیر ووٹنگ کے، بالکل اسی طرح جیسے پچھلے کام کی پیمائش کی جاتی ہے — حوالہ پر مبنی کنفیگریشن 86.3% UAR تک پہنچتی ہے۔ حوالہ سے پاک کنفیگریشن، جس کے لیے کوئی اندراج شدہ بیس لائن درکار نہیں ہوتی اور ایک واحد بولے گئے نمونے سے فیصلہ کرتی ہے، 81.9% تک پہنچتی ہے۔ تعیناتی کے آپریٹنگ پوائنٹ پر، جہاں نظام ریکارڈنگ کی کئی ونڈوز کو متفقہ فیصلے میں یکجا کرتا ہے، یہ بالترتیب 87.6% اور 82.5% تک بڑھ جاتی ہیں۔

سیاق و سباق کے لیے: اس کارپس پر سرکاری Interspeech 2011 Speaker-State Challenge بیس لائن 65.9% UAR پر کھڑی ہے، پہلے شائع شدہ جدید ترین نتائج تقریباً 73–75% پر عروج پر ہیں، اور غیر تربیت یافتہ انسانی سامعین تقریباً 60–65% اسکور کرتے ہیں۔

نظام معمول کے ریڈیو ٹریفک پر ایک غیر فعال پرت کے طور پر چلتا ہے۔ کارکن ہمیشہ کی طرح بولتے ہیں؛ کوئی اضافی طریقہ کار نہیں، کام میں کوئی رکاوٹ نہیں، کوئی علیحدہ چوکی نہیں۔

نظام کیا ہے — اور کیا نہیں ہے۔ یہ خون میں الکحل کی مقدار کی پیمائش نہیں کرتا اور کسی کارکن کو ڈیوٹی سے ہٹانے کی بنیاد کے طور پر کام نہیں کر سکتا۔ یہ پہلی سطح کا اسکریننگ ٹول ہے جو اس بات کی نشاندہی کرتا ہے کہ کس کو توجہ کی ضرورت ہے، قائم شدہ ذرائع سے تصدیق کے لیے۔ متعلقہ موازنہ بریتھلائزر کے ساتھ نہیں ہے، بلکہ آج استعمال ہونے والے متبادل کے ساتھ ہے: نگران کا مشاہدہ، جو تقریباً غیر تربیت یافتہ سننے کی سطح پر کارکردگی دکھاتا ہے۔

ہم نے صوتی حالات میں مکمل نتائج شائع کیے ہیں — بشمول وہ جہاں درستگی کم ہوتی ہے — طریقہ کار کی موازنہ کی حدود اور معلوم پابندیوں کے ساتھ۔