XENOM R&D নন-ইনভেসিভ ভয়েস স্ক্রিনিংয়ে সর্বাধুনিক মান অর্জন করেছে

কথাবার্তা শুধু শব্দ বহন করে না। অ্যালকোহল নেশা উচ্চারণ, গতি এবং বর্ণালী মাইক্রো-পরিবর্তনে পরিমাপযোগ্য চিহ্ন রেখে যায় — সংকেত যা মানুষের কান সর্বোত্তমভাবে অবিশ্বাস্যভাবে নিবন্ধন করে।

XENOM-এর R&D টিম এই অ্যাকোস্টিক বায়োমার্কার সনাক্ত করার জন্য একটি স্বত্বাধিকারী ডিপ লার্নিং মডেল প্রশিক্ষণ দিয়েছে এবং এই কাজের জন্য আদর্শ পাবলিক বেঞ্চমার্ক Alcohol Language Corpus-এ এটি মূল্যায়ন করেছে।

কঠোরভাবে লাইক-ফর-লাইক স্কোর করা হয়েছে — প্রতি-উইন্ডো আনওয়েটেড অ্যাভারেজ রিকল, প্রতি উচ্চারণে একটি একক সিদ্ধান্ত কোনো ভোটিং ছাড়াই, ঠিক যেভাবে পূর্ববর্তী কাজ পরিমাপ করা হয় — রেফারেন্স-ভিত্তিক কনফিগারেশন 86.3% UAR-এ পৌঁছায়। রেফারেন্স-মুক্ত কনফিগারেশন, যার কোনো এনরোল করা বেসলাইন প্রয়োজন হয় না এবং একটি একক কথ্য নমুনা থেকে সিদ্ধান্ত নেয়, 81.9%-এ পৌঁছায়। স্থাপনার অপারেটিং পয়েন্টে, যেখানে সিস্টেম একটি রেকর্ডিংয়ের কয়েকটি উইন্ডোকে একটি সম্মত সিদ্ধান্তে একত্রিত করে, এগুলি যথাক্রমে 87.6% এবং 82.5%-এ উন্নীত হয়।

প্রসঙ্গের জন্য: এই কর্পাসে অফিসিয়াল Interspeech 2011 Speaker-State Challenge বেসলাইন 65.9% UAR-এ দাঁড়িয়ে আছে, পূর্বে প্রকাশিত সর্বাধুনিক ফলাফল প্রায় 73–75%-এ শীর্ষে রয়েছে এবং অপ্রশিক্ষিত মানব শ্রোতারা প্রায় 60–65% স্কোর করে।

সিস্টেমটি নিয়মিত রেডিও ট্র্যাফিকের উপর একটি প্যাসিভ স্তর হিসাবে চলে। কর্মীরা সবসময়ের মতো কথা বলে; কোনো অতিরিক্ত প্রক্রিয়া নেই, কাজে কোনো বাধা নেই, কোনো পৃথক চেকপয়েন্ট নেই।

সিস্টেমটি কী — এবং কী নয়। এটি রক্তের অ্যালকোহল ঘনত্ব পরিমাপ করে না এবং কোনো কর্মীকে দায়িত্ব থেকে অপসারণের ভিত্তি হিসেবে কাজ করতে পারে না। এটি একটি প্রথম-সারির স্ক্রিনিং টুল যা নির্দেশ করে কাদের মনোযোগ প্রয়োজন, প্রতিষ্ঠিত উপায়ে যাচাইয়ের জন্য। প্রাসঙ্গিক তুলনা ব্রেথালাইজারের সাথে নয়, বরং আজকের ব্যবহৃত বিকল্পের সাথে: সুপারভাইজার পর্যবেক্ষণ, যা প্রায় অপ্রশিক্ষিত শ্রবণের স্তরে কাজ করে।

আমরা অ্যাকোস্টিক পরিস্থিতি জুড়ে সম্পূর্ণ ফলাফল প্রকাশ করেছি — যেখানে নির্ভুলতা হ্রাস পায় সেগুলি সহ — সাথে তুলনাযোগ্যতার সতর্কতা এবং পদ্ধতির পরিচিত সীমাবদ্ধতাগুলি।