მეტყველება უფრო მეტს ატარებს, ვიდრე სიტყვებს. ალკოჰოლური ინტოქსიკაცია ტოვებს გაზომვად კვალს არტიკულაციაში, ტემპში და სპექტრულ მიკროვარიაციაში — სიგნალები, რომლებსაც ადამიანის ყური საუკეთესო შემთხვევაში არასაიმედოდ აღიქვამს.
XENOM-ის R&D გუნდმა შეიმუშავა საკუთრების ღრმა სწავლების მოდელი ამ აკუსტიკური ბიომარკერების აღმოსაჩენად და შეაფასა ის Alcohol Language Corpus-ზე, ამ ამოცანის სტანდარტულ საჯარო ბენჩმარკზე.
მკაცრად თანაბარი შედარებით — ფანჯარაზე შეუწონავი საშუალო გაწვდომა, ერთი გადაწყვეტილება თითო გამოთქმაზე ხმის მიცემის გარეშე, ზუსტად ისე, როგორც წინა ნამუშევრები იზომება — რეფერენსზე დაფუძნებული კონფიგურაცია აღწევს 86.3% UAR-ს. რეფერენსის გარეშე კონფიგურაცია, რომელიც არ საჭიროებს ჩარიცხულ საბაზისო ნიმუშს და გადაწყვეტილებას იღებს ერთი წარმოთქმული ნიმუშიდან, აღწევს 81.9%-ს. განთავსების ოპერაციულ წერტილში, სადაც სისტემა აერთიანებს ჩანაწერის რამდენიმე ფანჯარას კონსენსუსის გადაწყვეტილებაში, ეს მაჩვენებლები იზრდება შესაბამისად 87.6%-მდე და 82.5%-მდე.
კონტექსტისთვის: ოფიციალური Interspeech 2011 Speaker-State Challenge-ის საბაზისო მაჩვენებელი ამ კორპუსზე არის 65.9% UAR, ადრე გამოქვეყნებული უახლესი შედეგები პიკს აღწევს დაახლოებით 73–75%-ზე, ხოლო დაუვარჯიშებელი ადამიანი მსმენელები აფასებენ დაახლოებით 60–65%-ს.
სისტემა მუშაობს როგორც პასიური ფენა რუტინულ რადიო ტრაფიკზე. მუშები საუბრობენ ისე, როგორც ყოველთვის; დამატებითი პროცედურის გარეშე, ამოცანის შეწყვეტის გარეშე, ცალკე საგუშაგოს გარეშე.
რა არის სისტემა — და რა არ არის. ის არ ზომავს სისხლში ალკოჰოლის კონცენტრაციას და არ შეიძლება გახდეს მუშის მოვალეობიდან ჩამოშორების საფუძველი. ეს არის პირველი ხაზის სკრინინგის ინსტრუმენტი, რომელიც მიუთითებს, ვინ იმსახურებს ყურადღებას, დადგენილი საშუალებებით გადამოწმებისთვის. შესაბამისი შედარება არ არის ალკოტესტერთან, არამედ დღეს გამოყენებულ ალტერნატივასთან: ზედამხედველის დაკვირვებასთან, რომელიც დაახლოებით დაუვარჯიშებელი მოსმენის დონეზე მუშაობს.
ჩვენ გამოვაქვეყნეთ სრული შედეგები აკუსტიკური პირობების მიხედვით — მათ შორის, სადაც სიზუსტე მცირდება — შედარებადობის შენიშვნებთან და მეთოდის ცნობილ შეზღუდვებთან ერთად.