XENOM Ar-Ge'si Non-İnvaziv Ses Taramasında Son Teknolojiyi Yakaladı

Konuşma, kelimelerden fazlasını taşır. Alkol intoksikasyonu; artikülasyon, tempo ve spektral mikro değişkenlikte ölçülebilir izler bırakır — insan kulağının en iyi ihtimalle güvenilmez şekilde algıladığı sinyaller.

XENOM Ar-Ge ekibi, bu akustik biyobelirteçleri tespit etmek için özel bir derin öğrenme modeli eğitti ve bunu bu görev için standart kamu kıyaslaması olan Alcohol Language Corpus üzerinde değerlendirdi.

Kesinlikle birebir karşılaştırıldığında — pencere başına ağırlıklandırılmamış ortalama duyarlılık, oylama olmadan her sözce için tek karar, önceki çalışmaların tam olarak ölçüldüğü şekilde — referans tabanlı yapılandırma %86,3 UAR değerine ulaşıyor. Kayıtlı bir referans gerektirmeyen ve tek bir konuşma örneğinden karar veren referanssız yapılandırma ise %81,9 değerine ulaşıyor. Sistemin bir kaydın birden fazla penceresini konsensüs kararına dönüştürdüğü dağıtım çalışma noktasında bu değerler sırasıyla %87,6 ve %82,5'e yükseliyor.

Bağlam için: bu korpus üzerindeki resmi Interspeech 2011 Konuşmacı-Durumu Yarışması taban çizgisi %65,9 UAR seviyesinde, daha önce yayınlanan son teknoloji sonuçlar yaklaşık %73–75 aralığında zirve yapıyor ve eğitimsiz insan dinleyiciler yaklaşık %60–65 aralığında puan alıyor.

Sistem, rutin telsiz trafiğinin üzerinde pasif bir katman olarak çalışır. Çalışanlar her zamanki gibi konuşur; ek prosedür yok, göreve kesinti yok, ayrı kontrol noktası yok.

Sistemin ne olduğu ve ne olmadığı. Kan alkol konsantrasyonunu ölçmez ve bir çalışanı görevden almak için gerekçe oluşturamaz. Yerleşik yöntemlerle doğrulama için kimin dikkat gerektirdiğini gösteren bir ilk aşama tarama aracıdır. İlgili karşılaştırma bir alkolmetre ile değil, bugün kullanılan alternatifle yapılır: eğitimsiz dinleme seviyesinde performans gösteren gözetmen gözlemi.

Doğruluğun düştüğü koşullar dahil olmak üzere akustik koşullar genelinde tam sonuçları, karşılaştırılabilirlik uyarıları ve yöntemin bilinen sınırlamalarıyla birlikte yayınladık.