SafeVoice — enjin kecerdasan pertuturan proprietari yang menandakan kemungkinan kecelaruan alkohol dari hanya beberapa saat pertuturan biasa. Tidak invasif, sifar perkakasan khusus, hanya memerlukan frasa dituturkan.
Kakitangan terjejas kekal sebagai pemacu utama dan kurang diinstrumentasi bagi insiden industri yang boleh dicegah. Alkohol merendahkan kelajuan tindak balas, pertimbangan ruang dan kawalan motor halus lama sebelum gejala menjadi ketara secara visual. Kawalan tradisional — alat ujian nafas berkala dan pemeriksaan visual penyelia — adalah sekejap, invasif, kesesakan di pintu syif, dan mudah dielak. Hasilnya adalah titik buta operasi: keadaan berisiko tinggi kekal paling sukar untuk dipintas secara berterusan.
Suara adalah isyarat ideal untuk menghapuskan jurang ini. Pekerja secara semula jadi menggunakan radio Tekan-untuk-Bercakap, akses interkom dan antara muka suara sepanjang syif mereka. Alkohol secara konsisten mengubah biomekanik akustik — menjejaskan kelajuan artikulasi, masa fonasi, prosodi dan kualiti suara spektrum — biomarker yang diekstrak oleh model khusus dari beberapa saat audio.
SafeVoice digunakan dalam dua seni bina pelengkap.
SafeVoice-Ref membandingkan suara masa nyata terhadap garis dasar sedar diri pekerja yang didaftarkan — ideal untuk saringan akses permulaan syif.
SafeVoice-Solo beroperasi sifar pukulan tanpa garis dasar didaftarkan, menilai letusan pertuturan tunggal semasa komunikasi radio rutin sepanjang syif.
Pecahan ujian ditahan Korpus Bahasa Alkohol Jerman, penanda aras awam standard, dinilai mengikut purata ingatan tidak berwajaran (UAR). Perbandingan dengan seni terdahulu menggunakan metrik setiap tetingkap — satu keputusan setiap ujaran, tiada pengundian — kerana seni terdahulu tidak mengundi.
Daripada mengklasifikasikan audio secara berasingan, SafeVoice-Ref membandingkan pertuturan dengan profil garis dasar individu. Menghapuskan varians akustik antara penutur menghasilkan keuntungan serta-merta kira-kira 5 mata dalam Purata Ingatan Tidak Berwajaran (UAR) — pencapaian seni bina paling berkesan kami.
Kedua-dua Ref dan Solo memanfaatkan perwakilan akustik tahap rendah yang sama. SafeVoice-Ref memaksimumkan ketepatan melalui pendaftaran sekali pantas, manakala SafeVoice-Solo mengutamakan geseran operasi sifar, menyaring mana-mana penutur serta-merta tanpa data sejarah.
Amalan standard mencadangkan membekukan tulang belakang pra-latih pada korpus kecil. Sapuan empirikal kami membuktikan sebaliknya: ketepatan saringan meningkat dengan kedalaman penalaan halus, melonjak kira-kira 7 mata di bawah penyesuaian tulang belakang hujung-ke-hujung penuh berbanding pembekuan lapisan separa.
Biomarker akustik wujud merentasi resolusi temporal yang berbeza. Lapisan tulang belakang lebih rendah mengekalkan dinamik artikulasi halus dan saluran vokal, manakala lapisan lebih tinggi memodelkan aliran prosodik dan irama frasa. Gabungan pelbagai peringkat diikuti pengumpulan penuh perhatian secara dinamik memberatkan bingkai paling diagnostik.
Kami memintas bunyi putih sintetik demi kurikulum audio industri meluas — jentera berat, deruman kenderaan, celoteh orang ramai ambien dan gemaan struktur. Ini menutup jurang prestasi dalam keadaan lapangan keras tanpa merendahkan ketepatan garis dasar bersih.
Untuk mengelakkan lonjakan sementara atau pembersihan tekak daripada mencetuskan penggera palsu, saluran paip inferens menilai pelbagai tetingkap analisis bertindih setiap ujaran. Menggunakan pengundian konsensus menambah 1–2 mata UAR dan menjadikan pengesanan sangat berdaya tahan terhadap lonjakan akustik dunia sebenar.
UAR konsensus (MV@5), berasaskan rujukan / tanpa rujukan. Diterbitkan termasuk keadaan di mana ketepatan menurun.
SafeVoice tidak mengukur kepekatan alkohol dalam darah dan tidak boleh dijadikan asas untuk mengeluarkan pekerja daripada tugas. Ia adalah alat saringan barisan pertama yang menunjukkan siapa yang wajar diberi perhatian, untuk disahkan melalui kaedah yang telah ditetapkan. Perbandingan yang relevan bukanlah dengan alat breathalyzer tetapi dengan alternatif yang digunakan hari ini: pemerhatian penyelia, yang berprestasi pada tahap pendengaran tanpa latihan.
Semua keputusan datang daripada satu korpus — German Alcohol Language Corpus, dirakam daripada 162 penutur dengan kebenaran dasar alkohol darah dan nafas bagi setiap penutur. Ia merupakan penanda aras rujukan untuk tugasan ini, tetapi ia adalah satu korpus tunggal, dan setiap perbandingan di atas dibuat pada bahagian ujian yang diasingkan.
Kami menerbitkan keadaan di mana ketepatan merosot bersama angka utama, dan kami menerbitkan apa yang kami tolak: kepala emosi tambahan dan regresi alkohol darah (kesan negatif), pembekuan separa tulang belakang (kira-kira tujuh mata lebih teruk), penalaan ambang keputusan (pembaikan simptom bernilai 0.2 mata), dan penyamanan pembenaman penutur untuk model bebas rujukan — peningkatan tulen 0.6 mata, dibuang kerana ia memerlukan pendaftaran setiap pengguna dan memusnahkan kelebihan geseran sifar Solo.
Pemeriksaan kesesuaian bertugas pada permulaan syif: daftar masuk lisan pendek terhadap garis dasar yang didaftarkan
Pemantauan pasif berterusan melalui trafik radio rutin, tanpa pendaftaran
Bendera yang ditentukur dihalakan kepada penyelia yang sesuai untuk keputusan manusia
Berjalan pada CPU dengan kependaman kurang daripada satu saat setiap tetingkap analisis
Merosot secara anggun apabila konteks demografi tidak tersedia
Dipaparkan melalui platform XENOM bersama isyarat operasi lain tapak