SafeVoice — מנוע בינה דיבור קנייני שמסמן שיכרות סבירה מכמה שניות של דיבור רגיל. לא פולשני, ללא חומרה ייעודית, דורש לא יותר ממשפט מדובר.
כוח אדם לקוי נותר גורם מוביל ובלתי ממוכשר מספיק לתקריות תעשייתיות הניתנות למניעה. אלכוהול פוגע במהירות התגובה, בשיפוט המרחבי ובשליטה המוטורית העדינה זמן רב לפני שהתסמינים נראים לעין. בקרות מסורתיות — בדיקות נשיפה תקופתיות ובדיקות ויזואליות של מפקחים — הן לסירוגין, פולשניות, צווארי בקבוק בשערי המשמרות, וקלות לעקיפה. התוצאה היא נקודה עיוורת תפעולית: מצבי סיכון גבוהים נותרים הקשים ביותר ליירוט רציף.
קול הוא האות האידיאלי לסגירת הפער הזה. עובדים משתמשים באופן טבעי במכשירי קשר Push-to-Talk, אינטרקום וממשקי קול לאורך המשמרת. אלכוהול משנה בעקביות את הביומכניקה האקוסטית — פוגע במהירות ההיגוי, בתזמון הפונציה, בפרוזודיה ובאיכות הקול הספקטרלית — סמנים ביולוגיים שמודל ייעודי מחלץ משניות של שמע.
SafeVoice נפרס בשתי ארכיטקטורות משלימות.
SafeVoice-Ref משווה קול בזמן אמת מול קו הבסיס הפיכח הרשום של העובד — אידיאלי לסינון גישה בתחילת משמרת.
SafeVoice-Solo פועל ללא רישום מוקדם, מעריך פרצי דיבור בודדים במהלך תקשורת רדיו שגרתית לאורך המשמרת.
פיצול בדיקה מוחזק של מאגר השפה הגרמנית לאלכוהול, המדד הציבורי הסטנדרטי, מדורג לפי unweighted average recall (UAR). השוואות עם אמנות קודמת משתמשות במדד לחלון — החלטה יחידה לכל ביטוי, ללא הצבעה — כי אמנות קודמת אינה מצביעה.
במקום לסווג שמע בבידוד, SafeVoice-Ref מודד את הדיבור מול פרופיל הבסיס של הפרט. ביטול השונות האקוסטית בין דוברים מניב שיפור מיידי של כ-5 נקודות ב-Unweighted Average Recall (UAR) — אבן הדרך הארכיטקטונית המשמעותית ביותר שלנו.
גם Ref וגם Solo משתמשים באותם ייצוגים אקוסטיים ברמה נמוכה. SafeVoice-Ref ממקסם דיוק באמצעות רישום חד-פעמי מהיר, בעוד SafeVoice-Solo נותן עדיפות לאפס חיכוך תפעולי, ומסנן כל דובר באופן מיידי ללא נתונים היסטוריים.
הפרקטיקה המקובלת מציעה להקפיא עמודי שדרה שאומנו מראש על מאגרי נתונים קטנים. הסריקות האמפיריות שלנו הוכיחו את ההיפך: דיוק הסינון צמח עם עומק הכוונון העדין, וקפץ בכ-7 נקודות תחת התאמת עמוד שדרה מלאה מקצה לקצה לעומת הקפאת שכבות חלקית.
סמנים ביולוגיים אקוסטיים קיימים ברזולוציות זמניות נפרדות. שכבות עמוד שדרה נמוכות שומרות על דינמיקת היגוי עדינה ומערכת הקול, בעוד שכבות גבוהות מדגמנות זרימה פרוזודית וקצב ניסוח. מיזוג רב-שכבתי ואחריו איגום קשבי ממשקל דינמית את הפריימים האבחנתיים ביותר.
עקפנו רעש לבן סינתטי לטובת תוכניות לימוד שמע תעשייתיות נרחבות — מכונות כבדות, רעם רכבים, פטפוט קהל סביבתי והדהוד מבני. זה סגר את פער הביצועים בתנאי שטח קשים מבלי לפגוע בדיוק הבסיס הנקי.
כדי למנוע משיאים חולפים או כחכוח גרון להפעיל אזעקות שווא, צינור ההסקה מדרג מספר חלונות ניתוח חופפים לכל ביטוי. החלת הצבעת קונצנזוס מוסיפה 1–2 נקודות UAR והופכת את הזיהוי לחסין במיוחד בפני שיאים אקוסטיים בעולם האמיתי.
קונצנזוס UAR (MV@5), מבוסס ייחוס / ללא ייחוס. פורסם כולל התנאים שבהם הדיוק יורד.
SafeVoice אינה מודדת ריכוז אלכוהול בדם ואינה יכולה לשמש עילה להרחקת עובד מתפקידו. זהו כלי סינון ראשוני המצביע על מי שמצדיק תשומת לב, לאימות באמצעים מקובלים. ההשוואה הרלוונטית אינה מול מכשיר נשיפה אלא מול החלופה הקיימת כיום: תצפית מפקח, שמתפקדת בערך ברמה של האזנה לא מאומנת.
כל התוצאות מגיעות ממאגר אחד — German Alcohol Language Corpus, שהוקלט מ-162 דוברים עם ערכי אמת של אלכוהול בדם ובנשימה לכל דובר. זהו מדד הייחוס למשימה זו, אך זהו מאגר יחיד, וכל ההשוואות לעיל נעשו על פיצול הבדיקה המוחזק שלו.
אנו מפרסמים את התנאים שבהם הדיוק יורד לצד הנתונים המובילים, ואנו מפרסמים את מה שדחינו: ראשי עזר לרגש ולרגרסיית אלכוהול בדם (השפעה שלילית), הקפאת עמוד שדרה חלקית (גרוע בכ-7 נקודות), כוונון סף החלטה (תיקון סימפטום בשווי 0.2 נקודות), והתניית הטמעת דובר עבור המודל ללא ייחוס — שיפור אמיתי של 0.6 נקודות, שנזנח משום שהיה דורש הרשמה לכל משתמש והורס את יתרון אפס החיכוך של Solo.
בדיקת כשירות לתפקיד בתחילת משמרת: כניסה קצרה בדיבור מול קו בסיס רשום
ניטור פסיבי רציף על תעבורת קשר שגרתית, ללא הרשמה
התראה מכוילת המופנית למפקח המתאים להחלטה אנושית
פועל על CPU עם פחות משניית חביון לכל חלון ניתוח
מתדרדר באופן הדרגתי כאשר הקשר דמוגרפי אינו זמין
מוצג בפלטפורמת XENOM לצד אותות תפעוליים אחרים של האתר