La parole ne transporte pas que des mots. L'imprégnation alcoolique laisse des traces mesurables dans l'articulation, le débit et les micro-variations spectrales — des signaux que l'oreille humaine perçoit, au mieux, de façon peu fiable.
L'équipe R&D de XENOM a entraîné un modèle d'apprentissage profond propriétaire pour détecter ces biomarqueurs acoustiques, puis l'a évalué sur l'Alcohol Language Corpus, le benchmark public de référence pour cette tâche.
Évaluée à conditions strictement comparables — rappel moyen non pondéré par fenêtre, une seule décision par énoncé et sans vote, exactement comme sont mesurés les travaux antérieurs — la configuration avec référence atteint 86,3 % d'UAR. La configuration sans référence, qui ne nécessite aucun enrôlement préalable et décide à partir d'un unique échantillon de parole, atteint 81,9 %. Au point de fonctionnement retenu en déploiement, où le système combine plusieurs fenêtres d'un même enregistrement en une décision par consensus, ces valeurs montent respectivement à 87,6 % et 82,5 %.
Pour situer ces chiffres : la référence officielle du Speaker-State Challenge d'Interspeech 2011 sur ce corpus s'établit à 65,9 % d'UAR, les meilleurs résultats publiés jusqu'ici plafonnent autour de 73–75 %, et des auditeurs humains non entraînés obtiennent environ 60–65 %.
Le système fonctionne comme une couche passive au-dessus du trafic radio de routine. Les opérateurs parlent comme ils l'ont toujours fait : aucune procédure supplémentaire, aucune interruption de la tâche, aucun point de contrôle dédié.
Ce que le système est — et ce qu'il n'est pas. Il ne mesure pas l'alcoolémie et ne peut fonder un retrait de poste. C'est un outil de dépistage de première ligne, qui indique qui mérite attention en vue d'une vérification par les moyens réglementaires. La comparaison pertinente n'est pas avec l'éthylotest, mais avec l'alternative en usage aujourd'hui : l'observation par l'encadrement, dont les performances se situent à peu près au niveau d'une écoute non entraînée.
Nous avons publié l'ensemble des résultats selon les conditions acoustiques — y compris celles où la précision se dégrade — ainsi que les réserves de comparabilité et les limites connues de la méthode.