XENOM R&D ਨੇ ਗੈਰ-ਹਮਲਾਵਰ ਆਵਾਜ਼ ਸਕ੍ਰੀਨਿੰਗ ਵਿੱਚ ਅਤਿ-ਆਧੁਨਿਕ ਪ੍ਰਾਪਤੀ ਕੀਤੀ

ਬੋਲੀ ਸਿਰਫ਼ ਸ਼ਬਦਾਂ ਤੋਂ ਵੱਧ ਹੈ। ਸ਼ਰਾਬ ਦਾ ਨਸ਼ਾ ਉਚਾਰਨ, ਗਤੀ ਅਤੇ ਸਪੈਕਟ੍ਰਲ ਸੂਖਮ-ਭਿੰਨਤਾ ਵਿੱਚ ਮਾਪਣਯੋਗ ਨਿਸ਼ਾਨ ਛੱਡਦਾ ਹੈ — ਸਿਗਨਲ ਜਿਨ੍ਹਾਂ ਨੂੰ ਮਨੁੱਖੀ ਕੰਨ ਵਧੀਆ ਤੋਂ ਵਧੀਆ ਭਰੋਸੇਯੋਗਤਾ ਨਾਲ ਦਰਜ ਨਹੀਂ ਕਰਦਾ।

XENOM ਦੀ R&D ਟੀਮ ਨੇ ਇਨ੍ਹਾਂ ਧੁਨੀ ਬਾਇਓਮਾਰਕਰਾਂ ਦਾ ਪਤਾ ਲਗਾਉਣ ਲਈ ਇੱਕ ਮਲਕੀਅਤੀ ਡੂੰਘੀ ਸਿਖਲਾਈ ਮਾਡਲ ਨੂੰ ਸਿਖਲਾਈ ਦਿੱਤੀ ਹੈ ਅਤੇ ਇਸਨੂੰ ਅਲਕੋਹਲ ਲੈਂਗੂਏਜ ਕਾਰਪਸ 'ਤੇ ਮੁਲਾਂਕਣ ਕੀਤਾ ਹੈ, ਜੋ ਇਸ ਕੰਮ ਲਈ ਮਿਆਰੀ ਜਨਤਕ ਬੈਂਚਮਾਰਕ ਹੈ।

ਸਖ਼ਤੀ ਨਾਲ ਇੱਕੋ ਜਿਹਾ ਮਾਪਿਆ ਗਿਆ — ਪ੍ਰਤੀ-ਵਿੰਡੋ ਅਣਵੇਟਿਡ ਔਸਤ ਰੀਕਾਲ, ਪ੍ਰਤੀ ਉਚਾਰਨ ਇੱਕ ਫੈਸਲਾ ਬਿਨਾਂ ਵੋਟਿੰਗ ਦੇ, ਬਿਲਕੁਲ ਜਿਵੇਂ ਪਿਛਲਾ ਕੰਮ ਮਾਪਿਆ ਜਾਂਦਾ ਹੈ — ਸੰਦਰਭ-ਅਧਾਰਿਤ ਕੌਂਫਿਗਰੇਸ਼ਨ 86.3% UAR ਤੱਕ ਪਹੁੰਚਦੀ ਹੈ। ਸੰਦਰਭ-ਰਹਿਤ ਕੌਂਫਿਗਰੇਸ਼ਨ, ਜਿਸਨੂੰ ਕੋਈ ਦਰਜ ਬੇਸਲਾਈਨ ਨਹੀਂ ਚਾਹੀਦੀ ਅਤੇ ਇੱਕ ਬੋਲੇ ਗਏ ਨਮੂਨੇ ਤੋਂ ਫੈਸਲਾ ਕਰਦੀ ਹੈ, 81.9% ਤੱਕ ਪਹੁੰਚਦੀ ਹੈ। ਤਾਇਨਾਤੀ ਆਪਰੇਟਿੰਗ ਪੁਆਇੰਟ 'ਤੇ, ਜਿੱਥੇ ਸਿਸਟਮ ਰਿਕਾਰਡਿੰਗ ਦੀਆਂ ਕਈ ਵਿੰਡੋਆਂ ਨੂੰ ਇੱਕ ਸਹਿਮਤੀ ਫੈਸਲੇ ਵਿੱਚ ਜੋੜਦਾ ਹੈ, ਇਹ ਕ੍ਰਮਵਾਰ 87.6% ਅਤੇ 82.5% ਤੱਕ ਵਧ ਜਾਂਦੇ ਹਨ।

ਸੰਦਰਭ ਲਈ: ਇਸ ਕਾਰਪਸ 'ਤੇ ਅਧਿਕਾਰਤ Interspeech 2011 ਸਪੀਕਰ-ਸਟੇਟ ਚੈਲੰਜ ਬੇਸਲਾਈਨ 65.9% UAR 'ਤੇ ਹੈ, ਪਹਿਲਾਂ ਪ੍ਰਕਾਸ਼ਿਤ ਅਤਿ-ਆਧੁਨਿਕ ਨਤੀਜੇ ਲਗਭਗ 73–75% 'ਤੇ ਸਿਖਰ 'ਤੇ ਹਨ, ਅਤੇ ਅਸਿਖਿਅਤ ਮਨੁੱਖੀ ਸਰੋਤੇ ਲਗਭਗ 60–65% ਸਕੋਰ ਕਰਦੇ ਹਨ।

ਸਿਸਟਮ ਰੁਟੀਨ ਰੇਡੀਓ ਟ੍ਰੈਫਿਕ ਉੱਤੇ ਇੱਕ ਪੈਸਿਵ ਪਰਤ ਵਜੋਂ ਚੱਲਦਾ ਹੈ। ਕਰਮਚਾਰੀ ਜਿਵੇਂ ਹਮੇਸ਼ਾ ਬੋਲਦੇ ਹਨ; ਕੋਈ ਵਾਧੂ ਪ੍ਰਕਿਰਿਆ ਨਹੀਂ, ਕੰਮ ਵਿੱਚ ਕੋਈ ਰੁਕਾਵਟ ਨਹੀਂ, ਕੋਈ ਵੱਖਰੀ ਚੈਕਪੁਆਇੰਟ ਨਹੀਂ।

ਸਿਸਟਮ ਕੀ ਹੈ — ਅਤੇ ਕੀ ਨਹੀਂ ਹੈ। ਇਹ ਖੂਨ ਵਿੱਚ ਅਲਕੋਹਲ ਦੀ ਮਾਤਰਾ ਨਹੀਂ ਮਾਪਦਾ ਅਤੇ ਕਿਸੇ ਕਰਮਚਾਰੀ ਨੂੰ ਡਿਊਟੀ ਤੋਂ ਹਟਾਉਣ ਦਾ ਆਧਾਰ ਨਹੀਂ ਬਣ ਸਕਦਾ। ਇਹ ਇੱਕ ਪਹਿਲੀ-ਪੱਧਰੀ ਸਕ੍ਰੀਨਿੰਗ ਟੂਲ ਹੈ ਜੋ ਦਰਸਾਉਂਦਾ ਹੈ ਕਿ ਕੌਣ ਧਿਆਨ ਦਾ ਹੱਕਦਾਰ ਹੈ, ਸਥਾਪਿਤ ਸਾਧਨਾਂ ਦੁਆਰਾ ਪੁਸ਼ਟੀ ਲਈ। ਸੰਬੰਧਿਤ ਤੁਲਨਾ ਬ੍ਰੀਥਲਾਈਜ਼ਰ ਨਾਲ ਨਹੀਂ ਹੈ, ਬਲਕਿ ਅੱਜ ਵਰਤੇ ਜਾਂਦੇ ਵਿਕਲਪ ਨਾਲ ਹੈ: ਸੁਪਰਵਾਈਜ਼ਰ ਨਿਰੀਖਣ, ਜੋ ਲਗਭਗ ਅਸਿਖਿਅਤ ਸੁਣਨ ਦੇ ਪੱਧਰ 'ਤੇ ਪ੍ਰਦਰਸ਼ਨ ਕਰਦਾ ਹੈ।

ਅਸੀਂ ਧੁਨੀ ਸਥਿਤੀਆਂ ਵਿੱਚ ਪੂਰੇ ਨਤੀਜੇ ਪ੍ਰਕਾਸ਼ਿਤ ਕੀਤੇ ਹਨ — ਜਿਨ੍ਹਾਂ ਵਿੱਚ ਉਹ ਵੀ ਸ਼ਾਮਲ ਹਨ ਜਿੱਥੇ ਸ਼ੁੱਧਤਾ ਘਟਦੀ ਹੈ — ਨਾਲ ਹੀ ਤੁਲਨਾਯੋਗਤਾ ਚੇਤਾਵਨੀਆਂ ਅਤੇ ਵਿਧੀ ਦੀਆਂ ਜਾਣੀਆਂ ਸੀਮਾਵਾਂ ਵੀ।