කථනය වචනවලට වඩා වැඩි දෙයක් රැගෙන යයි. මධ්යසාර මත්වීම උච්චාරණය, වේගය සහ වර්ණාවලි ක්ෂුද්ර-විචලනය තුළ මැනිය හැකි සලකුණු තබයි — මිනිස් කන උපරිම වශයෙන් විශ්වාස කළ නොහැකි ලෙස ලියාපදිංචි කරන සංඥා.
XENOM හි R&D කණ්ඩායම මෙම ධ්වනි ජෛව සලකුණු හඳුනා ගැනීමට හිමිකාර ගැඹුරු ඉගෙනුම් ආකෘතියක් පුහුණු කර, මෙම කාර්යය සඳහා සම්මත පොදු මිණුම් දණ්ඩ වන Alcohol Language Corpus මත ඇගයීමට ලක් කර ඇත.
හරියටම සමාන-සඳහා-සමාන ලෙස ලකුණු කරන ලද — කවුළුවකට අබරිත සාමාන්ය නැවත කැඳවීම, ඡන්දයකින් තොරව උච්චාරණයකට තනි තීරණයක්, පෙර කාර්යය මනිනු ලැබූ ආකාරයටම — යොමු-පාදක වින්යාසය 86.3% UAR කරා ළඟා වේ. ලියාපදිංචි මූලික රේඛාවක් අවශ්ය නොවන සහ තනි කථන සාම්පලයකින් තීරණය කරන යොමු-රහිත වින්යාසය 81.9% කරා ළඟා වේ. යෙදවීමේ මෙහෙයුම් ලක්ෂ්යයේදී, පද්ධතිය පටිගත කිරීමක කවුළු කිහිපයක් එකඟතා තීරණයකට ඒකාබද්ධ කරන විට, මේවා පිළිවෙලින් 87.6% සහ 82.5% දක්වා ඉහළ යයි.
සන්දර්භය සඳහා: මෙම corpus මත නිල Interspeech 2011 කථික-තත්ත්ව අභියෝගයේ මූලික රේඛාව 65.9% UAR ලෙස පවතී, කලින් ප්රකාශයට පත් කළ අති නවීන ප්රතිඵල දළ වශයෙන් 73–75% දක්වා උපරිම වේ, සහ පුහුණු නොකළ මිනිස් සවන්දෙන්නන් 60–65% පමණ ලකුණු කරයි.
පද්ධතිය සාමාන්ය රේඩියෝ ගමනාගමනය මත උදාසීන ස්ථරයක් ලෙස ක්රියාත්මක වේ. කම්කරුවන් සැමවිටම මෙන් කථා කරයි; අමතර ක්රියා පටිපාටියක් නැත, කාර්යයට බාධාවක් නැත, වෙනම පිරික්සුම් ස්ථානයක් නැත.
පද්ධතිය කුමක්ද — සහ කුමක් නොවේද. එය රුධිර මධ්යසාර සාන්ද්රණය මනින්නේ නැති අතර කම්කරුවෙකු රාජකාරියෙන් ඉවත් කිරීමට පදනමක් ලෙස සේවය කළ නොහැක. එය ස්ථාපිත ක්රම මගින් සත්යාපනය සඳහා අවධානය යොමු කළ යුත්තේ කවුරුන්ද යන්න පෙන්නුම් කරන පළමු පෙළ පරීක්ෂණ මෙවලමකි. අදාළ සැසඳීම හුස්ම පරීක්ෂකයක් සමඟ නොව, අද භාවිතා වන විකල්පය සමඟ ය: අධීක්ෂක නිරීක්ෂණය, එය පුහුණු නොකළ සවන්දීමේ මට්ටමට ආසන්නව ක්රියා කරයි.
අපි ධ්වනි තත්ත්ව හරහා සම්පූර්ණ ප්රතිඵල ප්රකාශයට පත් කර ඇත — නිරවද්යතාව පිරිහෙන ඒවා ඇතුළුව — සැසඳිය හැකි බවේ අවවාද සහ ක්රමයේ දන්නා සීමාවන් සමඟ.