ការស្រាវជ្រាវ និងអភិវឌ្ឍន៍ XENOM សម្រេចបានកម្រិតទំនើបក្នុងការត្រួតពិនិត្យសំឡេងដោយគ្មានការឈ្លានពាន

ការនិយាយផ្ទុកលើសពីពាក្យ។ ការស្រវឹងគ្រឿងស្រវឹងបន្សល់ទុកដានដែលអាចវាស់បានក្នុងការបញ្ចេញសំឡេង ល្បឿន និងការប្រែប្រួលតូចៗនៃវិសាលគម — សញ្ញាដែលត្រចៀកមនុស្សចាប់បានមិនគួរឱ្យទុកចិត្ត។

ក្រុម R&D របស់ XENOM បានបណ្តុះបណ្តាលគំរូរៀនស៊ីជម្រៅដែលមានកម្មសិទ្ធិដើម្បីរកឱ្យឃើញសញ្ញាសម្គាល់សូរស័ព្ទទាំងនេះ ហើយបានវាយតម្លៃវាលើ Alcohol Language Corpus ដែលជាស្តង់ដារសាធារណៈសម្រាប់កិច្ចការនេះ។

ការដាក់ពិន្ទុយ៉ាងតឹងរឹងដូចគ្នា — ការរំលឹកមធ្យមគ្មានទម្ងន់តាមបង្អួច ការសម្រេចចិត្តមួយក្នុងមួយការនិយាយដោយគ្មានការបោះឆ្នោត ដូចដែលការងារមុនៗត្រូវបានវាស់ — ការកំណត់រចនាសម្ព័ន្ធផ្អែកលើឯកសារយោងឈានដល់ 86.3% UAR។ ការកំណត់រចនាសម្ព័ន្ធគ្មានឯកសារយោង ដែលមិនតម្រូវឱ្យមានបន្ទាត់មូលដ្ឋានចុះឈ្មោះ និងសម្រេចចិត្តពីគំរូនិយាយតែមួយ ឈានដល់ 81.9%។ នៅចំណុចប្រតិបត្តិការដាក់ឱ្យប្រើប្រាស់ ដែលប្រព័ន្ធរួមបញ្ចូលបង្អួចជាច្រើននៃការថតសំឡេងទៅជាការសម្រេចចិត្តឯកភាព តួលេខទាំងនេះកើនឡើងដល់ 87.6% និង 82.5% រៀងគ្នា។

សម្រាប់បរិបទ៖ បន្ទាត់មូលដ្ឋានផ្លូវការរបស់ Interspeech 2011 Speaker-State Challenge លើសំណុំទិន្នន័យនេះស្ថិតនៅ 65.9% UAR លទ្ធផលស្ថានភាពសិល្បៈដែលបានបោះពុម្ពពីមុនឈានដល់ប្រហែល 73–75% ហើយអ្នកស្តាប់ជាមនុស្សដែលមិនបានបណ្តុះបណ្តាលដាក់ពិន្ទុប្រហែល 60–65%។

ប្រព័ន្ធនេះដំណើរការជាស្រទាប់អកម្មលើចរាចរណ៍វិទ្យុប្រចាំថ្ងៃ។ កម្មករនិយាយដូចដែលពួកគេតែងតែធ្វើ គ្មាននីតិវិធីបន្ថែម គ្មានការរំខានដល់កិច្ចការ គ្មានចំណុចត្រួតពិនិត្យដាច់ដោយឡែក។

អ្វីដែលប្រព័ន្ធនេះគឺ — និងមិនមែន។ វាមិនវាស់កំហាប់ជាតិអាល់កុលក្នុងឈាម ហើយមិនអាចប្រើជាមូលដ្ឋានសម្រាប់ដកកម្មករចេញពីកាតព្វកិច្ចបានទេ។ វាគឺជាឧបករណ៍ពិនិត្យបឋមដែលបង្ហាញថាអ្នកណាត្រូវការការយកចិត្តទុកដាក់ សម្រាប់ការផ្ទៀងផ្ទាត់តាមមធ្យោបាយដែលបានបង្កើតឡើង។ ការប្រៀបធៀបដែលពាក់ព័ន្ធមិនមែនជាមួយឧបករណ៍វាស់ជាតិអាល់កុលក្នុងខ្យល់ដង្ហើមទេ ប៉ុន្តែជាមួយជម្រើសដែលប្រើសព្វថ្ងៃ៖ ការសង្កេតរបស់អ្នកគ្រប់គ្រង ដែលដំណើរការប្រហែលកម្រិតនៃការស្តាប់ដោយមិនបានបណ្តុះបណ្តាល។

យើងបានបោះពុម្ពលទ្ធផលពេញលេញលើលក្ខខណ្ឌសូរស័ព្ទ — រួមទាំងលក្ខខណ្ឌដែលភាពត្រឹមត្រូវធ្លាក់ចុះ — រួមជាមួយការកត់សម្គាល់អំពីភាពអាចប្រៀបធៀបបាន និងដែនកំណត់ដែលគេស្គាល់នៃវិធីសាស្ត្រនេះ។