リアルタイムMRI音声処理を高精度化する音韻特徴量PhonoQ
arXiv cs.CL ・ 2026-08-10
原題: Structured Phonological Representations for Audio-Articulatory rtMRI Speech Classification
AI による要約
リアルタイムMRIによる発話時の構音動作と音声を対応付けるタスクにおいて、構造化された音韻特徴を提示するモデル「PhonoQ」の有効性が示された。PhonoQから抽出された表現を用いることで、WavLMやHuBERTなどの既存ベースラインよりも未知の音声や被験者に対する音韻カテゴリの分類精度が向上した。この手法により構音動作と音韻特性の結びつきをより正確にモデル化できる。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。