トレンド一覧

RT-SEMamba:段階的知識蒸留によるリアルタイム音声強調向けMambaモデル

arXiv cs.CL ・ 2026-08-12

原題: RT-SEMamba: Real-Time Speech Enhancement Mamba via Progressive Knowledge Distillation

AI による要約

時間周波数Mambaブロックを採用した因果的音声強調モデル「RT-SEMamba」が提案された。段階的知識蒸留(KD)により8層の教師モデルを1層の生徒モデルへ圧縮し、25msの低遅延制約下でPESQスコア3.18を達成しつつ、処理速度を2.75倍に向上させた。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。

音声・音楽 / 研究・論文

この話題に関わるコラム