トレンド一覧

音声・音楽 の AI ニュース

音声・音楽 に関する AI ニュースを新しい順に 179 件。3 時間おきに自動収集し、AI が要約しています。

AIで曲を分解して聴く新たな音楽体験の可能性

AIを活用した音楽ツールにより、曲をイントロやサビなどのパーツに分解して聴くことで、これまで聞き流していた音に再び出会えるようになった。曲の構造を可視化する新しい音楽体験が提案されている。

Zenn AI ・ 2026-09-03

アリババがAI音楽生成市場に参入、米主導の市場に対抗

アリババがAI音楽生成分野に本格参入し、先行する米国勢のシェアに対抗する姿勢を鮮明にした。テキストからの楽曲作成や音響合成の領域でも米中テクノロジー大手の競争が進展している。

Google News (中国AI企業) ・ 2026-09-02

構音障害ASR向けPEFT手法の比較検証を実施

構音障害ASR向けのPEFT手法7種を、単一話者の事例で比較した研究が発表された。Whisper-large-v3とQwen3-ASR-1.7Bを基盤モデルとして用い、LoRAとDoRAに有意差はなく、単純なLoRAが最適と結論付けた。

arXiv cs.CL ・ 2026-09-02

方向指示付きTTSを疑似トリプレットで拡張する手法を発表

声優が台本を読み直す際の演出指示に対応する方向指示付きTTSを、疑似トリプレット構築で拡張する手法を提案した。印象制御可能なTTSモデルとLLMを用いて(参照音声、指示文、修正音声)の疑似データを生成し、話者特性を保持したまま修正を実現する。

arXiv cs.CL ・ 2026-09-02

WhisperXの文脈認識バッチ処理で WER を低減

WhisperX の文脈認識インターリーブバッチ処理を発表した。VAD 由来のセグメント境界を活用し、連続文脈を維持しながらバッチ処理を実現。長時間音声ベンチマークで WER を削減し、固有名詞の転写精度を向上させた。

arXiv cs.CL ・ 2026-08-31

音楽表現学習にJEPAとコントラスト学習を融合したCoJEPA

JEPAとコントラスト学習を組み合わせた音楽表現学習手法 CoJEPA を提案する。JEPAは局所的な予測により表現を豊かにするが安定性に課題があり、コントラスト学習は安定するが局所タスクに弱い。CoJEPAは両者を単一のバックボーンで統合し、EMA教師なしで安定した学習を実現した。

arXiv cs.AI ・ 2026-08-31

音声センチメント分析用データセット SpeechSense、韻律特徴に焦点

音声センチメント分析の新データセット SpeechSense が公開された。従来のテキスト中心の手法では失われる韻律特徴(プロソディ・トーン)に着目し、採用面接や顧客サービスなど実務で必要な微妙な態度(自信・不安など)を分析可能にする。1,000時間超の音声データと、基本感情ではなく対人態度に焦点を当てたラベルを備える。

arXiv cs.CL ・ 2026-08-18