トレンド一覧

音声・音楽 の AI ニュース

音声・音楽 に関する AI ニュースを新しい順に 22 件。3 時間おきに自動収集し、AI が要約しています。

ワーナー・ミュージックとSunoが提携 契約アーティストの楽曲でAI生成音楽が可能に(画像) - ITmedia

ワーナー・ミュージックがAI生成音楽プラットフォームのSunoと提携し、所属アーティストの楽曲を活用したAI音楽生成を可能にすると発表しました。音楽メジャーレーベルが生成AIを権利面で正式に受容しビジネス展開する大きなターニングポイントとなります。

Google News (音声・音楽AI) ・ 2026-07-29

「あなたの声」でしゃべり出す――音声合成スマホアプリ「コエステーション」東芝が公開(画像)(1/2枚目) - ITmedia

東芝が個人の声を学習して再現する音声合成スマホアプリ「コエステーション」を公開しました。ユーザー独自の音声を利用したサービス提供と、パーソナライズ化された音声合成技術の応用可能性を示しています。

Google News (音声・音楽AI) ・ 2026-07-28

SpeechLLM Meets Federated Learning for End-to-End ASR: English and Italian Case Studies

音声言語モデル(SpeechLLM)と連合学習(FL)を組み合わせ、プライバシーを保護したエンドツーエンド音声認識システムを検証した論文。通信効率の良い最適化手法を設計し、英語とイタリア語の実験において中央集権型の学習と同等の安定性と精度を達成した。

arXiv cs.CL ・ 2026-07-28

Let Me Look at You: Advanced Facial Expression Modeling for Conversational Speech Synthesis

対話型音声合成において、共感度の高い音声を生成するために表情認識を活用するフレームワーク「FacialTalker」が提案された。フレーム単位の表情変化を単一コードブックでトークン化する技術を導入し、視覚的な感情表現に合わせた自然で豊かな音声合成を可能にした。

arXiv cs.CL ・ 2026-07-27

音声合成ランキングで1位を獲得したAI「Qwen-Audio-3.0-TTS」をアリババが公開。日本語対応、音声クローンも可能(生成AIクローズアップ) - au Webポータル

アリババが音声合成ランキングで1位を獲得したAIモデル「Qwen-Audio-3.0-TTS」を公開した。日本語に対応し音声クローン機能も備えており、高度な音声生成技術の標準化と多言語対応の推進に寄与する。

Google News (音声・音楽AI) ・ 2026-07-27

ai-sage/GigaChat3.1-Audio-10B-A1.8B · Hugging Face

音声ネイティブな言語モデル「GigaChat Audio 10B」および専用データセット「TimeGround-1M」が公開された。コンフォーマーエンコーダーとMoEデコーダーを組み合わせることで、テキスト性能を維持したまま高度な音声理解やローカライゼーションを実現している。

r/LocalLLaMA ・ 2026-07-26