Google、音楽生成AI「Lyria 3.5」をGeminiアプリとAPIで提供開始
Googleが音楽生成AIの新バージョン「Lyria 3.5」をGeminiアプリおよびAPIを通じて提供を開始した。ユーザーは音楽生成機能を直接利用できるようになる。
Google News (音声・音楽AI) ・ 2026-09-05
音声・音楽 に関する AI ニュースを新しい順に 179 件。3 時間おきに自動収集し、AI が要約しています。
Googleが音楽生成AIの新バージョン「Lyria 3.5」をGeminiアプリおよびAPIを通じて提供を開始した。ユーザーは音楽生成機能を直接利用できるようになる。
Google News (音声・音楽AI) ・ 2026-09-05
高知発のスタートアップが、ElevenLabsの日本語音声AI技術を用いて故人や家族の声を再現する認知症・独居高齢者向けAI通話サービス「リリーメモリー」を8月に提供開始する。介護や見守り分野での活用を目的としている。
Google News (音声・音楽AI) ・ 2026-09-05
会議やインタビューの音声をインターネット上のサーバーに送信せず、端末内で処理する個人開発の音声文字起こしアプリ「Privoxa」がリリースされた。プライバシーを重視したローカル処理のアプローチが特徴となっている。
Zenn AI ・ 2026-09-05
最新の音楽生成AIモデル「Lyria 3.5」が発表された。高度な音楽制作機能やクオリティの向上が期待される。
Google News (音声・音楽AI) ・ 2026-09-04
GoogleのGemini 3.5 Live Translateを活用した多言語間での音声通話ツールにおいて、日本語・英語・スペイン語の3言語間でライブ字幕の遅延を測定した。聞き取る音声の翻訳と、目で見せる原文字幕の同期に関する検証を行っている。
Zenn LLM ・ 2026-09-04
MiniMax H3は、参照アート画像から音声付きの2K AI動画を生成できるモデルである。ユーザーが指定した画像を基に高解像度映像と音響を同時に出力する。
Google News (中国AI企業) ・ 2026-09-04
録音から文字起こし、AI要約、翻訳まで一台で行う「AI NotePods 10S」がCAMPFIREにて発売開始。会議や対話の記録・整理を効率化するデバイスとして注目される。
Google News (音声・音楽AI) ・ 2026-09-04
Microsoftが文字起こしAI「MAI-Transcribe-2」をリリースした。Gemini 3.5 Transcribeより5倍、GPT-Transcribeより10倍高速な処理性能を実現している。
Google News (音声・音楽AI) ・ 2026-09-04
sanoTTSが294kパラメータ(337KB)で動作する最小の完全なTTSスタックをリリースした。3ドルのマイクロコントローラーで動作し、1.46Mモデルは従来の3倍・10倍の規模のモデルを上回る性能を示した。
r/LocalLLaMA ・ 2026-09-03
高品質な音声ダビングと全二重対話合成を行う統合フレームワークAlignment-Free Text-Audioboxを発表した。DAC-VAE特徴量を用いた潜在拡散フレームワークを採用し、強制アライメントや明示的な持続時間の予測を不要にしている。
arXiv cs.CL ・ 2026-09-03
音楽生成AIのSunoが規約を変更し、ダウンロード回数に制限を設けた。無料プランは生涯7回、Proプランは月20曲、Premierプランは月60曲までとなる。
Google News (音声・音楽AI) ・ 2026-09-03
AIを活用した音楽ツールにより、曲をイントロやサビなどのパーツに分解して聴くことで、これまで聞き流していた音に再び出会えるようになった。曲の構造を可視化する新しい音楽体験が提案されている。
Zenn AI ・ 2026-09-03
ElevenLabsが、韓国のコンタクトセンター市場への本格参入を発表した。AI音声技術を活用し、人手不足の解消を目指す。
Google News (音声・音楽AI) ・ 2026-09-03
Fish Audioが5000万ドルの資金調達を発表した。音声合成技術の向上とクリエイターの権利保護を強化する計画だ。
Google News (音声・音楽AI) ・ 2026-09-03
SUNOが音楽生成AI向けのプロンプト辞典「prompt-jukebox」をリリースした。3,500件のプロンプトを収録し、日本最大級の規模となる。
Google News (音声・音楽AI) ・ 2026-09-03
ElevenLabsが韓国でデータレジデンシーの整備を検討中だ。法人向け音声AIの拡大を目指す取り組みで、データ処理のローカライズを進める。
Google News (音声・音楽AI) ・ 2026-09-03
アリババがAI音楽生成分野に本格参入し、先行する米国勢のシェアに対抗する姿勢を鮮明にした。テキストからの楽曲作成や音響合成の領域でも米中テクノロジー大手の競争が進展している。
Google News (中国AI企業) ・ 2026-09-02
構音障害ASR向けのPEFT手法7種を、単一話者の事例で比較した研究が発表された。Whisper-large-v3とQwen3-ASR-1.7Bを基盤モデルとして用い、LoRAとDoRAに有意差はなく、単純なLoRAが最適と結論付けた。
arXiv cs.CL ・ 2026-09-02
声優が台本を読み直す際の演出指示に対応する方向指示付きTTSを、疑似トリプレット構築で拡張する手法を提案した。印象制御可能なTTSモデルとLLMを用いて(参照音声、指示文、修正音声)の疑似データを生成し、話者特性を保持したまま修正を実現する。
arXiv cs.CL ・ 2026-09-02
約70万のオーディオクリップに対し、マルチモーダルLLM(Qwen3-Omni)を用いて1500万の多様なキャプションを生成した SonicCaps を公開した。24件のキャプションを構造化プロンプトで生成し、音声検索の精度向上に寄与する。
arXiv cs.CL ・ 2026-09-02
Metaが、リアルタイムで音声をテキスト化するAI「Muse Voice Transcribe」をリリースした。会議やインタビューなどのリアルタイム文字起こしに対応する。
Google News (音声・音楽AI) ・ 2026-09-02
Suno AIを使って、オリジナルのアコースティックデモを高品質なバラードに加工した事例を紹介。AIによる音楽生成ツールの可能性を示す動画。
Google News (音声・音楽AI) ・ 2026-09-02
マイコン上で動作する音声合成システム「sanoTTS」が発表された。全工程を337KBに収め、リソース制約の厳しい環境でも利用可能だ。
Google News (音声・音楽AI) ・ 2026-09-02
Metaが、初のリアルタイム音声認識モデル「Muse Voice Transcribe」を発表した。20人超の話者識別と多言語混在に対応し、会議や議事録作成の効率化を目指す。
Google News (音声・音楽AI) ・ 2026-09-02
音声合成キャラクター7名が集結する3Dライブ「Voicetic Fantasia 2027」が開催される。リアルタイムの音声合成技術を活用した新たなエンターテインメント体験を提供する。
Google News (音声・音楽AI) ・ 2026-09-01
音楽生成AI「Suno」に対し、ソニーとUMGがストリーミングリッピングを理由に訴訟を拡大した。裁判所が提訴を認め、音楽業界のAI利用に関する議論が加速する。
Google News (音声・音楽AI) ・ 2026-09-01
AI音声合成「AITalk(R)」の防災行政無線への累計導入数が1,000件を突破した。全国自治体の60%が採用しており、災害時の情報伝達に活用される。
Google News (音声・音楽AI) ・ 2026-09-01
音楽生成AIのSUNOが大型アップデートを発表し、作曲フェーズが大きく変わった。電子透かしの導入や新モデルの追加、利用ポリシーの変更が行われた。
Google News (音声・音楽AI) ・ 2026-09-01
エーアイーのAI音声合成技術「AITalk」が防災行政無線向けに累計1000件の導入を達成した。防災分野での実用的な導入事例として注目される。
Google News (音声・音楽AI) ・ 2026-09-01
WhisperX の文脈認識インターリーブバッチ処理を発表した。VAD 由来のセグメント境界を活用し、連続文脈を維持しながらバッチ処理を実現。長時間音声ベンチマークで WER を削減し、固有名詞の転写精度を向上させた。
arXiv cs.CL ・ 2026-08-31
13のニューラルオーディオコーデック(NAC)のトークン統計を分析し、Zipf則やHeaps則などの言語的特性を評価した。音響条件や量子化手法が統計に与える影響が大きいことを示す。
arXiv cs.CL ・ 2026-08-31
JEPAとコントラスト学習を組み合わせた音楽表現学習手法 CoJEPA を提案する。JEPAは局所的な予測により表現を豊かにするが安定性に課題があり、コントラスト学習は安定するが局所タスクに弱い。CoJEPAは両者を単一のバックボーンで統合し、EMA教師なしで安定した学習を実現した。
arXiv cs.AI ・ 2026-08-31
Googleは新たな音楽生成AI「Lyria 3」を発表した。料金体系や使い方、競合のSuno・Udioとの違いを詳しく解説する。音楽制作の新たな選択肢として注目を集める。
Google News (音声・音楽AI) ・ 2026-08-29
Metaが開発したAIエージェント「Muse Glimmer」は家庭用GPU1台で動作し、MiniMaxが発表した「MiniMax Music 3」は5分間のボーカル付き楽曲を生成できる。5つの生成AI技術を解説する。
Google News (音声・音楽AI) ・ 2026-08-19
録音・文字起こし・AIアドバイスの3機能を備えたAIイヤホン「AI +u Buds」が一般発売される。会議やメモの自動記録・要約に加え、AIによるアドバイス機能も提供する。
Google News (音声・音楽AI) ・ 2026-08-19
アリババが、テキストや音声の指示だけで楽曲を生成する音楽生成AIのベータ版を公開した。従来の楽曲制作に必要だった専門知識や時間を大幅に削減し、誰でも簡単に楽曲を作成できるようになる。
Google News (音声・音楽AI) ・ 2026-08-19
音声センチメント分析の新データセット SpeechSense が公開された。従来のテキスト中心の手法では失われる韻律特徴(プロソディ・トーン)に着目し、採用面接や顧客サービスなど実務で必要な微妙な態度(自信・不安など)を分析可能にする。1,000時間超の音声データと、基本感情ではなく対人態度に焦点を当てたラベルを備える。
arXiv cs.CL ・ 2026-08-18
AI音楽の制作を、プロンプト設計から生成、リミックスまでの実践的なワークフローで解説する。LumiMusicの機能を例に、アイデアから完成曲までの制作過程を具体的に紹介する。
Zenn AI ・ 2026-08-14
中国のMiniMaxが音楽生成AI「Music3」を無償で公開し、日本語ボーカルによる最大5分の楽曲をローカルで生成できるようになった。音楽制作の敷居を下げる取り組みとして注目される。
Google News (中国のAI) ・ 2026-08-14
Suno Studio 2.0が公開され、ブラウザDAWにMIDIとオートメーションが搭載された。
Google News (音声・音楽AI) ・ 2026-08-14