声を音声合成ソフト化して保存するサービス エイベックス子会社が個人向けに提供スタート(画像)(1/2枚目) - ITmedia
エイベックスの子会社が、個人の声を音声合成ソフトウェア化して保存・利用できる個人向けサービスを開始した。自身の「声」をデジタル資産として蓄積・活用する新たな市場開拓として注目される。
Google News (音声・音楽AI) ・ 2026-07-29
音声・音楽 に関する AI ニュースを新しい順に 22 件。3 時間おきに自動収集し、AI が要約しています。
エイベックスの子会社が、個人の声を音声合成ソフトウェア化して保存・利用できる個人向けサービスを開始した。自身の「声」をデジタル資産として蓄積・活用する新たな市場開拓として注目される。
Google News (音声・音楽AI) ・ 2026-07-29
ワーナー・ミュージックがAI生成音楽プラットフォームのSunoと提携し、所属アーティストの楽曲を活用したAI音楽生成を可能にすると発表しました。音楽メジャーレーベルが生成AIを権利面で正式に受容しビジネス展開する大きなターニングポイントとなります。
Google News (音声・音楽AI) ・ 2026-07-29
OpenAIが文脈理解やノイズ耐性を向上させた2種類の文字起こしAIのAPIを公開した。音声認識精度の向上により、実務やプロダクトへの高精度な音声処理の組み込みがさらに容易になるため重要である。
Google News (音声・音楽AI) ・ 2026-07-29
DXC TechnologyとElevenLabsが、エンタープライズ向けAIと音声イノベーションのスケールを目的とした戦略的パートナーシップを発表しました。企業の音声AI活用とグローバル展開を加速させる点で重要です。
Google News (音声・音楽AI) ・ 2026-07-29
OpenAIが新たな文字起こしAI「GPT Transcribe」および「GPT Live Transcribe」をリリースしました。音声認識分野における機能拡充と利便性の向上が図られています。
Google News (音声・音楽AI) ・ 2026-07-29
ElevenLabsがOpenHomeと提携し、日本の開発者による音声AIのハードウェア実装を支援すると発表した。音声合成技術のハードウェア統合や国内開発者のエコシステム拡大が期待される。
Google News (音声・音楽AI) ・ 2026-07-29
東芝が個人の声を学習して再現する音声合成スマホアプリ「コエステーション」を公開しました。ユーザー独自の音声を利用したサービス提供と、パーソナライズ化された音声合成技術の応用可能性を示しています。
Google News (音声・音楽AI) ・ 2026-07-28
音声合成スタートアップのFish Audioが、クリエイター保護と音声合成技術の強化を目的に5000万ドルを調達した。急速にユーザー数を伸ばす同社のサービス基盤拡大につながる。
Google News (音声・音楽AI) ・ 2026-07-28
Fish Audioがシードラウンドで5,000万ドルを調達し、クリエイターや企業向けのAI音声モデル開発を加速させる。すでに8万人以上のユーザーと高い年間経常収益を誇り、急成長を遂げている。
TechCrunch AI ・ 2026-07-28
音声言語モデル(SpeechLLM)と連合学習(FL)を組み合わせ、プライバシーを保護したエンドツーエンド音声認識システムを検証した論文。通信効率の良い最適化手法を設計し、英語とイタリア語の実験において中央集権型の学習と同等の安定性と精度を達成した。
arXiv cs.CL ・ 2026-07-28
DXCテクノロジーとElevenLabsが戦略的提携を結び、企業向けAIと音声イノベーションの大規模展開を進めることを発表した。音声AI技術のビジネス活用がさらに加速する契機となるため重要である。
Google News (音声・音楽AI) ・ 2026-07-28
ブラウザ上で動作し、インストール不要で楽曲を最大4つのトラックに分離できるAI音源分離ツール「Lunaron」が個人開発によって公開された。手軽に高品質な音声処理を行えるツールとして注目される。
Zenn AI ・ 2026-07-27
DeepgramがAWS IAMの一時的委任を活用したAmazon SageMaker AIのサポート機能を強化し、トラブルシューティング時間を大幅に短縮した。クラウド環境での音声AIモデル運用の効率化に寄与する。
AWS Machine Learning Blog ・ 2026-07-27
対話型音声合成において、共感度の高い音声を生成するために表情認識を活用するフレームワーク「FacialTalker」が提案された。フレーム単位の表情変化を単一コードブックでトークン化する技術を導入し、視覚的な感情表現に合わせた自然で豊かな音声合成を可能にした。
arXiv cs.CL ・ 2026-07-27
シドニー大学のインターン生が、Sakana AIの音声対話モデル「KAME」をオープンモデルで動作させ、MT-Benchを用いてベンチマーク評価を行った。低遅延な音声対話モデルの実用性やバックエンドLLMの振る舞い検証として意義がある。
Zenn LLM ・ 2026-07-27
OpenAIのRealtime APIにおいて、WebSocket中継とWebRTC直結の2つの接続方式を実装・比較検証した実践的な記事が公開された。音声の経路や遅延、セキュリティ設計などのトレードオフを実測データで明らかにしており、音声AIアプリのアーキテクチャ選定に有用である。
Zenn AI ・ 2026-07-27
アリババが音声合成ランキングで1位を獲得したAIモデル「Qwen-Audio-3.0-TTS」を公開した。日本語に対応し音声クローン機能も備えており、高度な音声生成技術の標準化と多言語対応の推進に寄与する。
Google News (音声・音楽AI) ・ 2026-07-27
音声合成技術の進化に伴い、経営者や上司の声を模倣する「AI音声詐欺」の脅威と対策について専門家が解説した。法人の被害を防ぐための具体的な組織的備えの重要性が強調されている。
ITmedia AI+ ・ 2026-07-26
音声ネイティブな言語モデル「GigaChat Audio 10B」および専用データセット「TimeGround-1M」が公開された。コンフォーマーエンコーダーとMoEデコーダーを組み合わせることで、テキスト性能を維持したまま高度な音声理解やローカライゼーションを実現している。
r/LocalLLaMA ・ 2026-07-26
パラメータ数が4Mおよび10M未満の極小かつ完全なローカル音声合成(TTS)モデル「Inflect v2」がリリースされた。外部のボコーダーやAPIを必要とせず、CPUやCUDA上で軽量に動作するためエッジデバイスでの活用において重要である。
r/LocalLLaMA ・ 2026-07-25
OpenAIとAnthropicが相次いで自社AIサービスの音声機能を強化した。AIは「声で操作」する時代に突入しつつある。
ITmedia AI+ ・ 2026-07-24
大規模音声言語モデルの推論能力を向上させるため、テキストモデルから知識を蒸留するフレームワーク「X^3-OPD」が提案された。クロスモーダルなアプローチにより、音声認識だけでなく高度な論理推論の獲得を目指す。
arXiv cs.LG ・ 2026-07-23