ai-sage/GigaChat3.1-Audio-10B-A1.8B · Hugging Face
r/LocalLLaMA ・ 2026-07-26
AI による要約
音声ネイティブな言語モデル「GigaChat Audio 10B」および専用データセット「TimeGround-1M」が公開された。コンフォーマーエンコーダーとMoEデコーダーを組み合わせることで、テキスト性能を維持したまま高度な音声理解やローカライゼーションを実現している。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。