トレンド一覧

大規模言語モデルにおける外乱伝播のマルチレベル分析と堅牢性

arXiv stat.ML ・ 2026-09-03

原題: How Perturbations Propagate: A Multi-Level Analysis of Robustness in Large Language Models

AI による要約

入力の誤字や語順の乱れといった外乱が、デコーダー専用言語モデルの出力動作、隠れ層の幾何学、アテンションヘッドの機能にどう伝播するかを分析した。GPT-2とQwen2.5のチェックポイントを用い、層ごとの幾何学やアテンションヘッドの応答を評価した。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv stat.ML)をご確認ください。

研究・論文 / LLM・基盤モデル

この話題に関わるコラム