大規模言語モデルにおける外乱伝播のマルチレベル分析と堅牢性
arXiv stat.ML ・ 2026-09-03
原題: How Perturbations Propagate: A Multi-Level Analysis of Robustness in Large Language Models
AI による要約
入力の誤字や語順の乱れといった外乱が、デコーダー専用言語モデルの出力動作、隠れ層の幾何学、アテンションヘッドの機能にどう伝播するかを分析した。GPT-2とQwen2.5のチェックポイントを用い、層ごとの幾何学やアテンションヘッドの応答を評価した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv stat.ML)をご確認ください。