トレンド一覧

Fairness Pruning により GLU-MLP 層の demographic bias を特定

arXiv cs.CL ・ 2026-07-30

原題: Fairness Pruning: Locating Demographic Bias in GLU-MLP Layers via Differential Activations

AI による要約

大規模言語モデル(LLM)のデモグラフィックバイアスを管理・軽減するための軽量な構造的介入手法「Fairness Pruning」を提案した研究。対照的なプロンプトを用いてバイアスに関連する特定のニューロンを特定し評価する。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。

LLM・基盤モデル / 規制・倫理