"Uncensored" LLMs are measurably more optimistic than their base models
r/LocalLLaMA ・ 2026-07-29
AI による要約
拒否反応を除去した「アンセンサード」なLLMは、ベースモデルと比較して回答がより楽観的かつ自信に満ちた傾向になることが検証されました。拒否の解除がモデルの出力態度や判断傾向に予期せぬ影響を与えることを示しており、モデル調整時の振る舞い評価において重要な知見となります。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(r/LocalLLaMA)をご確認ください。