トレンド一覧

低リソース言語における言語間AIセーフティガードレールの欠陥

arXiv cs.CL ・ 2026-08-11

原題: The Illusion of Cross-Lingual Safety in Low-Resource Languages

AI による要約

英語で調整された言語モデルの安全アライメントが、アフリカの低リソース4言語において機能しない実態が明らかになった。有害プロンプトに対して拒絶信号が英語の10%未満しか保持されず、言語間で安全性の転移がほとんど行われないという脆弱性を指摘している。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。

規制・倫理 / LLM・基盤モデル

この話題に関わるコラム