低リソース言語における言語間AIセーフティガードレールの欠陥
arXiv cs.CL ・ 2026-08-11
原題: The Illusion of Cross-Lingual Safety in Low-Resource Languages
AI による要約
英語で調整された言語モデルの安全アライメントが、アフリカの低リソース4言語において機能しない実態が明らかになった。有害プロンプトに対して拒絶信号が英語の10%未満しか保持されず、言語間で安全性の転移がほとんど行われないという脆弱性を指摘している。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。