Gradient Immunity: マルチファインチューニングへの耐性
arXiv cs.AI ・ 2026-08-05
原題: Gradient Immunity: Null-Space Resistance to Malicious Fine-Tuning
AI による要約
研究者は、Gradient Immunityと呼ばれるマルチファインチューニングへの耐性を提供する手法を提案した。この手法は、Null Space Cubic LayerとInverse Adapterを使用して、有害なサンプルからの勾配を抑制する。Gradient Immunityは、AIモデルの安全性と信頼性を高めるために重要なステップである。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。