トレンド一覧

GEAR:長文脈推論における繰り返しコピーの抑制

Zenn LLM ・ 2026-07-31

原題: GEAR:長文脈推論における「繰り返しコピー」を証拠接地で抑制するRL報酬設計

AI による要約

GEARは、長文脈推論における繰り返しコピーを抑制するために、証拠接地でRL報酬設計を使用する。繰り返しコピーは、LLMの性能を低下させる要因の一つである。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(Zenn LLM)をご確認ください。

LLM・基盤モデル