LLMの推論時計算量を適応的かつ解釈可能に割り当てるフレームワーク
arXiv cs.AI ・ 2026-08-04
原題: Interpretable Adaptive Sampling for LLM Test-Time Scaling
AI による要約
LLMの推論時の計算量を適応的に割り当てるフレームワーク「TACT」を提案した。推論の難易度やモデルの自信度に応じてサンプリング回数を動的に調整し、計算効率を向上させる。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.AI)をご確認ください。