トレンド一覧

段階的推論と強化学習によるLLMの社会的対話能力の向上手法

arXiv cs.CL ・ 2026-08-06

原題: Enhancing Social Intelligence in LLMs with Hierarchical Reasoning and Utterance-Level Goal Rewarding

AI による要約

動的な対話での社会的知能を高めるため、高レベル戦略と低レベル言語実行を分離する「TSR」フレームワークを提案した。さらに目的達成度に応じて動的に報酬を与える強化学習アルゴリズム「LHRL-VGR」を開発し、目標達成と戦略遵守の両立を実現した。

この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv cs.CL)をご確認ください。

LLM・基盤モデル / AIエージェント