オンライン文脈型行列ゲームの政策最適化と統計的推論手法を発表
arXiv stat.ML ・ 2026-08-17
原題: Policy Optimization and Statistical Inference for Online Contextual Matrix Games
AI による要約
動的な文脈と戦略的相互作用が混在する意思決定問題に対応するオンライン文脈型行列ゲームを提案する。ホテルの価格競争など、文脈変化と他者の戦略的応答を同時に考慮した新たな学習アルゴリズム OnGameLearn を実装した。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv stat.ML)をご確認ください。