オンライン推論法
arXiv stat.ML ・ 2026-08-13
原題: Online Inference for Quantile Temporal Difference Learning in Distributional Reinforcement Learning
AI による要約
量子時差学習のオンライン推論法を提案した。提案法は、ランダムスケーリングを利用し、QTDのパスに沿った情報を使用して、漸近的にピボタルな統計量を構築する。提案法は、オンラインで計算可能であり、メモリ要件を削減する。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(arXiv stat.ML)をご確認ください。