齋藤優太
齋藤優太
ホーム
論文・出版
連絡先
履歴書
英語
Light
Dark
Automatic
すべての機械学習は A/B テストである
成田 悠輔
,
粟飯原 俊介
,
齋藤優太
,
松谷 恵
,
矢田 紘平
July 2020
学会誌
分類
報告
収録
人工知能, Vol.35, No.4
Off-Policy Evaluation
齋藤優太
関連項目
Off-Policy Evaluation and Learning for the Future under Non-Stationarity
A General Framework for Off-Policy Learning with Partially-Observed Reward
Cross-Domain Off-Policy Evaluation and Learning for Contextual Bandits
POTEC: Off-Policy Contextual Bandits for Large Action Spaces via Policy Decomposition
Effective Off-Policy Evaluation and Learning in Contextual Combinatorial Bandits
引用
×