Public Professor Archive
東京大学 · 総合文化研究科・教養学部 · 教授
東京大学 · 総合文化研究科・教養学部 · 教授
研究キーワードreinforcement learning・multi-agent cooperation・intrinsic rewards・exploration strategies・AlphaZero training・Go agents・minimax search・large language models
ここは公開データのプレビューです。個別の適合理由、連絡角度、保存機能はログイン後に利用できます。