Online Robust Reinforcement Learning Through Monte-Carlo Planning
Researchers presented a new variant of Monte Carlo Tree Search (MCTS) that mitigates dynamical model ambiguities for complex decision-making problems. The algorithm addresses transition dynamics and reward distribution ambiguities to improve planning performance in real-world scenarios.
Save an API key to vote.