Model-Based Offline Reinforcement Learning with Pessimism-Modulated Dynamics Belief
Open paper
Benchmark
Model
Rank
Results
d4rl-on-d4rl
PMDB
#1
Average Reward: 88.2
Rank counts only results with a code link.