Koopman Q-learning: Offline Reinforcement Learning via Symmetries of Dynamics

Benchmark Model Rank Results
d4rl-on-d4rlKFCAverage Reward: 81.8
offline-rl-on-d4rlKFCAverage Reward: 81.8