Zhang-Wei Hong, Pulkit Agrawal, Remi Tachet des Combes, Romain Laroche: Harnessing Mixed Offline Reinforcement Learning Datasets via Trajectory Weighting. ICLR 2023