Weibo Jiang, Shaohui Li, Zhi Li, Yuxin Ke, Zhizhuo Jiang, Yaowen Li, Yu Liu: Dual-Policy-Guided Offline Reinforcement Learning with Optimal Stopping. AAMAS 2024: 2315-2317