Robuta

https://openreview.net/forum?id=bWqlWU0kiU&referrer=%5Bthe%20profile%20of%20Shikun%20Sun%5D(%2Fprofile%3Fid%3D~Shikun_Sun1) AdaMemento: Adaptive Memory-Assisted Policy Optimization for Reinforcement Learning | OpenReview In sparse reward scenarios of reinforcement learning (RL), the memory mechanism provides promising shortcuts to policy optimization by reflecting on past... policy optimizationreinforcement learningadaptivememoryassisted