Robuta

https://openreview.net/forum?id=XzH3QMBKIJ Multi-Objective SPIBB: Seldonian Offline Policy Improvement with Safety Constraints in Finite MDPs... A novel Seldonian algorithm for safe policy improvement in the offline multi-objective RL setting for finite MDPs.