https://openreview.net/forum?id=XzH3QMBKIJ
Multi-Objective SPIBB: Seldonian Offline Policy Improvement with Safety Constraints in Finite MDPs...
A novel Seldonian algorithm for safe policy improvement in the offline multi-objective RL setting for finite MDPs.