https://ai.meta.com/research/publications/invariant-causal-prediction-for-block-mdps/
Invariant Causal Prediction for Block MDPs | Facebook AI Research
Generalization across environments is critical for the successful application of reinforcement learning algorithms to real-world challenges. In this...
causal predictionfacebook aiinvariantblockmdps
https://scholars.cityu.edu.hk/en/publications/fast-bellman-updates-for-robust-mdps/
Fast Bellman Updates for Robust MDPs - CityUHK Scholars
fastbellmanupdatesrobustmdps
https://albertometelli.github.io/publication/0040-2024-No-Regret-Reinforcement-Learning-in-Smooth-MDPs
No-Regret Reinforcement Learning in Smooth MDPs - Alberto Maria Metelli, Ph.D.
no regretreinforcement learning
https://arxiv.org/abs/2002.03072
[2002.03072] Generalized Hidden Parameter MDPs Transferable Model-based RL in a Handful of Trials
Abstract page for arXiv paper 2002.03072: Generalized Hidden Parameter MDPs Transferable Model-based RL in a Handful of Trials
https://sites.google.com/illinois.edu/mdps-and-rl/lectures
MDPs and RL - Lectures
These are notes that I use to prepare for class. These are not intended to be official lecture notes. In particular, I don't proof-read them carefully....
mdpsrllectures
https://infoscience.epfl.ch/entities/publication/9140c85e-73f2-4cda-9bb3-90d54a0c0205?ln=en
Imitation Learning in Discounted Linear MDPs without exploration assumptions
We present a new algorithm for imitation learning in infinite horizon linear MDPs dubbed ILARL which greatly improves the bound on the number of trajectories...
imitation learningdiscountedlinearmdpswithout
https://researchconnect.buffalo.edu/en/publications/policy-optimization-for-robust-average-cost-mdps/
Policy Optimization for Robust Average Cost MDPs - SUNY University at Buffalo
policy optimizationaverage costrobust
https://kth.diva-portal.org/smash/record.jsf?pid=diva2:1645919
Minimum Cost Flows, MDPs, and ?1-Regression in Nearly Linear Time for Dense Instances
https://openresearch-repository.anu.edu.au/items/003c1eec-86ca-43e4-ba8e-e1405c89f6b8
Symbolic Dynamic Programming for Continuous State and Action MDPs
dynamic programmingsymboliccontinuousstateaction
https://community.checkpoint.com/t5/Firewall-and-Security-Management/mdps-management-separation-and-management-access-rule/m-p/122055/highlight/true
Re: mdps management separation and management acce... - Check Point CheckMates
Jun 25, 2021 - It is okay for traffic not destined for the gateway. The problem is for traffic destined for the gateway. The mgmt rule basically accepts specific
check pointmdpsmanagementseparationacce
https://openresearch-repository.anu.edu.au/items/ea11b74c-7457-4f32-a5d0-00c9dbc66444
Symbolic Dynamic Programming for Discrete and Continuous State MDPs
dynamic programmingsymbolicdiscretecontinuousstate
https://arxiv.org/abs/2509.10504
[2509.10504] Retrosynthesis Planning via Worst-path Policy Optimisation in Tree-structured MDPs
Abstract page for arXiv paper 2509.10504: Retrosynthesis Planning via Worst-path Policy Optimisation in Tree-structured MDPs
https://scholars.cityu.edu.hk/en/publications/fast-bellman-updates-for-wasserstein-distributionally-robust-mdps/
Fast Bellman Updates for Wasserstein Distributionally Robust MDPs - CityUHK Scholars
fastbellmanupdatesrobustmdps
https://arxiv.org/abs/1512.08824
[1512.08824] Qualitative Analysis of VASS-Induced MDPs
Abstract page for arXiv paper 1512.08824: Qualitative Analysis of VASS-Induced MDPs
qualitative analysisvassinducedmdps
https://supervisorconnect.it.monash.edu/index.php/projects/research/explainability-and-compact-representation-k-mdps
Explainability and Compact representation of K-MDPs | Supervisor Connect
Markov Decision Processes (MDPs) are frameworks used to model decision-making in situations where outcomes are partly random and partly under the control of a...
explainabilitycompactrepresentationkmdps
https://research.ibm.com/publications/zero-shot-linear-combinations-of-grounded-social-interactions-with-linear-social-mdps
Zero-shot linear combinations of grounded social interactions with Linear Social MDPs for AAAI 2023...
Zero-shot linear combinations of grounded social interactions with Linear Social MDPs for AAAI 2023 by Ravi Tejwani et al.