Robuta

https://ai.meta.com/research/publications/invariant-causal-prediction-for-block-mdps/ Invariant Causal Prediction for Block MDPs | Facebook AI Research Generalization across environments is critical for the successful application of reinforcement learning algorithms to real-world challenges. In this... causal predictionfacebook aiinvariantblockmdps https://scholars.cityu.edu.hk/en/publications/fast-bellman-updates-for-robust-mdps/ Fast Bellman Updates for Robust MDPs - CityUHK Scholars fastbellmanupdatesrobustmdps https://albertometelli.github.io/publication/0040-2024-No-Regret-Reinforcement-Learning-in-Smooth-MDPs No-Regret Reinforcement Learning in Smooth MDPs - Alberto Maria Metelli, Ph.D. no regretreinforcement learning https://arxiv.org/abs/2002.03072 [2002.03072] Generalized Hidden Parameter MDPs Transferable Model-based RL in a Handful of Trials Abstract page for arXiv paper 2002.03072: Generalized Hidden Parameter MDPs Transferable Model-based RL in a Handful of Trials https://sites.google.com/illinois.edu/mdps-and-rl/lectures MDPs and RL - Lectures These are notes that I use to prepare for class. These are not intended to be official lecture notes. In particular, I don't proof-read them carefully.... mdpsrllectures https://infoscience.epfl.ch/entities/publication/9140c85e-73f2-4cda-9bb3-90d54a0c0205?ln=en Imitation Learning in Discounted Linear MDPs without exploration assumptions We present a new algorithm for imitation learning in infinite horizon linear MDPs dubbed ILARL which greatly improves the bound on the number of trajectories... imitation learningdiscountedlinearmdpswithout https://researchconnect.buffalo.edu/en/publications/policy-optimization-for-robust-average-cost-mdps/ Policy Optimization for Robust Average Cost MDPs - SUNY University at Buffalo policy optimizationaverage costrobust https://kth.diva-portal.org/smash/record.jsf?pid=diva2:1645919 Minimum Cost Flows, MDPs, and ?1-Regression in Nearly Linear Time for Dense Instances https://openresearch-repository.anu.edu.au/items/003c1eec-86ca-43e4-ba8e-e1405c89f6b8 Symbolic Dynamic Programming for Continuous State and Action MDPs dynamic programmingsymboliccontinuousstateaction https://community.checkpoint.com/t5/Firewall-and-Security-Management/mdps-management-separation-and-management-access-rule/m-p/122055/highlight/true Re: mdps management separation and management acce... - Check Point CheckMates Jun 25, 2021 - It is okay for traffic not destined for the gateway. The problem is for traffic destined for the gateway. The mgmt rule basically accepts specific check pointmdpsmanagementseparationacce https://openresearch-repository.anu.edu.au/items/ea11b74c-7457-4f32-a5d0-00c9dbc66444 Symbolic Dynamic Programming for Discrete and Continuous State MDPs dynamic programmingsymbolicdiscretecontinuousstate https://arxiv.org/abs/2509.10504 [2509.10504] Retrosynthesis Planning via Worst-path Policy Optimisation in Tree-structured MDPs Abstract page for arXiv paper 2509.10504: Retrosynthesis Planning via Worst-path Policy Optimisation in Tree-structured MDPs https://scholars.cityu.edu.hk/en/publications/fast-bellman-updates-for-wasserstein-distributionally-robust-mdps/ Fast Bellman Updates for Wasserstein Distributionally Robust MDPs - CityUHK Scholars fastbellmanupdatesrobustmdps https://arxiv.org/abs/1512.08824 [1512.08824] Qualitative Analysis of VASS-Induced MDPs Abstract page for arXiv paper 1512.08824: Qualitative Analysis of VASS-Induced MDPs qualitative analysisvassinducedmdps https://supervisorconnect.it.monash.edu/index.php/projects/research/explainability-and-compact-representation-k-mdps Explainability and Compact representation of K-MDPs | Supervisor Connect Markov Decision Processes (MDPs) are frameworks used to model decision-making in situations where outcomes are partly random and partly under the control of a... explainabilitycompactrepresentationkmdps https://research.ibm.com/publications/zero-shot-linear-combinations-of-grounded-social-interactions-with-linear-social-mdps Zero-shot linear combinations of grounded social interactions with Linear Social MDPs for AAAI 2023... Zero-shot linear combinations of grounded social interactions with Linear Social MDPs for AAAI 2023 by Ravi Tejwani et al.