Dynamic Programming for Epistemic Uncertainty in Markov Decision Processes
马尔可夫决策过程中的信念不确定性动态规划
AI总结 本文提出了一种模糊厌恶MDP理论,通过风险度量评估策略,统一了多种具有信念不确定性的MDP模型,并刻画了与动态规划兼容的风险度量。
作者
Machine Learning
马尔可夫决策过程中的信念不确定性动态规划
AI总结 本文提出了一种模糊厌恶MDP理论,通过风险度量评估策略,统一了多种具有信念不确定性的MDP模型,并刻画了与动态规划兼容的风险度量。
图上的扩散鲁棒优化
AI总结 提出一种基于扩散的不确定性模型用于有向图上的鲁棒优化,其中边权扰动沿相邻边传播并满足节点守恒约束,分析了该拓扑感知不确定性对凸网络问题和组合图问题计算复杂度的影响。
Comments 46 pages, 6 figures