标题 |
![]() 可数状态无限时域收缩马尔可夫决策过程的有限状态逼近:策略空间方法
相关领域
数学
可数集
状态空间
国家(计算机科学)
马尔可夫决策过程
马尔可夫链
π的近似
有限状态
空格(标点符号)
应用数学
马尔可夫过程
数理经济学
离散数学
计算机科学
算法
统计
操作系统
|
网址 | |
DOI | |
其它 |
期刊:Journal of Mathematical Analysis and Applications 作者:D. J. White 出版日期:1979-12-01 |
求助人 | |
下载 | 求助已完成,仅限求助人下载。 |
温馨提示:该文献已被科研通 学术中心 收录,前往查看
科研通『学术中心』是文献索引库,收集文献的基本信息(如标题、摘要、期刊、作者、被引量等),不提供下载功能。如需下载文献全文,请通过文献求助获取。
|