楼主: nandehutu2022
314 0

[计算机科学] 用自动方法加快马尔可夫决策过程的规划 构造抽象 [推广有奖]

  • 0关注
  • 5粉丝

会员

学术权威

74%

还不是VIP/贵宾

-

威望
10
论坛币
10 个
通用积分
68.4190
学术水平
0 点
热心指数
0 点
信用等级
0 点
经验
24246 点
帖子
4004
精华
0
在线时间
1 小时
注册时间
2022-2-24
最后登录
2022-4-20

楼主
nandehutu2022 在职认证  发表于 2022-3-11 15:20:00 来自手机 |AI写论文

+2 论坛币
k人 参与回答

经管之家送您一份

应届毕业生专属福利!

求职就业群
赵安豆老师微信:zhaoandou666

经管之家联合CDA

送您一个全额奖学金名额~ !

感谢您参与论坛问题回答

经管之家送您两个论坛币!

+2 论坛币
摘要翻译:
本文研究了随机最短路径问题(SSP)中的规划问题,这是马尔可夫决策问题(MDP)的一个子类。我们关注的是状态空间可以完全枚举的中等规模问题。该问题有许多重要的应用,如不确定环境下的导航和规划。我们提出了一种新的方法来构造一个多层次的层次结构,该层次结构由原始问题的逐步简单的抽象组成。一旦计算出来,层次结构可以通过首先为最抽象的级别找到策略,然后递归地将其细化为原始问题的解决方案来加快规划。这种方法是完全自动化的,在返回接近最优解的同时,在样本问题上比最先进的MDP求解器加快了两个数量级。我们还证明了由于抽象的使用而导致的解的最优性损失的理论界。
---
英文标题:
《Speeding Up Planning in Markov Decision Processes via Automatically
  Constructed Abstractions》
---
作者:
Alejandro Isaza, Csaba Szepesvari, Vadim Bulitko, Russell Greiner
---
最新提交年份:
2012
---
分类信息:

一级分类:Computer Science        计算机科学
二级分类:Artificial Intelligence        人工智能
分类描述:Covers all areas of AI except Vision, Robotics, Machine Learning, Multiagent Systems, and Computation and Language (Natural Language Processing), which have separate subject areas. In particular, includes Expert Systems, Theorem Proving (although this may overlap with Logic in Computer Science), Knowledge Representation, Planning, and Uncertainty in AI. Roughly includes material in ACM Subject Classes I.2.0, I.2.1, I.2.3, I.2.4, I.2.8, and I.2.11.
涵盖了人工智能的所有领域,除了视觉、机器人、机器学习、多智能体系统以及计算和语言(自然语言处理),这些领域有独立的学科领域。特别地,包括专家系统,定理证明(尽管这可能与计算机科学中的逻辑重叠),知识表示,规划,和人工智能中的不确定性。大致包括ACM学科类I.2.0、I.2.1、I.2.3、I.2.4、I.2.8和I.2.11中的材料。
--

---
英文摘要:
  In this paper, we consider planning in stochastic shortest path (SSP) problems, a subclass of Markov Decision Problems (MDP). We focus on medium-size problems whose state space can be fully enumerated. This problem has numerous important applications, such as navigation and planning under uncertainty. We propose a new approach for constructing a multi-level hierarchy of progressively simpler abstractions of the original problem. Once computed, the hierarchy can be used to speed up planning by first finding a policy for the most abstract level and then recursively refining it into a solution to the original problem. This approach is fully automated and delivers a speed-up of two orders of magnitude over a state-of-the-art MDP solver on sample problems while returning near-optimal solutions. We also prove theoretical bounds on the loss of solution optimality resulting from the use of abstractions.
---
PDF链接:
https://arxiv.org/pdf/1206.3233
二维码

扫码加我 拉你入群

请注明:姓名-公司-职位

以便审核进群资格,未注明则拒绝

关键词:决策过程 马尔可夫 Intelligence Constructing Presentation 构造 空间 original Decision 过程

您需要登录后才可以回帖 登录 | 我要注册

本版微信群
jg-xs1
拉您进交流群
GMT+8, 2025-12-9 09:40