Skip to main content
QUICK REVIEW

[论文解读] Cooperative Epistemic Multi-Agent Planning for Implicit Coordination

Thorsten Engesser, Thomas Bolander|Technical University of Denmark, DTU Orbit (Technical University of Denmark, DTU)|Mar 7, 2017
Logic, Reasoning, and Knowledge被引用 9
一句话总结

本文提出了一种去中心化的认识论规划框架,通过动态认识论逻辑(DEL)实现自主智能体之间的隐性协调,使智能体在无需显式协商的情况下联合规划,通过将通信建模为可规划的认识论动作,并利用视角转换来推理他人的知识。关键贡献在于形式化定义了隐性协调的顺序与条件计划,该框架在规划器中实现,通过嵌套知识推理实现正确协调,并在俄罗斯纸牌问题和传信问题等基准测试中验证了其可扩展性能。

ABSTRACT

Epistemic planning can be used for decision making in multi-agent situations with distributed knowledge and capabilities. Recently, Dynamic Epistemic Logic (DEL) has been shown to provide a very natural and expressive framework for epistemic planning. We extend the DEL-based epistemic planning framework to include perspective shifts, allowing us to define new notions of sequential and conditional planning with implicit coordination. With these, it is possible to solve planning tasks with joint goals in a decentralized manner without the agents having to negotiate about and commit to a joint policy at plan time. First we define the central planning notions and sketch the implementation of a planning system built on those notions. Afterwards we provide some case studies in order to evaluate the planner empirically and to show that the concept is useful for multi-agent systems in practice.

研究动机与目标

  • 解决知识与能力在智能体之间分布的去中心化多智能体规划挑战。
  • 通过使智能体能够基于认识论推理实现隐性协调,消除对显式协商或联合策略承诺的需求。
  • 在认识论状态中通过视角转换,形式化定义并计算顺序与条件的隐性协调计划。
  • 实现并实证评估一个规划器,使其能够在现实的多智能体场景中生成隐性协调的计划。
  • 证明通过视角转换的认识论规划可实现正确协调,且仅带来与经典路径规划相当的线性开销。

提出的方法

  • 将基于DEL的认识论规划框架扩展以支持视角转换,使智能体能够推理他人知识与能力。
  • 将所有通信能力建模为可与物理(本体)动作一同规划的认识论动作。
  • 在认识论状态空间上使用广度优先搜索寻找解,区分常规图(顺序计划)与AND-OR图(条件计划)。
  • 实现一个能推理嵌套知识状态的规划器,使智能体能够基于共享知识与视角转换预判他人的行动。
  • 将该框架应用于基准问题,如俄罗斯纸牌问题以及两种传信场景(MailTell与MailCheck),涵盖不同网络拓扑结构。
  • 采用状态空间搜索,追踪各世界中互斥前提条件,相对于经典路径规划保持线性开销。

实验结果

研究问题

  • RQ1如何在无需显式协调或联合策略承诺的情况下,以去中心化方式构建多智能体计划?
  • RQ2何种形式化框架使智能体能够通过视角转换推理他人知识与行动,实现隐性协调?
  • RQ3如何在动态认识论逻辑框架内定义并计算顺序与条件的隐性协调计划?
  • RQ4与经典规划相比,维护嵌套知识状态中的认识论推理的计算开销如何?
  • RQ5在何种场景下,通过视角转换的认识论规划能实现可扩展且无死锁或活锁的正确协调?

主要发现

  • 规划器成功为俄罗斯纸牌问题生成了隐性协调的计划,智能体通过认识论动作(如公告)实现联合目标。
  • 在MailTell场景中,智能体可公开传递信件并私下告知收件人,规划器找到了直接路径,开销极小,计划长度与最短路径一致。
  • 在MailCheck场景中,由于知识有限,需采用条件计划,规划器计算出完整路径,经过所有智能体,运行时间按预期呈指数增长。
  • 对于50个智能体的MailTell场景,平均求解时间为3.6秒;对于30个智能体的MailCheck场景,平均耗时达38.76秒,反映出条件规划复杂度的提升。
  • 每个状态的认识论世界数量受智能体数量限制,仅带来与经典路径规划相当的线性开销,验证了可扩展性。

更好的研究,从现在开始

从阅读论文到最终审阅,大幅缩短您的研究时间。

无需绑定信用卡

本解读由 AI 生成,并经人工编辑审核。