Project Icon

gym-sokoban

推箱子游戏的深度强化学习挑战

该项目实现了经典视频游戏推箱子,旨在为深度强化学习算法提供训练环境。游戏中的房间生成是随机的,有助于避免神经网络过拟合预定义场景。玩家需要将所有箱子推到目标位置,不可逆的错误增加了游戏的挑战性。项目支持多种渲染模式和尺寸配置,适用于不同研究和训练需求。可通过PIP或从仓库安装,并提供多种游戏变体,如固定目标、多玩家和箱子拉动功能。

项目介绍:gym-sokoban

什么是Sokoban

Sokoban,即“仓库管理员”,是一款源自日本的传统益智游戏。在游戏中,玩家需要将房间内的所有箱子推至指定的存储位置或目标点。由于存在可能无可挽回的错误,这些谜题对玩家,尤其是强化学习算法来说,具有很大挑战性,因为这些算法大多缺乏预见未来的能力。

gym-sokoban项目概述

gym-sokoban是根据DeepMind的论文《增强想象力的智能体用于深度强化学习》中的规则来实现Sokoban游戏的开源库。该项目中的房间生成是随机的,因此可以训练深度神经网络,而无需过拟合于预定义的房间集合。

安装方法

使用PIP安装

如果要快速上手,可以使用pip来安装:

pip install gym-sokoban

从仓库安装

如果想要一个本地版本,可以从GitHub克隆库并进行安装:

git clone git@github.com:mpSchrader/gym-sokoban.git
cd gym-sokoban
pip install -e .

游戏环境

房间要素

每个游戏房间由五个主要元素组成:墙壁、地板、箱子、箱子目标点和玩家。这些元素可能存于不同状态,取决于它们是否与目标点重叠。

可执行动作

游戏提供9种动作来与环境交互,包括上下左右的推和移动动作,以及不执行任何操作的“无操作”动作。

动作ID
无操作0
向上推1
向下推2
向左推3
向右推4
向上移动5
向下移动6
向左移动7
向右移动8

奖励机制

完成游戏并将所有箱子推到目标点将获得10分的奖励。此外,将箱子推上或推出目标点分别获得1分和-1分的奖励。每执行一步操作,都会产生-0.1的罚分,鼓励玩家使用更短的解法。

关卡生成

每当加载或重置一个Sokoban环境时,房间都会被随机生成,主要经过三个阶段:拓扑结构生成、元素放置以及反向游戏。

游戏配置

Sokoban有多种配置可选,比如房间大小、箱子数量、渲染模式及规则等。

渲染模式

除了常规渲染外,还可以使用TinyWorld模式,在这个模式下,每个像素对应房间内的一个元素。

尺寸变化

玩家可以选择不同大小的房间配置,提供了从小于7x7到大于13x13等多种选择。

其他变化

除此之外,游戏也实现了或者计划实现一些变化形式,比如固定目标、多人玩家、推拉模式等,这些变化可能增加或降低游戏难度。

引用方式

如果您在研究中使用了该仓库,请引用以下信息:

@misc{SchraderSokoban2018,
  author = {Schrader, Max-Philipp B.},
  title = {gym-sokoban},
  year = {2018},
  publisher = {GitHub},
  journal = {GitHub repository},
  howpublished = {https://github.com/mpSchrader/gym-sokoban}
}

联系和贡献

联系方式

如果对这个或其他项目感兴趣,可以通过GitHub问题或LinkedIn联系项目作者。

贡献方式

用户可以通过fork该库并提交他们所需的功能进行贡献。此外,也可以通过提交新issue来请求支持或新功能。

项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号