gym-sokoban
该项目实现了经典视频游戏推箱子,旨在为深度强化学习算法提供训练环境。游戏中的房间生成是随机的,有助于避免神经网络过拟合预定义场景。玩家需要将所有箱子推到目标位置,不可逆的错误增加了游戏的挑战性。项目支持多种渲染模式和尺寸配置,适用于不同研究和训练需求。可通过PIP或从仓库安装,并提供多种游戏变体,如固定目标、多玩家和箱子拉动功能。