LightZero

整合MCTS与深度强化学习的轻量级算法工具包

LightZero MCTS 强化学习开源工具包算法基准测试 Github 开源项目

LightZero是一个开源算法工具包，整合了蒙特卡洛树搜索(MCTS)和深度强化学习(RL)。它支持AlphaZero、MuZero等多种基于MCTS的RL算法，提供详细文档和性能对比。该项目致力于标准化MCTS+RL算法，以促进相关研究和应用。LightZero的轻量级设计和易用性，有助于用户理解算法核心并进行算法间比较。

Github

Huggingface

介绍相关项目

awesome-game-ai - 游戏AI多智能体学习资源与最新研究进展汇总

Game AIGithub多智能体学习开源项目强化学习德州扑克

该项目汇集了游戏AI领域多智能体学习的优秀资源,包括开源项目、论文、会议和竞赛信息。涵盖德州扑克、斗地主、星际争霸等多种完全/不完全信息游戏。重点展示深度强化学习在游戏AI中的应用及最新研究进展,为游戏AI研究者提供全面的参考资料。

DRLib - 简洁高效的深度强化学习算法集成库

DRLibGithubHERPER开源项目机器人操作深度强化学习

DRLib是一个集成主流off-policy强化学习算法的开源库,支持HER和PER技术。基于OpenAI Spinning Up开发,提供TensorFlow和PyTorch两个版本。相比原版更易用和调试,适合机器人相关任务研究。提供详细环境配置教程。

go-zero - 高性能微服务框架集成先进工程实践

Githubgo-zero代码生成工程实践开源项目微服务框架高并发

go-zero是一款集成了众多工程实践的Web和RPC框架。它为高并发服务的稳定性而生，采用弹性设计，已在大规模用户网站稳定运行多年。框架提供简洁API语法和代码生成工具goctl，支持多种编程语言，内置超时控制、并发管理、自适应熔断等特性。go-zero无需复杂配置，即可提升开发效率和系统稳定性，是现代微服务架构的优选方案。

ElegantRL - 云原生高效的大规模并行深度强化学习框架，支持弹性扩展

DRL算法ElegantRLGithub云原生并行计算开源项目深度强化学习

ElegantRL是一个云原生的大规模并行深度强化学习框架，支持多种DRL算法和多代理环境。其核心代码少于1000行，具备轻量、高效和弹性特点。通过微服务架构和容器化，支持大规模计算节点扩展，并自动分配云端资源。相比Ray RLlib和Stable Baselines 3，ElegantRL在单GPU、多GPU和云平台测试中更稳定高效。广泛应用于RLSolver、FinRL等项目，并支持Isaac Gym等模拟器。

sumo-rl - 用于智能交通信号控制的强化学习框架

GithubSUMO-RL交通仿真交通信号控制多智能体开源项目强化学习

SUMO-RL是基于SUMO交通模拟器的强化学习框架，专注于智能交通信号控制。该框架提供简洁接口，支持创建单代理和多代理强化学习环境，允许自定义状态和奖励函数，并兼容主流RL库。SUMO-RL简化了交通信号控制的强化学习研究过程，适用于多种交通网络和场景。目前已应用于多项研究，覆盖从单一交叉口到大规模城市网络的各类交通控制问题。

Practical_RL - 强化学习开源课程：实用技巧与实践

GithubGoogle ColabHSEPractical_RLYSDA开源项目强化学习

Practical_RL是一个专注于强化学习实用性的开源课程，提供HSE和YSDA的课堂教学及线上学习支持，涵盖英语和俄语材料。课程从基础理论到实践应用，包括价值迭代、Q学习、深度学习、探索策略、策略梯度方法、序列模型及部分观察MDP等内容。学生可以通过GitHub改进课程，使用Google Colab或本地环境进行实践。适合希望在实际问题中应用强化学习的学生和研究者。

sheeprl - 基于PyTorch的强化学习框架支持多种算法和环境

GithubLightning FabricPyTorchSheepRL开源项目强化学习算法实现

SheepRL是一个基于PyTorch和Lightning Fabric的强化学习框架。它支持PPO、SAC、Dreamer等多种算法，以及Atari、MuJoCo、Minecraft等多种环境。该框架易用可扩展，实现了算法与环境的解耦，适用于广泛的强化学习任务。在部分基准测试中，SheepRL展现出与其他框架相当甚至更优的性能，为强化学习研究和开发提供了高效工具。

lightwood - 用JSON-AI语法简化DS/ML生命周期的AutoML框架

AutoMLGithubJSON-AILightwood开源项目数据科学机器学习管道

Lightwood是一个用JSON-AI语法简化DS/ML生命周期的AutoML框架。它支持多种数据类型和时间序列模式，使用户无需重复编写样板代码即可专注于独特的模型部分。用户可以修改默认值或替换步骤自定义管道，同时支持自带模型的自定义架构。

rl_games - 强化学习框架支持多环境及算法的高性能实现

GPU加速GithubRL Games多智能体训练开源项目强化学习机器人学习

rl_games是一个高性能强化学习库，实现了PPO、A2C等算法，支持NVIDIA Isaac Gym、Brax等环境的GPU加速训练。该库具备异步actor-critic、多智能体训练、自对弈等功能，可在多GPU上并行。rl_games提供Colab notebook示例便于快速上手，在多个基准测试中表现出色。作为一个功能丰富的强化学习工具，rl_games兼具高性能和易用性。

stable-baselines3-contrib - 实验性强化学习算法和工具

GithubGym WrappersStable-Baselines3rl算法sb3-contrib开源项目文档

提供最新的实验性强化学习算法和工具，保持稳定基线风格和文档，适用于更广泛的实际应用需求。包括增强随机搜索（ARS）和量化回归DQN（QR-DQN）等算法，以及适用于Gym环境的包装器。适合需要超越主存储库限制且仍需高可靠性的用户。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号