Project Icon

openrl

综合性强化学习平台,支持多任务训练

OpenRL 是一款基于 PyTorch 的开源强化学习研究框架,支持单代理、多代理、离线强化学习、自我对弈及自然语言处理任务。框架提供统一接口、训练加速方法和多种深度学习模型支持,兼容 Gymnasium、MuJoCo、StarCraft II 等多种环境。同时,OpenRL 还支持用户自定义训练模型、奖励模型和环境配置,并提供中英文文档。

reflexion - 具有语言强化学习的代理
AlfWorldGPT-4GithubHotPotQAReflexionVerbal Reinforcement Learning开源项目
介绍Reflexion项目及其在语言强化学习中的应用。该项目提供详细的实验指南,涵盖推理和决策过程的操作步骤与策略。用户可以通过不同智能体类型和反射策略进行实验,了解其对结果的影响。项目代码和日志已发布,并附有丰富的资源和支持信息。
LLM-RLHF-Tuning - RLHF三阶段训练支持指令微调、奖励模型和多种训练方式
DPOGithubLLaMALLaMA2PPORLHF开源项目
本项目实现了RLHF的三阶段训练,包括指令微调、奖励模型训练和PPO算法训练。支持LLaMA和LLaMA2模型,并提供多种分布式加速训练方法。项目附有详细的实现文档,并对比了其他开源框架的功能,是RLHF训练的宝贵资源。
pymarl2 - 多智能体强化学习的高效实现框架
GithubQMIXStarCraft多智能体强化学习开源项目超参数调优通信任务
PyMARL2是一个开源项目,专注于改进协作多智能体强化学习的实现技巧和约束。该项目针对StarCraft多智能体挑战进行了优化,实现了QMIX、VDN、IQL等多种算法。通过采用值函数裁剪、奖励缩放等技巧,PyMARL2显著提升了QMIX在复杂场景中的性能。此外,该框架还支持通信任务和Google Football环境,为多智能体强化学习研究提供了有力工具。
Reinforcement-Learning - 将深度强化学习与神经网络使用Python和PyTorch实现结合的课程
GithubPyTorchPythonQ学习开源项目深度强化学习神经网络
本课程深入分析了神经网络与强化学习的结合,提供了Python和PyTorch实用实现。掌握Q学习、深度Q学习、PPO和演员批评算法,通过在OpenAI Gym的RoboSchool和Atari游戏中实际应用,熟悉深度强化学习的关键技术和应用场景。
FinRL-Trading - 基于机器学习的股票选择与交易策略平台
AI交易FinRLGithub开源项目强化学习投资组合配置股票选择
FinRL-Trading是一个开源的交易策略开发平台,基于FinRL框架构建。该平台整合了监督学习和深度强化学习技术,用于股票选择和投资组合管理。FinRL-Trading提供金融数据处理、技术指标分析、股票筛选、资产配置和回测等功能,并支持部署到在线交易平台进行模拟交易。这个项目为研究人员和开发者提供了一个探索和实现AI驱动交易策略的工具,结合了机器学习、金融科技和算法交易等先进技术,旨在推动智能投资决策的发展。
Deep-reinforcement-learning-with-pytorch - 深度强化学习PyTorch实现与代码示例
DQNDeep Reinforcement LearningGithubGymTD3pytorch开源项目
本项目提供经典和前沿的深度强化学习算法PyTorch实现,包括DQN、DDPG、PPO等。项目持续更新并维护,适用于Anaconda虚拟环境管理。详细的安装步骤和测试方法确保用户能顺利运行代码,文档中还提供了相关论文和代码链接,便于深入学习研究。
godot_rl_agents - Godot引擎智能NPC开发框架
GithubGodot RL Agents开源框架开源项目机器学习深度强化学习游戏AI
Godot RL Agents是一个开源框架,用于在Godot引擎中开发智能NPC。它支持多种强化学习算法,适用于2D和3D游戏,并提供丰富的AI传感器。该框架完全免费开源,可帮助开发者创造复杂行为的游戏角色,实现自动化游戏测试,为游戏开发和AI研究提供新的可能性。
Popular-RL-Algorithms - 流行强化学习算法的PyTorch实现与评估
GithubPyTorch开源代码开源项目强化学习性能对比算法实现
Popular-RL-Algorithms项目实现了SAC、DDPG、TD3、PPO等多种流行强化学习算法的PyTorch版本。项目提供了算法的多种实现以便比较,并包含奖励归一化、多进程训练等实用技巧。通过在OpenAI Gym环境中的性能展示,为强化学习研究和应用提供了参考。
trl - 用于大型语言模型微调和对齐的开源工具库
GithubTRLTransformer大语言模型开源项目强化学习微调
TRL是一个开源的全栈工具库,专用于大型语言模型的微调和对齐。它支持监督式微调、奖励建模和近端策略优化等方法,适用于多种模型架构。该库基于Transformers构建,提供灵活的训练器和自动模型类,并集成Accelerate、PEFT等工具实现高效扩展。TRL还提供命令行界面,方便用户进行模型微调和交互。
rl-baselines3-zoo - Stable Baselines3 强化学习代理的训练框架,包括超参数优化和预训练代理
GithubRL Baselines3 ZooStable Baselines3开源项目强化学习训练框架超参数调整
RL Baselines3 Zoo提供一个灵活的训练框架支持众多增强学习算法和环境。此框架便于进行算法基准测试、调优以及AI模型的训练和评估。已集成200多个预训练智能体,并配备全面的文档和安装指南,适合科研和开发使用。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号