Project Icon

openrl

综合性强化学习平台,支持多任务训练

OpenRL 是一款基于 PyTorch 的开源强化学习研究框架,支持单代理、多代理、离线强化学习、自我对弈及自然语言处理任务。框架提供统一接口、训练加速方法和多种深度学习模型支持,兼容 Gymnasium、MuJoCo、StarCraft II 等多种环境。同时,OpenRL 还支持用户自定义训练模型、奖励模型和环境配置,并提供中英文文档。

OpenNMT-py - 开源的神经机器翻译与大型语言模型框架
EoleGithubLLM支持Neural Machine TranslationOpenNMT-pyPyTorch开源项目
OpenNMT-py是基于PyTorch的开源神经机器翻译和语言模型框架,适用于研究和生产。支持大语言模型转换、量化以及多GPU并行。提供教程、文档和社区支持,适合翻译、总结等多种NLP任务。最新版本引入了多查询注意力机制和线性去偏等新功能。
rl-baselines-zoo - 一站式强化学习训练与优化集成环境
GithubRL Baselines ZooStable-Baselines3开源项目强化学习训练代理超参数调优
RL Baselines Zoo提供一个多元化的强化学习代理集合,支持用户通过简易界面进行代理训练和算法评测。项目含多个环境和算法,带有经过优化的默认超参数,适用于教育和研究用途。注意:此库已停止维护,建议使用更新的RL-Baselines3 Zoo版本。
AgentTuning - 提升大语言模型的多任务代理能力
AI代理AgentTuningGithubLLM开源项目机器学习自然语言处理
AgentTuning项目通过多种代理任务的交互数据微调大语言模型,增强其通用代理能力。实验表明,经过AgentTuning的模型在新的代理任务中展现出良好的泛化能力,同时保持了强大的语言处理能力。项目开源的AgentInstruct数据集和AgentLM模型为相关研究提供了重要参考。
dreamerv3-torch - DreamerV3算法的PyTorch实现 跨领域强化学习新突破
DreamerV3Github世界模型人工智能开源项目强化学习深度学习
dreamerv3-torch是DreamerV3算法的PyTorch实现。该项目提供了详细的安装和使用说明,支持DMC、Atari、Crafter和Minecraft等多种基准测试环境。DreamerV3作为一种可扩展的强化学习算法,能在多个领域中以固定超参数实现优异性能。该实现参考了多个知名强化学习项目,为研究人员和开发者提供了实用的工具。
3DModelingRL - 深度强化学习在3D建模中的应用与突破
3D建模ECCV 2020GithubPyTorch开源项目强化学习计算机视觉
3DModelingRL项目展示了一种创新的3D建模方法,利用深度强化学习模拟人类建模过程。项目包含Prim-Agent和Mesh-Agent两个核心组件,分别用于生成基于图元的表示和编辑网格。该方法在ECCV 2020会议发表,为3D建模领域开辟新方向。项目提供完整代码、预训练模型和数据集,便于研究者进一步探索和应用。
RWKV_Pytorch - RWKV大语言模型的纯PyTorch推理框架
GithubPyTorchRWKV大语言模型开源开源项目推理框架
RWKV_Pytorch是一个基于纯PyTorch实现的RWKV大语言模型推理框架。该框架支持批量和并行推理,充分发挥RWKV模型性能。其代码结构清晰,便于阅读和二次开发。框架支持ONNX格式模型的导出和推理,提供本地部署选项。未来计划适配香橙派AI Pro开发板,以实现在昇腾生态上推理RWKV模型。当前版本仅兼容RWKV v6模型(x060版本)。
PufferLib - 复杂游戏环境强化学习的简化工具
GithubPufferLibPyTorch开源项目强化学习环境包装
PufferLib是一个包装层工具,旨在简化复杂游戏环境中的强化学习开发。它支持原生PyTorch网络和简短的环境绑定,自动处理大部分复杂操作。该工具提供优化的LSTM支持、性能指标、本地仪表板、异步环境采样和检查点等功能,为强化学习研究提供全面解决方案。
Deep_reinforcement_learning_Course - 掌握Stable Baselines3、RL Baselines3 Zoo、Sample Factory和CleanRL等库的使用的深度强化学习课程
AI训练Deep Reinforcement LearningGithubHugging FaceRL库开源项目训练代理
免费深度强化学习课程,结合理论与实践,掌握Stable Baselines3、RL Baselines3 Zoo、Sample Factory和CleanRL等库的使用。训练智能体在SnowballFight、Huggy the Doggo、MineRL(Minecraft)、VizDoom(Doom)及经典环境(如Space Invaders、PyBullet)中运行。发布和下载社区智能体,并参与挑战与其他团队及AI对抗。
ViZDoom - AI视觉强化学习平台,支持多平台与多语言
APIGithubViZDoom开源项目强化学习深度学习视觉学习
ViZDoom平台基于ZDoom引擎,可通过视觉信息训练AI玩Doom游戏,适用于视觉学习和深度强化学习研究。支持Linux、macOS和Windows平台,提供Python和C++ API以及Gymnasium/OpenAI Gym环境封装。该平台具备自定义场景创建、同步和异步多玩家模式、可调分辨率和渲染参数,还支持3D视觉和音频缓冲区访问。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号