rl-agents

强化学习算法集：覆盖多种环境及应用

Reinforcement Learning rl-agents Value Iteration Deep Q-Network Monte-Carlo Tree Search Github 开源项目

此页面介绍了多种强化学习算法的实现，如价值迭代、交叉熵方法、蒙特卡洛树搜索和深度Q网络，适用于有限MDP和连续动作空间等环境。用户可参考详细的安装和使用指南，通过命令行运行实验和基准测试，并使用Gym Monitor和Tensorboard等工具进行性能监控，非常适合优化决策和数据分析的研究者与开发者。

访问官网

Github

介绍相关项目

awesome-game-ai - 游戏AI多智能体学习资源与最新研究进展汇总

Game AIGithub多智能体学习开源项目强化学习德州扑克

该项目汇集了游戏AI领域多智能体学习的优秀资源,包括开源项目、论文、会议和竞赛信息。涵盖德州扑克、斗地主、星际争霸等多种完全/不完全信息游戏。重点展示深度强化学习在游戏AI中的应用及最新研究进展,为游戏AI研究者提供全面的参考资料。

microagents - 动态生成和储存基于微服务的自我改进代理

AI自我改进GPT-4 TurboGithubMicroagentsPythonText-Embedding-Ada-002开源项目

Microagents是一个实验框架，通过动态生成基于微服务的自我改进代理来响应用户任务。这些代理经过验证后进行存储，能在多次对话中学习独立推测任务执行方法。此项目采用Python和OpenAI的GPT-4 Turbo构建，支持并行处理和预训练代理，提供命令行和Gradio为基础的两种用户界面，并通过SQLite进行持久化存储，增强了代理的记忆功能。目前已发布第一个版本v0.1.0，欢迎社区贡献。

awesome-model-based-RL - 模型化强化学习论文与资源汇总

DreamerGithubMCTS世界模型开源项目强化学习模型学习

本项目汇集了模型化强化学习(Model-Based RL)领域的精选研究论文，持续更新前沿进展。项目提供了将算法分为'学习模型'和'给定模型'两类的分类方法。收录内容包括经典论文、最新会议论文、教程和代码库，涵盖从基础理论到应用的多个主题。这一资源集合为研究人员提供了全面的参考材料，反映了模型化强化学习领域的发展动态。

awesome-llm-agents - LLM代理资源一览，涵盖框架、应用与平台

Awesome LLM agentsGithubHaystackLangchainLlama IndexVisualGPT开源项目

本列表收录了优秀的LLM代理资源，涵盖开源框架、实用应用、平台及重要论文和讲座。关键工具包括Langchain、Llama Index、Haystack等，旨在为开发者提供高效的NLP解决方案。用户还可以提交和建议更多资源，支持社区开发。

Awesome-AGI-Agents - 全面解读AGI智能体的最新资源与开发平台

AI AgentsAuto-GPTGithubLLMLangChainOpenAI开源项目

精选AGI智能体资源集合，涵盖文章、视频、论文、前沿项目和开发平台。开源项目如Auto-GPT和MetaGPT展示了自主AI智能体的应用潜力。复旦NLP与米哈游的综述论文对大语言模型驱动的Agent提供了深度解读。开发者可借助LangChain、SuperAGI等工具，快速构建和部署智能体。适用于关注AI智能体发展及其在科研、技术和应用领域前沿探索的用户。

LLM-RLHF-Tuning - RLHF三阶段训练支持指令微调、奖励模型和多种训练方式

DPOGithubLLaMALLaMA2PPORLHF开源项目

本项目实现了RLHF的三阶段训练，包括指令微调、奖励模型训练和PPO算法训练。支持LLaMA和LLaMA2模型，并提供多种分布式加速训练方法。项目附有详细的实现文档，并对比了其他开源框架的功能，是RLHF训练的宝贵资源。

agents - 轻量级AI代理开发框架

GithubGlobe Agent FrameworksLLM编程上下文管理代码生成开源框架开源项目

Globe Agent Frameworks提供了一系列精简的LLM提示和编程技术。该项目通过最小化可复制的代码示例，展示了AI代理编程的核心概念，包括内部独白、目标导向编程和结构化输出。此外，它还包含上下文管理和代码生成的示例。开发者可以通过复制和修改这些代码来创建自定义AI代理解决方案。

trainable-agents - 可训练的角色扮演AI，实现动态个性化互动

Character-LLMGithubLLM开源项目数据集角色扮演训练

Character-LLMs是一款专为角色扮演设计的可训练智能体，利用经验重建技术生成丰富的角色体验数据，无需额外提示即可模拟特定角色，如贝多芬或埃及艳后。项目提供九个角色的模型和数据集，支持角色个性化构建与互动。详情请见论文和代码仓库。

deep-neuroevolution - 深度神经网络进化算法的分布式实现

Deep NeuroevolutionGenetic AlgorithmsGithubMujocoOpenAI开源项目强化学习

本项目提供分布式深度神经网络训练的多种实现，包括深度遗传算法(DeepGA)和进化策略(ES)，用于强化学习。基于并改进了OpenAI的代码，支持本地和AWS运行。项目还包括NeuroEvolution的视觉检测工具VINE和GPU优化加速。用户可通过Docker容器快速启动实验，并使用Mujoco进行高级实验。

DRL-robot-navigation - 移动机器人深度强化学习自主导航方案

GazeboGithubROSTD3开源项目机器人导航深度强化学习

项目集成了ROS、Gazebo和PyTorch，构建了一个移动机器人深度强化学习导航框架。系统利用TD3算法训练机器人应对复杂环境，实现障碍物识别和目标导航。该方案为自主移动机器人研究提供了一个开源的实验平台。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号