Project Icon

rl-agents

强化学习算法集:覆盖多种环境及应用

此页面介绍了多种强化学习算法的实现,如价值迭代、交叉熵方法、蒙特卡洛树搜索和深度Q网络,适用于有限MDP和连续动作空间等环境。用户可参考详细的安装和使用指南,通过命令行运行实验和基准测试,并使用Gym Monitor和Tensorboard等工具进行性能监控,非常适合优化决策和数据分析的研究者与开发者。

awesome-game-ai - 游戏AI多智能体学习资源与最新研究进展汇总
Game AIGithub多智能体学习开源项目强化学习德州扑克
该项目汇集了游戏AI领域多智能体学习的优秀资源,包括开源项目、论文、会议和竞赛信息。涵盖德州扑克、斗地主、星际争霸等多种完全/不完全信息游戏。重点展示深度强化学习在游戏AI中的应用及最新研究进展,为游戏AI研究者提供全面的参考资料。
microagents - 动态生成和储存基于微服务的自我改进代理
AI自我改进GPT-4 TurboGithubMicroagentsPythonText-Embedding-Ada-002开源项目
Microagents是一个实验框架,通过动态生成基于微服务的自我改进代理来响应用户任务。这些代理经过验证后进行存储,能在多次对话中学习独立推测任务执行方法。此项目采用Python和OpenAI的GPT-4 Turbo构建,支持并行处理和预训练代理,提供命令行和Gradio为基础的两种用户界面,并通过SQLite进行持久化存储,增强了代理的记忆功能。目前已发布第一个版本v0.1.0,欢迎社区贡献。
awesome-model-based-RL - 模型化强化学习论文与资源汇总
DreamerGithubMCTS世界模型开源项目强化学习模型学习
本项目汇集了模型化强化学习(Model-Based RL)领域的精选研究论文,持续更新前沿进展。项目提供了将算法分为'学习模型'和'给定模型'两类的分类方法。收录内容包括经典论文、最新会议论文、教程和代码库,涵盖从基础理论到应用的多个主题。这一资源集合为研究人员提供了全面的参考材料,反映了模型化强化学习领域的发展动态。
awesome-llm-agents - LLM代理资源一览,涵盖框架、应用与平台
Awesome LLM agentsGithubHaystackLangchainLlama IndexVisualGPT开源项目
本列表收录了优秀的LLM代理资源,涵盖开源框架、实用应用、平台及重要论文和讲座。关键工具包括Langchain、Llama Index、Haystack等,旨在为开发者提供高效的NLP解决方案。用户还可以提交和建议更多资源,支持社区开发。
Awesome-AGI-Agents - 全面解读AGI智能体的最新资源与开发平台
AI AgentsAuto-GPTGithubLLMLangChainOpenAI开源项目
精选AGI智能体资源集合,涵盖文章、视频、论文、前沿项目和开发平台。开源项目如Auto-GPT和MetaGPT展示了自主AI智能体的应用潜力。复旦NLP与米哈游的综述论文对大语言模型驱动的Agent提供了深度解读。开发者可借助LangChain、SuperAGI等工具,快速构建和部署智能体。适用于关注AI智能体发展及其在科研、技术和应用领域前沿探索的用户。
LLM-RLHF-Tuning - RLHF三阶段训练支持指令微调、奖励模型和多种训练方式
DPOGithubLLaMALLaMA2PPORLHF开源项目
本项目实现了RLHF的三阶段训练,包括指令微调、奖励模型训练和PPO算法训练。支持LLaMA和LLaMA2模型,并提供多种分布式加速训练方法。项目附有详细的实现文档,并对比了其他开源框架的功能,是RLHF训练的宝贵资源。
agents - 轻量级AI代理开发框架
GithubGlobe Agent FrameworksLLM编程上下文管理代码生成开源框架开源项目
Globe Agent Frameworks提供了一系列精简的LLM提示和编程技术。该项目通过最小化可复制的代码示例,展示了AI代理编程的核心概念,包括内部独白、目标导向编程和结构化输出。此外,它还包含上下文管理和代码生成的示例。开发者可以通过复制和修改这些代码来创建自定义AI代理解决方案。
trainable-agents - 可训练的角色扮演AI,实现动态个性化互动
Character-LLMGithubLLM开源项目数据集角色扮演训练
Character-LLMs是一款专为角色扮演设计的可训练智能体,利用经验重建技术生成丰富的角色体验数据,无需额外提示即可模拟特定角色,如贝多芬或埃及艳后。项目提供九个角色的模型和数据集,支持角色个性化构建与互动。详情请见论文和代码仓库。
deep-neuroevolution - 深度神经网络进化算法的分布式实现
Deep NeuroevolutionGenetic AlgorithmsGithubMujocoOpenAI开源项目强化学习
本项目提供分布式深度神经网络训练的多种实现,包括深度遗传算法(DeepGA)和进化策略(ES),用于强化学习。基于并改进了OpenAI的代码,支持本地和AWS运行。项目还包括NeuroEvolution的视觉检测工具VINE和GPU优化加速。用户可通过Docker容器快速启动实验,并使用Mujoco进行高级实验。
DRL-robot-navigation - 移动机器人深度强化学习自主导航方案
GazeboGithubROSTD3开源项目机器人导航深度强化学习
项目集成了ROS、Gazebo和PyTorch,构建了一个移动机器人深度强化学习导航框架。系统利用TD3算法训练机器人应对复杂环境,实现障碍物识别和目标导航。该方案为自主移动机器人研究提供了一个开源的实验平台。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号