#强化学习

Practical_RL - 强化学习实战课程学习资源汇总 - 从理论到实践的开源教程

2024年09月10日

Practical_RL 强化学习 HSE YSDA Google Colab Github 开源项目

2024年09月10日

TensorLayer学习资料汇总 - 深度学习和强化学习的高效开发库

2024年09月10日

TensorLayer TensorFlow 深度学习强化学习开源软件 Github 开源项目

2024年09月10日

ml-agents入门学习资料汇总 - Unity机器学习代理工具包

2024年09月10日

Unity ML-Agents Toolkit AI 强化学习模拟环境游戏开发 Github 开源项目

2024年09月10日

Dopamine学习资料汇总 - 快速原型化强化学习算法的研究框架

2024年09月10日

Dopamine 强化学习 JAX DQN Tensorflow Github 开源项目

2024年09月10日

DeepMind Lab学习资料汇总 - 一个用于AI研究的可定制3D平台

2024年09月10日

DeepMind Lab 人工智能强化学习 Bazel ioquake3 Github 开源项目热门

2024年09月10日

SUMO-RL: 强化学习在交通信号控制中的应用

2024年09月05日

SUMO-RL 强化学习交通信号控制多智能体交通仿真 Github 开源项目

2024年09月05日

强化学习论文综述:从经典方法到前沿研究

2024年09月05日

强化学习论文集模型无关模型相关离线学习 Github 开源项目

2024年09月05日

大型语言模型游戏智能体研究前沿:awesome-LLM-game-agent-papers项目综述

2024年09月05日

LLM 游戏智能体人工智能自然语言处理强化学习 Github 开源项目

2024年09月05日

Q-Transformer: 基于自回归Q函数的可扩展离线强化学习方法

2024年09月05日

Q-Transformer 强化学习 AI模型神经网络机器人控制 Github 开源项目

2024年09月05日

深度强化学习助力人形机器人学习行走

2024年09月05日

人形机器人双足行走强化学习 MuJoCo PyTorch Github 开源项目

2024年09月05日

相关项目

Practical_RL

Practical_RL是一个专注于强化学习实用性的开源课程，提供HSE和YSDA的课堂教学及线上学习支持，涵盖英语和俄语材料。课程从基础理论到实践应用，包括价值迭代、Q学习、深度学习、探索策略、策略梯度方法、序列模型及部分观察MDP等内容。学生可以通过GitHub改进课程，使用Google Colab或本地环境进行实践。适合希望在实际问题中应用强化学习的学生和研究者。

TensorLayer

TensorLayer 是一个基于 TensorFlow 的深度学习和强化学习库，为研究人员和工程师提供多种可定制的神经网络层，简化复杂 AI 模型的构建。它设计独特，结合了高性能与灵活性，支持多种后端和硬件，并提供丰富的教程和应用实例。广泛应用于全球知名大学和企业，如谷歌、微软、阿里巴巴等。

dopamine

Dopamine是一个用于快速原型设计强化学习算法的研究框架，旨在便于用户进行自由实验。其设计原则包括易于实验、灵活开发、紧凑可靠和结果可重复。支持的算法有DQN、C51、Rainbow、IQN和SAC，主要实现于jax。Dopamine提供了Docker容器及源码安装方法，适用于Atari和Mujoco环境，并推荐使用虚拟环境。更多信息请参阅官方文档。

PaLM-rlhf-pytorch

本项目实现了基于PaLM架构的强化学习与人类反馈（RLHF），适用于开放环境下的ChatGPT复现。结合了LoRA微调和Flash Attention技术，提供详细的安装和使用指南。加入社区，探索最新的PPO和RL技术进展。

neurojs

neurojs是一个浏览器内的JavaScript深度学习框架，特别专注于强化学习任务。它提供全栈神经网络支持、强化学习扩展以及网络配置的二进制导入和导出功能。用户可以通过2D自驾车等演示直观了解其功能。尽管该项目已停止维护，但仍可作为学习和实验工具，建议使用更通用的框架如TensorFlow-JS。

deep-neuroevolution

本项目提供分布式深度神经网络训练的多种实现，包括深度遗传算法(DeepGA)和进化策略(ES)，用于强化学习。基于并改进了OpenAI的代码，支持本地和AWS运行。项目还包括NeuroEvolution的视觉检测工具VINE和GPU优化加速。用户可通过Docker容器快速启动实验，并使用Mujoco进行高级实验。

lab

DeepMind Lab是一个基于id Software的Quake III Arena开发的3D学习环境，通过ioquake3和其他开源软件支持。本平台提供了一系列挑战性的3D导航和解谜任务，主要用于深度强化学习等人工智能领域的研究。构建于多个层次的任务和Lua脚本配置，DeepMind Lab支持广泛的研究应用和技术评估。适合学术研究者和技术开发者使用，可以通过专门文档获得更多构建和使用信息。

alpha-zero-general

该项目基于AlphaGo Zero论文，提供了简化和灵活的自学强化学习实现，适用于各种双人回合制对抗游戏和深度学习框架。用户可通过实现Game.py和NeuralNet.py中的类，为所选游戏自定义实现。项目提供了Othello、五子棋和井字棋等游戏示例，支持PyTorch和Keras框架，并包含核心训练循环、蒙特卡洛树搜索和神经网络参数设置的详细说明，此外还提供预训练模型和Docker环境设置。

ml-agents

Unity ML-Agents Toolkit是一个开源项目，利用游戏和模拟环境训练智能代理。集成了基于PyTorch的先进算法，用户可以轻松训练2D、3D和VR/AR游戏中的智能代理。支持强化学习、模仿学习和神经进化等方法，适用于NPC行为控制、自动化测试和游戏设计评估。该工具包为游戏开发者和AI研究人员提供了一个共享平台，助力在Unity丰富环境中测试AI进展，并惠及广泛的研究和开发社区。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com