navsim

创新自动驾驶仿真与评估系统

NAVSIM是一个创新的自动驾驶仿真与评估系统。它通过简化的场景鸟瞰图抽象来收集端到端驾驶指标，采用开环计算方法平衡效率和闭环评估一致性。该系统支持多种代理模型，提供标准化数据集，为自动驾驶研究提供高效可靠的评估工具。NAVSIM的非反应式设计和数据驱动方法有助于推进自动驾驶技术的发展。

Github

文档

论文

介绍相关项目

carla-roach - 端到端城市自动驾驶仿真框架

CARLA-RoachGithub基准测试开源项目强化学习模仿学习自动驾驶

CARLA-Roach是一个端到端城市自动驾驶仿真框架,通过模仿强化学习教练实现驾驶。它提供基准测试、数据收集、强化学习训练和基于DAGGER的模仿学习功能。该项目还包含预训练模型,支持在NoCrash和CARLA Leaderboard等基准上评估。CARLA-Roach为自动驾驶研究提供了实用的仿真平台。

CustomNavMesh - Unity导航网格增强系统实现动态避障和智能寻路

GithubNavMeshAgentNavMeshObstacleUnity开源项目自定义导航网格避障

CustomNavMesh是一个基于Unity导航系统的扩展解决方案,使AI代理能在寻路时动态避开静止的其他代理。通过切换NavMeshAgent和NavMeshObstacle组件,实现了更灵活的寻路行为。系统兼容NavMeshComponents,提供自定义Surface、Obstacle和Agent组件,可替换原生组件。CustomNavMesh支持代理间的推挤交互,并根据速度和时间智能控制阻挡状态,提升了AI导航的真实感。

DSVT - 易于部署的大规模点云3D对象检测系统

3D对象检测CVPR 2023DSVTGithubWaymo动态稀疏体素转化器开源项目

DSVT是一款高效且易于部署的大规模点云3D对象检测系统，适用于Waymo和NuScenes等数据集。通过动态稀疏体素变换器和旋转集合分区策略，DSVT实现了27Hz的实时推理速度，提供了在单帧和多帧检测中的卓越表现，适用于自动驾驶等场景。

ManiSkill - 开源机器人仿真与训练统一框架

GPU并行GithubManiSkill 3SAPIEN开源框架开源项目机器人仿真

ManiSkill是基于SAPIEN的开源机器人仿真与训练框架。它提供GPU并行化视觉数据采集系统，支持多种机器人和任务类型。该框架具有高效的GPU并行任务处理能力，可快速生成合成数据并在不同场景中进行仿真。ManiSkill提供灵活的任务构建API，简化GPU内存管理。它支持2D/3D视觉强化学习、模仿学习等工作流程，未来将扩展更多资产和场景支持。

Awesome-Multimodal-LLM-Autonomous-Driving - 多模态大语言模型推动自动驾驶技术创新

GithubWACV人工智能多模态大语言模型开源项目自动驾驶计算机视觉

该资源库汇集自动驾驶领域多模态大语言模型(MLLM)相关研究,全面介绍MLLM在感知、规划和控制方面的应用。内容涵盖最新模型、数据集和基准,并总结WACV 2024 LLVM-AD研讨会成果。项目探讨了MLLM应用于自动驾驶系统的挑战和机遇,为研究人员和工程师提供了解该前沿领域发展的宝贵参考。

HybridNets - 实时多任务交通场景感知网络

GithubHybridNets可行驶区域分割多任务感知开源项目目标检测车道线检测

HybridNets是一个实时多任务交通场景感知网络,集成了交通对象检测、可行驶区域分割和车道线检测功能。该网络可在嵌入式系统上实时运行,在BDD100K数据集的目标检测和车道检测任务中达到了最先进水平。HybridNets平衡了实时性能和多任务准确性,为自动驾驶和高级驾驶辅助系统提供了高效的视觉感知解决方案。

AutoWebGLM - 智能网页导航代理系统

AutoWebGLMGithubHTML简化Web导航代理大语言模型开源项目自动网页浏览

AutoWebGLM项目致力于开发高效的自动网页导航代理系统。该项目基于ChatGLM3-6B模型，通过创新的HTML简化算法、人机混合训练方法、强化学习和拒绝采样技术，显著提升了模型的网页理解和浏览器操作能力。此外，项目推出的AutoWebBench双语基准为评估AI网页导航代理性能提供了专业工具。

Cam2BEV - 深度学习实现多视角车载图像到语义分割鸟瞰图转换

Cam2BEVGithub开源项目深度学习自动驾驶语义分割鸟瞰图

该项目提出一种深度学习方法,将多个车载摄像头图像转换为语义分割鸟瞰图(BEV)。采用合成数据集训练,可良好泛化到真实场景。方法使用语义分割图像作为输入,缩小了仿真与真实数据的差距,无需手动标注。项目开源了代码、网络架构和数据集,适用于自动驾驶环境感知研究。相比传统逆透视映射,该方法在处理3D物体和遮挡区域时表现更佳。

sumo-rl - 用于智能交通信号控制的强化学习框架

GithubSUMO-RL交通仿真交通信号控制多智能体开源项目强化学习

SUMO-RL是基于SUMO交通模拟器的强化学习框架，专注于智能交通信号控制。该框架提供简洁接口，支持创建单代理和多代理强化学习环境，允许自定义状态和奖励函数，并兼容主流RL库。SUMO-RL简化了交通信号控制的强化学习研究过程，适用于多种交通网络和场景。目前已应用于多项研究，覆盖从单一交叉口到大规模城市网络的各类交通控制问题。

S3Gaussian - 自监督3D高斯模型提升自动驾驶动态场景解析

3D高斯GithubS3Gaussian场景分解开源项目无人驾驶自监督学习

S3Gaussian使用3D高斯模型进行自监督动态街景解析，增强了自动驾驶的场景分解和渲染效果。该项目采用多分辨率hexplane编码器和多头高斯解码器，将4D网格编码为特征平面，并解码为4D高斯模型。无需额外注释即可优化模型。最新代码和评估已发布，详细介绍了环境配置、数据准备、训练和可视化过程。

相关项目

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com