bark

自动驾驶语义仿真与行为模型开发框架

BARK 自动驾驶行为模型仿真框架基准测试 Github 开源项目

BARK是一个开源的自动驾驶语义仿真框架，专注于行为模型的开发和评估。它支持快速构建、训练和基准测试决策算法，尤其适合强化学习等计算密集型任务。BARK提供行为基准测试、Python和C++模型开发等功能，并可与机器学习工具和CARLA仿真器集成。其生态系统包含BARK-ML、BARK-MCTS等多个组件，为自动驾驶行为模型的研究提供全面支持。

访问官网

Github

介绍相关项目

Awesome-Multimodal-LLM-Autonomous-Driving - 多模态大语言模型推动自动驾驶技术创新

GithubWACV人工智能多模态大语言模型开源项目自动驾驶计算机视觉

该资源库汇集自动驾驶领域多模态大语言模型(MLLM)相关研究,全面介绍MLLM在感知、规划和控制方面的应用。内容涵盖最新模型、数据集和基准,并总结WACV 2024 LLVM-AD研讨会成果。项目探讨了MLLM应用于自动驾驶系统的挑战和机遇,为研究人员和工程师提供了解该前沿领域发展的宝贵参考。

BEV-Planner - 端到端自动驾驶中车辆状态依赖分析与评估方法创新

Githubego状态开源项目开环评估端到端模型自动驾驶路径规划

BEV-Planner项目研究端到端自动驾驶中的关键问题。研究发现在nuScenes数据集上,模型过度依赖车辆状态而忽视感知信息。项目提出新的评估指标和基准方法,全面评估规划质量。研究结果质疑当前自动驾驶研究方向,建议重新审视现有方法。项目为自动驾驶领域提供新思路,包括道路遵循性评估和简单但有效的基线模型。

bisheng - 开源大模型应用开发平台

BishengGithub大模型应用开源开源项目数据治理智能应用热门

Bisheng是一款开源大模型应用开发平台，旨在加速大模型技术在多种业务场景下的应用落地，通过提供灵活、可靠的开发组件和流程编排能力，支持包括文档摘要、知识库问答和对话等智能应用的构建。平台强调实用功能和数据治理，专为高并发和企业级应用设计。于2023年8月底正式开源，提供全面的开发者文档和社区支持。

ad-rss-lib - 开源C++库实现自动驾驶责任敏感安全模型

C++库GithubRSS安全模型开源开源项目自动驾驶

ad-rss-lib是一个开源C++库,实现了自动驾驶责任敏感安全(RSS)模型。该库可处理多车道、交叉路口和非结构化道路场景,为自动驾驶系统提供安全约束。支持自动驾驶地图集成和Python开发,已在CARLA模拟器和百度Apollo平台中应用,为自动驾驶安全研究提供了有力工具。

lidar-slam-detection - 面向自动驾驶和机器人的开源感知系统架构

GithubLSDSLAM开源项目机器人感知激光雷达自动驾驶

LSD是一个面向自动驾驶和机器人的开源感知系统架构。它支持多种传感器集成,提供便捷的标定工具,实现软件时间同步及数据记录回放。系统集成了基于体素3D-CNN的点云目标检测、跟踪和预测功能,以及基于GICP、FLOAM和FastLIO的前端里程计算法和基于G2O的后端优化。LSD还包含基于Web的交互式地图编辑工具,并可与ROS系统对接。作为一个功能完备的感知方案,LSD为自动驾驶和机器人应用提供了坚实的技术基础。

TAD_Sim - 高效安全的跨平台自动驾驶测试仿真系统

GithubTAD Sim仿真系统开源项目算法验证自动驾驶虚拟现实

TAD_Sim是腾讯自动驾驶团队开发的跨平台分布式仿真系统。该系统集成了工业级车辆动力学模型和专业渲染引擎，可实现自动驾驶全模块的闭环仿真验证。TAD_Sim支持Windows和Ubuntu平台，提供完整的开发文档和SDK。通过降低研发成本和缩短周期，TAD_Sim为自动驾驶算法的测试和验证提供了高效的解决方案。

ml-ferret - 高级多模态语言模型实现精细指代和定位

AI视觉交互FerretGithub多模态大语言模型开源项目指代理解视觉定位

Ferret是一个端到端多模态大语言模型，支持任意形式的指代并能在响应中定位内容。通过混合区域表示和空间感知视觉采样器，实现了细粒度和开放词汇的指代与定位。项目提供GRIT数据集和Ferret-Bench评估基准，为多模态模型研究提供重要资源。

BakLLaVA - 突破性多模态语言模型创新

AI训练BakLLaVAGithub多模态开源项目视觉指令微调语言模型

BakLLaVA项目通过优化基础模型、改进训练流程、使用定制数据集和重构LLaVA架构，将先进的多模态能力融入语言模型。该项目与LAION、Ontocord和Skunkworks OSS AI小组合作，致力于提升AI系统理解和生成视觉内容的能力。BakLLaVA为研究人员提供了探索视觉语言模型前沿的强大工具。

MagicDrive - 多样化3D几何控制的街景生成框架

3D几何控制GithubMagicDrive开源项目扩散模型街景生成计算机视觉

MagicDrive是一个创新街景生成框架，提供多样化的3D几何控制，包括相机姿态、道路地图和3D边界框。通过结合文本描述、定制编码策略和跨视图注意力模块，实现了多相机视角的一致性。该框架能生成高保真街景图像和视频，精确捕捉3D几何特征和场景细节，有助于提升BEV分割和3D物体检测等任务的性能。

giskard - LLM和ML模型的评估和测试框架

AI模型GiskardGithubLLM偏见检测安全性开源项目

Giskard是一个开源的Python库，旨在自动检测AI应用中的性能、偏差和安全问题。支持LLM和传统的ML模型，功能涵盖自动生成评估数据集、评估RAG应用答案、检测幻觉、生成有害内容及敏感信息泄露等问题。Giskard可无缝集成到各种环境中，并提供详细文档和示例代码，适用于各类AI开发者。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号