Project Icon

OmniNxt

全方位视觉感知的开源紧凑型空中机器人

OmniNxt是一个开源的空中机器人项目,采用四鱼眼相机设计实现360度全方位视觉感知。项目特点包括硬件紧凑、自主飞控系统、视觉惯性里程计和深度估计算法。OmniNxt为空中机器人研究和开发提供了一个功能完备的开放平台,适用于多种复杂环境下的空中任务。

NEXA AI - 高性能本地化多模态AI模型
AI代理AI工具Octopus模型功能调用本地运行边缘设备
NEXA AI开发的本地化AI模型Octopus系列,可在多种设备上离线运行,无需订阅。这些模型具备自然语言理解、工具调用等能力,可执行多样化任务。相比云端AI,Octopus模型在速度、成本和准确度上均有优势,同时保障数据隐私。该技术适用于需要高性能、低延迟和数据安全的AI应用场景。
omnisafe - 安全强化学习框架加速AI系统安全研究
GithubOmniSafeSafeRL安全强化学习开源项目强化学习算法框架
OmniSafe是一个用于安全强化学习(SafeRL)研究的开源框架。它提供了全面的SafeRL算法基准测试和模块化工具包。该框架采用高度模块化设计,支持高性能并行计算,并提供开箱即用的工具。OmniSafe实现了多种类型的SafeRL算法,包括基于策略、无模型和基于模型等。通过丰富的教程和API,框架适合不同水平的研究人员使用。OmniSafe致力于推动SafeRL领域的发展,为AI系统安全性研究提供重要支持。
OmniXAI - 多功能AI决策解释Python库
GithubOmniXAI可解释人工智能开源项目数据分析机器学习模型解释
OmniXAI是一个开源Python库,专注于可解释人工智能(XAI)。它支持多种数据类型和机器学习模型,提供丰富的解释方法,如特征归因和反事实解释。通过统一接口和可视化仪表板,OmniXAI简化了AI决策解释过程,适用于机器学习流程的各个阶段,为数据科学家和ML从业者提供深入洞察。
xtreme1 - 开源多模态训练数据平台,专注于数据标注、管理和本体管理,支持计算机视觉和大模型项目
AI驱动工具GithubXtreme1多模式训练数据开源项目数据标注计算机视觉
Xtreme1是一款开源多模态训练数据平台,专注于数据标注、管理和本体管理,支持计算机视觉和大模型项目。凭借AI驱动工具,高效进行2D/3D物体检测、分割及LiDAR-摄像头融合,提升效率。平台具有强大的数据管理和质量监控功能,并提供模型结果可视化,辅助模型评估。Xtreme1云端版本长期免费,安装方便,兼容多种操作系统和硬件。
octo - 基于transformer的通用机器人控制策略
AI模型GithubOcto开源项目微调机器人政策预训练模型
Octo是一个基于transformer的扩散策略模型,通过80万条多样化机器人轨迹数据训练而成。该模型支持多个RGB相机输入,可控制各种机器人手臂,并接受语言命令或目标图像指令。其模块化注意力结构使其能高效迁移至新的传感器输入、动作空间和形态。项目提供预训练模型、微调脚本和评估示例,便于研究人员进行深入开发和应用。
Open-LLaVA-NeXT - 多模态大语言模型实现视觉语言对齐和指令微调的开源项目
AI模型评估GithubLLaVA-NeXT多模态模型开源实现开源项目视觉语言训练
Open-LLaVA-NeXT是一个复现LLaVA-NeXT系列模型的开源项目。它提供开源训练数据和检查点,基于LLaVA代码库进行修改。该项目支持CLIP-L-336视觉编码器以及Vicuna-7B和LLaMA3-8B等语言模型。通过特征对齐和视觉指令微调两个阶段的训练,Open-LLaVA-NeXT实现了多模态能力,在多项评估任务中表现优异。
bevfusion - 具有统一鸟瞰图表示的多任务多传感器融合
3D目标检测BEVFusionGithub多传感器融合开源项目自主驾驶鸟瞰图表示
BEVFusion是一个有效的多任务多传感器融合框架,通过在共享的鸟瞰视角表示空间中统一多模态特征,解决了传统点级融合方法的局限性。其优化的视角转换和显著降迟特性使其在各种3D感知任务中表现出色。该框架在提升3D物体检测和BEV图分割性能的同时,大幅降低计算成本,树立了新行业标杆。
OpenCat - 基于 Arduino 和 Raspberry Pi 的开源四足机器人制作框架
GithubOpenCatPetoi四足开源项目机器人编程
OpenCat是由Petoi开发的基于Arduino和树莓派的开源四足机器人框架,旨在推动四足机器人研究、教育和工程发展。用户可以通过该项目创建灵活的编程步态和运动,并通过块状编码、C/C++/Python等编程语言将模拟应用于现实。OpenCat已广泛应用于机器人和AI项目,如自主移动、目标检测、视觉SLAM和模仿学习等,并支持各种传感器和AI芯片的扩展。
Fast-BEV - 新一代鸟瞰视角感知系统
Fast-BEVGithub开源项目深度学习自动驾驶计算机视觉鸟瞰图感知
Fast-BEV是一种先进的鸟瞰视角感知系统,专注于3D目标检测和BEV语义分割。该项目针对自动驾驶等应用场景进行了优化,提供多种模型配置和CUDA、TensorRT加速支持。Fast-BEV不仅在性能和速度方面表现卓越,还提供了完整的安装指南、数据准备流程和训练方法,为研究人员和开发者提供了强大的工具。作为领先的感知算法和计算机视觉解决方案,Fast-BEV为鸟瞰视角感知任务设立了新的标准。
BEVFormer - 多摄像头鸟瞰图学习框架助力自动驾驶感知
BEVFormerGithub多相机感知开源项目目标检测自动驾驶鸟瞰图表示
BEVFormer是一个用于自动驾驶感知的开源框架,通过时空Transformer从多摄像头图像中学习统一的鸟瞰图表示。该方法利用预定义的网格查询,结合空间交叉注意力和时间自注意力机制,有效聚合多视角的空间和时序信息。在nuScenes测试集上,BEVFormer达到56.9%的NDS指标,显著超越现有方法,与激光雷达系统性能相当。这一创新为基于纯视觉的3D目标检测提供了新的基准。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号