TopoNet

自动驾驶场景拓扑推理的图神经网络方法

TopoNet 场景拓扑推理自动驾驶图神经网络 OpenLane-V2 Github 开源项目

TopoNet是一个端到端框架，用于推理自动驾驶场景中车道中心线和交通元素间的连接关系。该框架采用图神经网络和知识图结构，整合异构特征并加强特征交互。TopoNet在OpenLane-V2数据集上展现了领先性能，为自动驾驶场景拓扑推理树立新标准。项目提供开源代码和预训练模型，促进自动驾驶研究发展。

gflownet - 基于图神经网络的离散对象生成框架

GFlowNetGithub图生成开源项目机器学习神经网络组合优化

gflownet是一个实现Generative Flow Network的开源框架，专注于离散和组合对象的生成，尤其适用于图结构。该项目基于图神经网络，支持多种GFN算法，提供离线和在线训练功能。gflownet包含完整的训练环境、算法实现和示例代码，可用于分子设计等任务，是研究GFN在图生成领域应用的有力工具。

NeuralNetworkRacing - 基于神经网络的2D自动驾驶模拟器

2D模拟Githubpyglet开源项目神经网络自动驾驶进化算法

NeuralNetworkRacing是一个使用Python开发的2D自动驾驶模拟项目。它结合神经网络和进化算法,训练虚拟汽车在生成的赛道上自主行驶。项目基于pyglet和numpy库实现,包含环境模拟、赛道生成等功能。通过配置文件,用户可以调整人口数量、突变率等参数。该开源项目为AI和自动驾驶领域提供了一个实验平台。

S3Gaussian - 自监督3D高斯模型提升自动驾驶动态场景解析

3D高斯GithubS3Gaussian场景分解开源项目无人驾驶自监督学习

S3Gaussian使用3D高斯模型进行自监督动态街景解析，增强了自动驾驶的场景分解和渲染效果。该项目采用多分辨率hexplane编码器和多头高斯解码器，将4D网格编码为特征平面，并解码为4D高斯模型。无需额外注释即可优化模型。最新代码和评估已发布，详细介绍了环境配置、数据准备、训练和可视化过程。

corenet - 用于训练多任务深度神经网络的工具库

CoreNetGithub开源项目模型训练深度学习神经网络计算机视觉

CoreNet是一款多功能深度神经网络工具库，支持训练各种规模的标准和创新模型。它适用于基础模型、计算机视觉和自然语言处理等多个领域。该项目提供可复现的训练方案、预训练模型权重和针对Apple Silicon优化的MLX示例，有助于推动AI研究和应用的发展。

BEV-Planner - 端到端自动驾驶中车辆状态依赖分析与评估方法创新

Githubego状态开源项目开环评估端到端模型自动驾驶路径规划

BEV-Planner项目研究端到端自动驾驶中的关键问题。研究发现在nuScenes数据集上,模型过度依赖车辆状态而忽视感知信息。项目提出新的评估指标和基准方法,全面评估规划质量。研究结果质疑当前自动驾驶研究方向,建议重新审视现有方法。项目为自动驾驶领域提供新思路,包括道路遵循性评估和简单但有效的基线模型。

ESANet - 高效RGB-D语义分割网络用于室内场景分析

ESANetGithubRGB-D实时处理室内场景分析开源项目语义分割

ESANet是一个高效的RGB-D语义分割网络,专为室内场景分析设计。该网络在NVIDIA Jetson AGX Xavier上实现实时语义分割,适用于移动机器人的实时场景分析系统。项目提供训练和评估代码,支持模型转换至ONNX和TensorRT,并可测量推理时间。ESANet在NYUv2、SUNRGB-D和Cityscapes等数据集上展现出优异性能。

FocalNet - 突破注意力机制的新型视觉模型架构

FocalNetsGithub卷积神经网络图像分类开源项目目标检测语义分割

FocalNet是一种创新的视觉模型架构,无需使用注意力机制。其核心的焦点调制技术在多项视觉任务中超越了现有的自注意力方法。该模型在ImageNet分类和COCO检测等基准测试中表现优异,同时保持了高效简洁的实现。FocalNet具有平移不变性、强输入依赖性等特点,为计算机视觉领域提供了一种全新的建模思路。

Forge_VFM4AD - DriveGAN实现高质量可控神经网络环境模拟

Github人工智能基础模型开源项目深度学习自动驾驶计算机视觉

DriveGAN是一种高质量神经网络模拟器，通过无监督学习实现环境组成部分的解耦控制。它可模拟转向控制、场景天气和非玩家对象位置等特征。DriveGAN的全微分特性支持视频序列重新模拟，允许在已记录场景中采取不同行动。该方法在多个数据集上训练，包括160小时真实驾驶数据，性能显著优于现有技术。

traffic_prediction - 交通预测模型与数据集综合评估

GithubPeMS数据集交通预测图神经网络开源项目时间序列深度学习

这个项目对交通预测领域的多种模型和数据集进行了系统的比较分析。它汇总了近期发表的相关论文,详细介绍了METR-LA、PeMS-BAY等常用公开数据集。项目提供了各模型在主要数据集上的性能对比图表,并探讨了实验设置的差异。同时,它还整理了可公开获取的数据集及其来源信息,为交通预测研究提供了有价值的参考资料。

sd-controlnet-mlsd - 结合M-LSD直线检测优化Stable Diffusion的图像生成

ControlNetGithubHuggingfaceM-LSDStable Diffusion开源项目扩散模型条件输入模型

该项目介绍了ControlNet神经网络结构，通过加入M-LSD直线检测等条件来控制大规模扩散模型，适用于Stable Diffusion。ControlNet能够在小数据集下进行稳健学习，且可在个人设备上快速训练。项目提供了多种检查点，涵盖边缘检测、深度估计和关键点检测，丰富了大规模扩散模型的控制方式，有助于推进相关应用的发展，最佳效果在Stable Diffusion v1-5结合使用时体现。

相关项目

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com