#自监督学习
Masked Image Modeling: 深度学习中的新范式
monodepth2
本项目提供了PyTorch实现的代码,用于训练和测试深度估计模型。代码采用自监督学习方法,支持单目和立体图像的深度预测。提供多种预训练模型和自定义数据集,兼容不同的图像分辨率。适用于研究和非商业用途,包含详细的设置指南、训练和评估说明。用户可通过此项目高效开发和优化深度估计模型。
DALLE2-pytorch
DALL-E 2的Pytorch实现由OpenAI开发,采用先进的神经网络技术将文本描述转化为高质量图像。本版本特别优化扩散先验网络,提供高性能的模型变体。开源项目鼓励开发者通过GitHub和Hugging Face参与贡献,并在Discord社区进行交流和支持。
awesome-self-supervised-learning
精选自监督学习资源,覆盖理论研究与各领域实际应用,如计算机视觉、机器学习等。本项目常更新,已成为AI领域必备的研究与教学资源。
Awesome-MIM
该项目汇总了掩码图像建模(MIM)及相关的自监督学习方法。涵盖了从2008年以来的主要自监督学习研究,并展示了其在自然语言处理和计算机视觉领域的发展历程和关键节点。所有内容按时间顺序排列并定期更新,包括相关论文、代码和框架的详细信息,旨在帮助研究者深入理解和应用MIM方法。欢迎贡献相关文献或修正建议。
Awesome-Denoise
本项目汇总了图像与视频去噪领域的多项最新研究,通过色彩空间、图像类型和噪声模型进行分类。包含RGB、Raw以及两者兼顾的色彩空间,单张图像、连拍和视频的图像类型,以及多种噪声模型如加性白高斯噪声、泊松高斯噪声和基于生成对抗网络的噪声模型。此外,项目还整理了多个基准数据集和自监督去噪的研究论文,为研究人员提供全面的参考资源。
S3Gaussian
S3Gaussian使用3D高斯模型进行自监督动态街景解析,增强了自动驾驶的场景分解和渲染效果。该项目采用多分辨率hexplane编码器和多头高斯解码器,将4D网格编码为特征平面,并解码为4D高斯模型。无需额外注释即可优化模型。最新代码和评估已发布,详细介绍了环境配置、数据准备、训练和可视化过程。
lightly
这个开源项目提供简单易用的自监督学习工具,支持自定义骨干模型和分布式训练。通过模块化设计,用户可以自由调整损失函数和模型头。项目还提供商业版本,包含用于嵌入、分类、检测和分割任务的预训练模型。此外,平台集成了主动学习和数据策划功能,适用于大规模数据处理和强大算法的应用。
solo-learn
solo-learn库基于PyTorch Lightning,提供多种自监督方法用于无监督视觉表征学习。该库包含全面的训练技巧和多种数据处理、评估方式,以提高训练效果和可重复性。其主要特点有快速的数据处理、自定义模型检查点、线上和线下的K-NN评估。库内包含灵活的数据增强、可视化功能,并不断更新方法和改进教程,使模型训练和调试更加高效简便。
AI-Optimizer
AI-Optimizer是一款多功能深度强化学习平台,涵盖从无模型到基于模型,从单智能体到多智能体的多种算法。其分布式训练框架高效便捷,支持多智能体强化学习、离线强化学习、迁移和多任务强化学习、自监督表示学习等,解决维度诅咒、非平稳性和探索-利用平衡等难题,广泛应用于无人机、围棋、扑克、机器人控制和自动驾驶等领域。