Project Icon

minRF

轻量级可扩展整流流变换器实现

minRF是一个开源项目,提供整流流变换器的轻量级实现,适用于深度学习研究。它结合SD3训练方法和LLaMA-DiT架构,包括支持MNIST和CIFAR数据集的基础版本,以及支持ImageNet训练并引入muP技术的高级版本。项目代码结构清晰,便于理解和定制,为研究人员提供了灵活的整流流模型实验环境。

oneflow - 用户友好且高效扩展的深度学习框架
CUDA支持GithubOneFlowPyTorch API分布式训练开源项目深度学习框架
OneFlow是一款深度学习框架,提供类似PyTorch的API,支持n维并行执行的全局张量以及图编译器用于加速和部署模型。最新版本1.0.0已发布,兼容Linux和多个Python版本。用户可以通过Docker或Pip轻松安装,并利用丰富的文档和模型库快速上手,适合大型变压器模型的并行训练和计算机视觉任务。
Restormer - 高效Restormer Transformer实现高分辨率图像修复
GithubRestormerTransformer图像去噪图像去雨开源项目高分辨率图像恢复
研究提出了一种名为Restormer的高效Transformer模型,通过多头注意力和前馈网络设计,实现了长距离像素交互,适用于大图像处理。该模型在图像去雨、单图像运动去模糊、散焦去模糊(单图像和双像素数据)和高斯及真实图像去噪等任务中表现优异。Restormer的训练代码和预训练模型已发布,并被选为CVPR 2022的口头报告。用户可通过Colab或命令行测试预训练模型。
unit-minions - 自主训练LoRA以提升代码与文档生成效率
AI研发提效GithubLoRA代码生成开源项目测试代码生成用户故事生成
了解'unit-minions'如何利用LoRA模型进行自主训练,以显著提升软件开发周期中的AI辅助效能。项目内容包括完整的训练教程、操作视频以及代码实战演示,详细呈现从需求分析到代码生成的自动化全过程。通过LLaMA和ChatGLM LoRA模型,有效支持代码辅助、测试和需求详细化,旨在提供科学的工具优化工程师的工作流程,提升开发效率。
nanodl - 设计与训练变压器模型的Jax库
GithubJaxNanoDLtransformer模型分布式训练开源项目深度学习
这是一个基于Jax的库,旨在简化变压器模型的开发和训练,特别适合资源有限的环境。支持多种模型如Gemma、GPT3、T5和Whisper,涵盖自然语言处理和计算机视觉任务。提供灵活的模块和层,包括Jax/Flax中未提供的RoPE、GQA、MQA和Swin注意力机制,支持多GPU/TPU的数据并行训练,简化数据处理。该库还包含加速的经典机器学习模型,帮助用户以最小的代码重写快速实现模型开发和训练。
lora - 使用低秩自适应技术进行快速稳定扩散模型微调
DreamboothGithubHuggingfaceLoRAPivotal TuningStable Diffusion开源项目
该项目使用低秩自适应技术进行快速稳定扩散模型微调,比dreambooth方法快两倍,支持inpainting,并且生成非常小的模型文件(1MB~6MB),便于共享和下载。兼容diffusers库,提供多向量核心调优反演功能,并实现更好的性能。项目集成了Huggingface Spaces,增加了LoRA合并、Resnet应用和转换脚本功能。通过仅微调模型的残差,该方法显著缩小模型大小,同时保持高保真度,适用于需要快速高效微调的用户。
MNN - 高效轻量的深度学习框架,支持多设备推理和训练
GithubMNN开源项目推理引擎深度学习框架轻量级高性能
MNN是一个高效轻量的深度学习框架,支持设备上的推理和训练。已被阿里巴巴30多个应用集成,覆盖直播、短视频、搜索推荐等70多种场景。MNN适用于嵌入式设备,支持TensorFlow、Caffe、ONNX等多种模型格式,并优化了ARM和x64 CPU及多种GPU的计算性能。通过MNN Workbench,用户可以下载预训练模型、进行可视化训练并一键部署到设备上。
RayDF - 革新性射线基础3D形状表示与快速渲染技术
3D建模GithubRayDF多视图一致性开源项目深度图像渲染神经网络
RayDF是一种创新的基于射线的连续3D形状表示方法,在渲染800x800深度图像时比传统方法快1000倍。该项目包含完整的训练和评估流程,涵盖双射线可见性分类器和射线-表面距离网络训练,并在多个数据集上进行了实验。RayDF在3D重建和渲染方面表现出色,为计算机视觉和图形学领域开辟了新的研究方向。
distill-sd - 更小更快速的Stable Diffusion模型,依靠知识蒸馏实现高质量图像生成
GithubStable Diffusion开源项目模型压缩神经网络训练细节预训练检查点
基于知识蒸馏技术开发的小型高速Stable Diffusion模型。这些模型保留了完整版本的图像质量,同时大幅减小了体积和提升了速度。文档详细介绍了数据下载脚本、U-net训练方法和模型参数设置,还支持LoRA训练及从检查点恢复。提供清晰的使用指南和预训练模型,适配快速高效图像生成需求。
mLoRA - 为大型语言模型提供高效多LoRA适配器构建
GithubLoRA适配器mLoRA大语言模型开源框架开源项目高效微调
mLoRA 是一个开源框架,旨在高效地对多个大型语言模型 (LLMs) 进行 LoRA 和其变体的微调。其主要功能包括同时微调多个 LoRA 适配器、共享基础模型、优化的流水线并行算法,并支持多种 LoRA 变体和偏好对齐算法。mLoRA 可在普通硬件上高效运行,支持多种模型和算法,有助于节省计算和内存资源。通过参考文档可了解如何快速部署和使用 mLoRA。
transfomers-silicon-research - Transformer模型硬件实现研究进展
BERTGithubTransformer开源项目硬件加速神经网络自然语言处理
本项目汇集了Transformer模型硬件实现的研究资料,包括BERT及其优化方案。内容涵盖算法-硬件协同设计、神经网络加速器、量化和剪枝等技术。项目提供了详细的论文列表,涉及FPGA实现、功耗优化等多个领域,全面展示了Transformer硬件加速的最新研究进展。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号