Project Icon

MACE

扩散模型中的大规模概念擦除技术

MACE是一种用于扩散模型的大规模概念擦除框架。该技术可同时擦除多达100个概念,并在泛化性和特异性间达成平衡。通过结合闭式交叉注意力优化和LoRA微调,MACE能有效消除不需要的概念信息。在对象、名人、显式内容和艺术风格擦除等多项任务评估中,MACE的性能均超越了现有方法。

photo-background-generation - 基于文本引导的扩散模型实现对象背景一致性
GithubHuggingfaceSalient Object-Aware Background Generation开源项目文本指导扩散模型模型物体膨胀电子商务广告背景生成
该开源项目通过文本引导的扩散模型,解决显著对象背景生成中的'对象扩展'问题,保持对象身份和背景的一致性。适合商业广告等需要清晰度的场景。项目已被CVPR 2024采用,提供创新的背景生成方法。
MegEngine - 高效、可扩展且易于使用的深度学习框架
GithubMegEngine开源项目深度学习框架硬件需求训练与推理高性能
MegEngine是一个高效、可扩展且易于使用的深度学习框架,具有统一的训练和推理框架、低硬件要求和跨平台高效推理的三大关键特性。支持x86、Arm、CUDA、RoCM等多种平台,兼容Linux、Windows、iOS、Android等系统。通过DTR算法和Pushdown内存规划器,大幅降低GPU内存使用。适用于模型开发到部署的各个环节,致力于构建开放友好的AI社区。
DesignEdit - 基于多层潜在表示的统一精准图像编辑框架
DesignEditGithubStable Diffusion人工智能图像编辑多层潜在分解开源项目
DesignEdit是一个创新图像编辑项目,采用多层潜在表示技术实现统一精准的编辑功能。支持对象移除、缩放、平移、移动、调整大小和翻转等操作,还可进行跨图像合成和排版重设。基于Stable Diffusion XL 1.0实现,无需额外训练即可使用。项目提供Gradio交互界面,简化了复杂的图像编辑过程。这个开源项目展示了AI在图像编辑领域的应用前景。
AceGPT - 优化阿拉伯语大型语言模型的文化适应性
AceGPTGithub大型语言模型开源项目性能评估文化对齐阿拉伯语言模型
AceGPT是一个针对阿拉伯语优化的开源大型语言模型。该项目不仅关注语言处理,还注重文化适应性和本地价值观融合。通过创新的训练方法,AceGPT在多项阿拉伯语基准测试中展现出优异性能。项目开放了训练代码、模型和评估数据,为阿拉伯语自然语言处理研究提供了宝贵资源。
mtt-distillation - 合成数据集优化训练性能,广泛适用于多个领域
CIFAR-100CVPR 2022Dataset DistillationGithubImageNetSynthetic Data开源项目
通过匹配训练轨迹实现数据集蒸馏,减少模型训练所需的真实数据集数量并保持高性能。适用于ImageNet等大规模数据集,可生成低支撑的合成数据集和可拼接纹理。项目提供详细的实现步骤和代码,从下载仓库、生成专家轨迹到数据集蒸馏,帮助用户快速开始应用。还提供可视化工具和超参数设置指南,满足不同需求。此方法显著提高了模型训练效率,适合学术研究和工业应用。
HCP-Diffusion - Stable Diffusion模型训练与优化工具集
DreamArtist++GithubHCP-DiffusionLoRAStable Diffusion开源项目文本到图像生成
HCP-Diffusion是基于Diffusers库开发的Stable Diffusion模型工具集。它整合了多种文本到图像生成的训练方法,包括Prompt-tuning和Textual Inversion等。该工具集引入了DreamArtist++技术,支持一次性文本到图像生成。HCP-Diffusion提供层级LoRA、模型集成和自定义优化器等功能,为AI研究和开发提供全面的模型训练与推理支持。
MNN - 高效轻量的深度学习框架,支持多设备推理和训练
GithubMNN开源项目推理引擎深度学习框架轻量级高性能
MNN是一个高效轻量的深度学习框架,支持设备上的推理和训练。已被阿里巴巴30多个应用集成,覆盖直播、短视频、搜索推荐等70多种场景。MNN适用于嵌入式设备,支持TensorFlow、Caffe、ONNX等多种模型格式,并优化了ARM和x64 CPU及多种GPU的计算性能。通过MNN Workbench,用户可以下载预训练模型、进行可视化训练并一键部署到设备上。
T-MAC - 优化低比特量化LLM推理的CPU加速框架
CPU加速GithubLLM推理T-MAC低比特量化开源项目矩阵乘法
T-MAC是一个创新的内核库,采用查找表技术实现混合精度矩阵乘法,无需反量化即可加速CPU上的低比特LLM推理。该框架支持多种低比特模型,包括GPTQ/gguf的W4A16、BitDistiller/EfficientQAT的W2A16和BitNet的W1(.58)A8。T-MAC在多种设备上展现出显著性能提升,例如在Surface Laptop 7上,单核处理速度可达20 tokens/s,四核可达48 tokens/s,比llama.cpp快4~5倍。
MagicDrive - 多样化3D几何控制的街景生成框架
3D几何控制GithubMagicDrive开源项目扩散模型街景生成计算机视觉
MagicDrive是一个创新街景生成框架,提供多样化的3D几何控制,包括相机姿态、道路地图和3D边界框。通过结合文本描述、定制编码策略和跨视图注意力模块,实现了多相机视角的一致性。该框架能生成高保真街景图像和视频,精确捕捉3D几何特征和场景细节,有助于提升BEV分割和3D物体检测等任务的性能。
DeepCache - 免费加速扩散模型
DeepCacheGithub开源项目无训练模型加速降采样高搜索量
DeepCache通过无需训练的方式显著加速扩散模型,支持Stable Diffusion、Stable Diffusion XL、Stable Video Diffusion等。兼容多种采样算法如DDIM和PLMS,并提供详细的使用示例,用户无需修改代码即可提升性能。此外,DeepCache还支持并行推理和多GPU使用,确保高效部署和运行。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

Project Cover

天工AI音乐

天工AI音乐平台支持音乐创作,特别是在国风音乐领域。该平台适合新手DJ和音乐爱好者使用,帮助他们启动音乐创作,增添生活乐趣,同时发现和分享新音乐。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号