Project Icon

concept-ablation

预训练文生图模型概念消除技术

Concept Ablation 项目开发了一种从预训练文本到图像扩散模型中移除特定概念的方法。通过将目标概念的图像分布匹配到锚概念分布,如将'Grumpy Cat'匹配到'Cat',实现了高效的概念消除。该技术可以去除版权材料、记忆图像等,同时保留相关概念,无需重新训练模型。在特定对象实例、艺术风格和记忆图像等多种任务中表现优异。

rich-text-to-image - 富文本格式提升文本到图像生成的精确控制
AI绘图GithubICCV 2023Rich-Text-to-ImageStable Diffusion开源项目文本生成图像
Rich-Text-to-Image项目利用富文本格式信息增强文本到图像生成的控制能力。该项目通过字体大小、颜色、样式和脚注等格式实现精确的颜色渲染、局部风格控制和详细区域合成。这种方法支持token显式重新加权,可与Stable Diffusion等主流模型集成,提供更精细的图像生成控制。项目开源了代码实现,并提供在线演示和相关论文,为文本到图像生成领域开辟了新的研究方向。
LLMGA - 用于精确图像生成和编辑的多模态大语言模型
ECCV2024GithubLLMGA图像生成多模态大模型开源项目
LLMGA基于多模态大语言模型,提供图像生成与编辑解决方案。结合Stable Diffusion和详细语言生成提示,项目提升了上下文理解并减少生成过程中的噪音,增强图像内容的精度。LLMGA支持文本到图像(T2I)、补画、扩画及指令编辑,适用于Logo设计、海报制作和故事绘本生成,支持中英文指令。广泛的模型和数据集选择满足不同需求,是理想的图像生成和编辑助手。
ProFusion - 高效定制化文本到图像生成的无正则化方法
AI绘图GithubProFusionStable Diffusion开源项目文本生成图像自定义模型
ProFusion是一个创新的文本到图像生成框架,专为定制预训练大规模模型而设计。该框架仅需一张测试图像和单个GPU,即可为独特概念生成多样创意图像。ProFusion采用无正则化方法,有效保留图像细节,并能构建定制数据集用于训练免调整的AI助手。此外,它还支持处理复杂输入,同时生成文本说明和图像,无需额外微调。
Photon_v1 - 基于Stable Diffusion的创新文本转图像模型
AI绘图GithubHuggingfacePhotonStable Diffusion图像生成开源项目模型
Photon_v1是基于Stable Diffusion技术的文本到图像生成模型。它可将文字描述转化为视觉图像,适用于创意设计、内容创作、数字艺术等多样化场景。该模型已部署在Hugging Face平台,支持在线推理功能,为用户提供便捷的图像生成体验。Photon_v1具有高效的文本理解能力和图像渲染质量,能够满足各种复杂的图像生成需求。
Mix-of-Show - 去中心化低秩适应技术实现扩散模型的多概念定制
AI绘图GithubMix-of-Show低秩适应多概念定制开源项目扩散模型
Mix-of-Show是一种扩散模型多概念定制技术,通过去中心化低秩适应实现单概念和多概念融合。它可生成高质量动漫和真实人物图像,无需正则化数据集,支持区域可控的多概念采样。该项目开源了训练和推理代码,为扩散模型个性化提供新方案。
concept-erasure - LEACE算法实现特征精准移除 优化模型公平性与可解释性
GithubLEACE公平性开源项目概念消除线性分类器表征学习
LEACE (LEAst-squares Concept Erasure) 是一种创新的概念擦除算法,通过闭式解方法有效阻止线性分类器检测特定概念,同时最小化对数据表征的影响。该方法可应用于增强模型公平性和可解释性,例如消除性别或种族等敏感特征的影响。项目提供简单易用的Python包,支持批量和流式数据处理,适合处理大规模数据集。LEACE在保证效率的同时,为AI模型的偏见消除和特征解释提供了有力支持。
GLIGEN - 开放式条件引导的文本到图像生成模型
GLIGENGithub人工智能开源项目文本到图像生成深度学习计算机视觉
GLIGEN是一个创新的开放式条件引导文本到图像生成模型。它扩展了冻结文本到图像模型的功能,支持框、关键点和图像等多种引导条件。在COCO和LVIS数据集的零样本测试中,GLIGEN大幅超越了现有的有监督布局到图像生成基线。这项技术在开放世界场景下的应用前景广阔,同时也需关注其局限性和伦理影响。
tame-the-authenticity-machine-v10-sdxl - 稳定扩散XL模型实现逼真图像生成
GithubHuggingfacediffusersstable-diffusiontext-to-image图像生成开源项目模型真实感
该项目利用zyxt99565的模型,通过diffusers库进行文本到图像的转换,支持多标签如stable-diffusion-xl和photorealistic,专注于生成高质量逼真图像。
OnlyReal-Black-Mix - 利用文本到图像技术实现高效图像生成的创新解决方案
CivitaiGithubHugging FaceHuggingfacediffusersstable-diffusion图像生成开源项目模型
该项目结合稳定扩散模型与diffusers,支持文本转图像功能,适合多样化的创意应用场景。利用Hugging Face API生成的样本图像及原作者的演示,展示了其在艺术创作中的潜力与应用价值。
CAT - 创新图像恢复模型 强化远程特征建模
GithubTransformer卷积神经网络图像修复开源项目自注意力机制长程依赖
CAT是一种创新的图像恢复模型,采用矩形窗口自注意力机制扩大特征提取范围。模型通过水平和垂直矩形窗口并行聚合特征,实现窗口间交互。结合CNN的局部特性,CAT在全局-局部特征耦合方面表现出色。实验证实该方法在多种图像恢复任务中超越了现有技术水平。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号