SDT

生成可定制风格的在线和离线手写体

SDT 手写生成写作风格解耦在线中文手写 CVPR 2023 Github 开源项目

该项目提出了一种名为SDT的风格解缠变压器，可生成具有特定内容和风格的手写体。相较于现有的RNN方法，SDT能够区分书写者和字符的风格差异，提高模仿性能。此外，该项目还延伸至离线手写体生成，显著改进了中文离线手写体的生成质量。最近的更新包括发布教程和代码，支持用户自定义手写体风格合成，新方法One-DM也已被ECCV 2024接收。

Github

介绍相关项目

coloringbookgenerator - 利用文本到图像技术生成创意填色书

AI绘图Coloring Book GeneratorGithubHuggingfaceSafetensorsstable-diffusion开源项目模型模型下载

项目结合稳定扩散和LoRA技术，实现了文本到图像的生成，适用于创作儿童填色书。使用稳定扩散XL基础模型生成DIY填色书，并支持Safetensors格式权重，确保高效运行，适合多种文本到图像转换场景。

stable-diffusion-3-medium - 基于多模态扩散变换器的开源AI图像生成模型

GithubHuggingfaceStable Diffusion 3人工智能绘画图像生成模型开源项目文本生成图像模型非商业许可

Stable Diffusion 3 Medium是Stability AI开发的文本生成图像模型，采用多模态扩散变换器(MMDiT)架构，集成OpenCLIP、CLIP和T5三种文本编码器。模型通过10亿图像预训练和3000万张图像微调，支持图像生成、字体排版等功能。提供多种模型变体，可通过ComfyUI或API使用，仅限非商业研究用途。

taesd - 轻量级自动编码器：高速解码Stable Diffusion潜在空间

AI绘图GithubStable DiffusionTAESD开源项目潜在空间自动编码器

TAESD是一款小巧的自动编码器，采用与Stable Diffusion VAE相同的潜在API。它能高效地将Stable Diffusion潜在空间解码为全尺寸图像。TAESD兼容SD1/2、SDXL、SD3和FLUX.1等多种模型，已整合到主流AI绘画工具中。该工具适用于实时预览图像生成过程和替代官方VAE的场景。尽管在细节还原方面稍有欠缺，TAESD通过轻微的质量损失换取了显著的速度和便利性提升。

ArtLine - 自动生成精美肖像线条艺术的开源项目

AI绘图ArtLineControlNetGithub开源项目线描艺术自注意力机制

ArtLine项目旨在自动生成精美的肖像线条艺术。整合了ControlNet与ArtLine，该模型不仅能识别面部特征，还能根据指令调整图像风格。项目采用自注意力机制、渐进式缩放和感知损失技术，使其在不同姿态和背景下表现出色。项目持续改进，将解决背景和阴影识别问题，提供更好的用户体验。

control_v11p_sd15_lineart - 基于ControlNet的Stable Diffusion线稿生成控制模型

AI图像生成ControlNetGithubHuggingfaceStable Diffusion图像处理开源项目机器学习模型

ControlNet v1.1 lineart是Stable Diffusion的线稿控制模型，通过输入线稿图像实现对生成结果的精确引导。该模型基于OpenRAIL许可证开源，支持草图转成品图像、线稿自动上色等功能，可与Stable Diffusion v1-5完美集成。作为专业的AI图像生成工具，它为数字艺术创作提供了更精准的控制方式。

LLMGA - 用于精确图像生成和编辑的多模态大语言模型

ECCV2024GithubLLMGA图像生成多模态大模型开源项目

LLMGA基于多模态大语言模型，提供图像生成与编辑解决方案。结合Stable Diffusion和详细语言生成提示，项目提升了上下文理解并减少生成过程中的噪音，增强图像内容的精度。LLMGA支持文本到图像（T2I）、补画、扩画及指令编辑，适用于Logo设计、海报制作和故事绘本生成，支持中英文指令。广泛的模型和数据集选择满足不同需求，是理想的图像生成和编辑助手。

AI Drawing Generator - AI在线工具将简单涂鸦转换为精细图像

AI工具AI绘图ControlNetStable Diffusion图像生成条件控制

该在线AI图像生成工具采用ControlNet技术，能将简单涂鸦转换为精细图像。支持边缘图、分割图和关键点等多种输入条件。用户只需上传涂鸦并添加描述，即可生成高质量图像。工具主要用于教育和创意领域，有效帮助用户将创意概念可视化。

epiCCartoon - 创新的动漫风格图像生成模型

GithubHuggingfaceStable DiffusionepiCCartoon动漫开源项目文本到图像模型渲染

利用整合Color101VAE的模型，提供高质量的图像生成，支持动画渲染和稳定扩散。工具重点在文字到图像的转换，为创作者提供多样生成风格。探索epiCCartoon模型的应用，发掘AI技术带来的无尽创意潜力。

OpenDalleV1.1 - 超越SDXL性能的开源AI文生图模型

GithubHuggingfaceOpenDalleV1.1Stable Diffusion人工智能绘画图像生成开源项目模型深度学习

OpenDalleV1.1是一个开源AI图像生成模型，比SDXL具有更强的性能表现。模型在图像真实感和艺术风格方面表现突出，能够准确解析提示词并生成对应图像。基于独特的模型合并方法开发，仅限个人非商业使用，支持diffusers框架部署，通过推荐参数配置可生成细节丰富的图像。

Tune-A-Video - 图像扩散模型微调实现高质量文本到视频转换

GithubTune-A-Video人工智能开源项目扩散模型文本生成视频计算机视觉

Tune-A-Video项目通过微调预训练的文本到图像扩散模型，实现高质量文本到视频生成。该方法仅需一个视频-文本对作为输入，即可快速适应新的视频生成任务。支持Stable Diffusion等多种预训练模型，能生成多样化风格的视频内容。项目开源代码实现，提供在线演示和预训练模型，为研究和开发提供便捷的文本到视频生成工具。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能，包括文生视频、动态画面和形象生成等，帮助用户快速上手，创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台，用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品，帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型，为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能，满足事务性工作的高频需求，帮助撰稿人节省精力，提高效率，优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号