Project Icon

tiny-dream

轻量级 Stable Diffusion C++ 推理库

Tiny Dream 是一个轻量级的 Stable Diffusion C++ 实现,仅包含头文件且无外部依赖。该库专注于提高 CPU 效率和减少内存占用,在普通硬件上即可高效运行。Tiny Dream 内存需求低,支持多种高级功能,并提供简洁的 C++ API,便于集成到现有项目中。

k-diffusion - 扩散模型框架支持多种采样算法和模型架构
GithubPyTorchk-diffusiontransformer开源项目注意力机制生成模型
k-diffusion是一个基于PyTorch的扩散模型实现框架。它支持分层Transformer模型、多种采样算法和Min-SNR损失加权。该框架提供模型包装器、CLIP引导采样功能,以及对数似然、FID和KID等评估指标的计算。k-diffusion为扩散模型研究和应用提供了实用工具。
autodiff - 高效直观的C++17自动微分库
C++库Githubautodiff导数计算开源项目自动微分表达式树
autodiff是一个C++17自动微分库,通过现代编程技术实现高效的导数计算。支持前向和反向模式,只需少量代码修改即可处理复杂函数。该库适用于机器学习、优化和科学计算领域,为开发者提供灵活的自动微分功能。
dreamtalk - 音频驱动的表情丰富说话头像生成系统
AI表情生成DreamTalkGithub开源项目扩散模型生成说话人头像音频驱动
DreamTalk是一个创新的音频驱动说话头像生成系统,采用扩散概率模型技术。该系统能生成高质量、表情丰富的说话头像视频,适应多种说话风格。DreamTalk在处理歌曲、多语言语音、噪声音频和非常规肖像等多样化输入时表现优异。通过结合扩散概率模型,DreamTalk实现了准确的唇形同步和生动的面部表情,为不同说话风格提供了灵活支持。
DiffSynth-Studio - 多功能扩散模型引擎 支持长视频合成与图像生成
AI绘画DiffSynth StudioGithub图像合成开源项目扩散模型视频生成
DiffSynth Studio是一款开源的扩散模型引擎,整合了ExVideo、Stable Diffusion 3和Kolors等多种AI模型。该引擎支持长视频合成、高分辨率图像生成、卡通渲染和视频风格化等功能。项目持续更新,重点探索扩散模型在视频合成领域的应用潜力。
Live2Diff - 革新视频扩散模型的实时流翻译技术
AI模型GithubLive2Diff实时流处理开源项目扩散模型视频翻译
Live2Diff是一款基于视频扩散模型的实时流翻译工具。该项目采用单向时间注意力机制,结合多时间步KV缓存和深度先验技术,实现高效的视频处理。支持DreamBooth和LoRA风格迁移,并通过TensorRT优化性能。在512x512分辨率下,处理速度可达16.43 FPS,为实时视频翻译领域提供了新的技术方案。
Stable Diffusion 3 - 探索Stable Diffusion 3的高级文本到图像生成能力
AI工具AI绘图Stable Diffusion 3人工智能图像质量文本生成图像
Stable Diffusion 3是Stability AI开发的先进文本到图像模型,在图像质量、多主题处理和文本遵循方面有显著提升。本站提供免费在线体验,用户可通过文本提示生成高质量图像。网站详细介绍了Stable Diffusion 3的核心特性,并提供API接口和下载选项,满足开发者和研究人员的不同需求。探索AI驱动的图像生成新境界,体验Stable Diffusion 3的强大功能。
tinyusdz - 轻量级跨平台USD文件处理库
C++14GithubTinyUSDZUSDAUSDCUSDZ开源项目
TinyUSDZ是一个C++14实现的USDZ/USDC/USDA文件处理库。它具有轻量级、安全和跨平台特性,仅依赖C++ STL。支持Linux、Windows、macOS、iOS、Android和WebAssembly平台。该库重视安全性,提供内存预算功能防范恶意文件。目前支持基本USD元素,正在开发高级功能。
stallion-dreams-pony-realistic-v1-sdxl - 文字到图像的真实感小马生成模型
GithubHuggingfaceStable DiffusionStallion Dreams图像处理开源项目文本生成图像模型照片现实主义
项目利用Stable Diffusion技术,专为生成真实感小马图像而设计,提供文字到图像的转换功能。模型使用diffusers库,在生成写实图像方面表现优异,适合对逼真效果有需求的创作者和开发者。
blended-diffusion - 使用自然语言进行图像局部编辑的工具
Blended DiffusionCLIPDDPMGithub图像编辑开源项目自然语言描述
Blended Diffusion 是一种利用自然语言和ROI掩模进行图像局部编辑的工具。结合了CLIP预训练语言-图像模型和DDPM去噪扩散模型,实现了高效的自然图像编辑。它可以保持背景完整,并无缝融合编辑区域,减少对抗性结果。功能包括新增物体、移除/替换/改变现有物体、背景替换和图像外推。相关代码和模型已开放下载,供用户探索。
Stable Diffusion Web - 创新的人工智能图像和头像创作工具
AI工具Vercel产品反馈图像处理用户评价软件工程
Stable Diffusion Web平台采用先进的Stable Diffusion技术,是领先的AI生成艺术和AI头像生成器。支持用户通过文本输入在几秒钟内快速生成逼真图像和定制头像。平台提供超过1000万个创作提示,激发无限灵感。作为免费开源工具,已吸引全球55,000多名用户。无论是专业创作者还是普通爱好者,都可在此释放创意,探索人工智能艺术的无限可能。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号