DanTagGen-delta

改进标签生成与艺术图像多样性的开源项目

HakuPhi 模型 Github 开源项目文本生成 LLaMA DanTagGen 龙女 Huggingface

DanTagGen-delta项目在HakuBooru数据库的支持下，利用NanoLLaMA架构和7.2M数据集进行训练，适用于LLaMA推理接口。引入质量标签的新版本增强了图像多样性，尽管存在轻微欠拟合。项目提供FP16与低比特量化模型，建议使用llama.cpp提升运行效率。

Huggingface

介绍相关项目

DanTagGen-delta-rev2 - 开源二次元图像标签生成模型支持多平台部署

DanTagGenGithubHuggingface人工智能图像标签生成开源项目机器学习模型深度学习

DanTagGen-delta-rev2是一款专注于动漫图像标签生成的开源工具。通过输入图像质量、评分和艺术家等参数，可快速生成相应标签，广泛应用于AI绘画和数据集标注。项目支持llama.cpp和HuggingFace Space等多种部署方式，并集成了SD-WebUI扩展和ComfyUI节点等实用工具。相比前代版本，新版本在标签多样性和稳定性方面有显著提升。

DanTagGen-alpha - 高效艺术标签生成工具，支持多种模型格式

DanTagGenGithubHuggingface开源项目数据集标签生成器模型模型架构训练

DanTagGen-alpha是一款基于NanoLLaMA架构的艺术标签生成工具，拥有400M参数，支持通过llama.c和llama-cpp-python进行高效推理，并兼容FP16、量化8位和6位模型格式。该项目采用精细数据过滤和6至12亿标记训练策略，支持多种应用场景。开发中的Gradio UI和API为其他开发者提供了丰富的扩展机会。

DanTagGen-beta - AI图片标签生成器助力精准艺术创作

AI绘图DanTagGenGithubHuggingface开源项目数据集模型深度学习生成模型

DanTagGen-beta是一款基于LLaMA架构的AI标签生成器，专为Danbooru风格的AI艺术创作设计。通过5.3M数据集训练，该工具能够根据基础标签智能推荐相关标签，有效提升生成图像的质量和细节。DanTagGen-beta支持多种部署方式，包括llama.cpp和量化模型，为AI艺术创作者提供了高效的标签辅助工具。

LlamaGen - 自回归模型在图像生成中的应用和优势

AR模型GithubHugging FaceLlamaGen图像生成开源项目自回归模型

LlamaGen项目展示了自回归模型在图像生成中的潜力，通过无偏视觉信号和大规模数据训练，实现了媲美扩散模型的性能。该项目发布了多种图像tokenizer和生成模型，支持从100M到3B参数的多种配置，并提供在线演示和高效的vLLM服务框架。访问项目页面和在线demo，体验这些创新模型的强大功能。

DeepDanbooru - AI动漫图片标签预测工具

DeepDanbooruGithubPythonTensorflow动漫图像标签开源项目训练项目

DeepDanbooru是一个用Python实现的AI工具，用于对动漫风格图片进行标签预测。通过TensorFlow进行训练和评估，支持使用Danbooru数据集或自定义数据集进行操作。

wd-vit-tagger-v3 - 图像评分与标签处理的高效解决方案

DanbooruGithubHuggingfaceWD ViT Tagger开源项目标签模型训练

WD ViT Tagger v3是一个针对 Danbooru 图像数据集的开源项目，支持图像评分、角色和标签的处理。v2.0版本通过类不平衡损失缩放技术改进了模型精度；v1.1 修订 JAX 模型配置，增加图像尺寸定义；v1.0 增加训练图像和更新标签，兼容 timm 和 ONNX，对批处理大小没有固定要求，并使用 Macro-F1 衡量模型性能。

LLMGA - 用于精确图像生成和编辑的多模态大语言模型

ECCV2024GithubLLMGA图像生成多模态大模型开源项目

LLMGA基于多模态大语言模型，提供图像生成与编辑解决方案。结合Stable Diffusion和详细语言生成提示，项目提升了上下文理解并减少生成过程中的噪音，增强图像内容的精度。LLMGA支持文本到图像（T2I）、补画、扩画及指令编辑，适用于Logo设计、海报制作和故事绘本生成，支持中英文指令。广泛的模型和数据集选择满足不同需求，是理想的图像生成和编辑助手。

wd-v1-4-swinv2-tagger-v2 - 带有改进推理和标签分类性能的新特性

GithubHuggingfaceONNXRuntimeWD 1.4 SwinV2 Tagger开源项目标签模型训练

模型WD 1.4 SwinV2 Tagger V2改进了标签分类功能，使用Danbooru图像集进行训练，V2.1版本增强了ONNXRuntime兼容性，并与timm兼容，支持多批次推理。使用TRC项目提供的TPU部署，提升模型的性能和算法效果。

joytag - 多标签AI图像标记模型支持5000+标签

AI视觉模型GithubJoyTagViT架构图像标签多标签分类开源项目

JoyTag是基于ViT-B/16架构的AI视觉模型，专用于图像多标签分类。采用Danbooru标记体系，支持5000多个标签，适用于手绘和摄影等多种图像类型。模型在0.4阈值下F1分数达0.578，能为每张图像生成独立标签预测。可用于diffusion模型训练等多种应用场景。

codegemma-1.1-7b-it-GGUF - 文本生成的多样化量化模型选择

GithubHugging FaceHuggingfacetransformers开源项目文本生成模型模型下载量化

项目使用llama.cpp进行模型量化，提供多种模型版本以优化文本生成性能。用户可以依据硬件配置选择合适的模型版本，推荐选用Q6_K等高质量量化格式。多样化的模型版本在内存占用和性能表现之间提供灵活选择，适用于多种硬件平台。I-quant模型在较低量化级别上表现优异，适合需要高效运行的场景。

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com