Project Icon

SRe2L

创新的ImageNet规模数据集压缩技术

SRe2L项目提出了一种新颖的大规模数据集压缩方法,通过'挤压'、'恢复'和'重新标记'三个步骤实现ImageNet规模数据的高效压缩。该方法在NeurIPS 2023会议上获得spotlight展示,为数据集蒸馏领域带来新的研究视角。项目还包括SCDD和CDA等相关工作,共同推动数据集蒸馏技术在大数据时代的应用和发展。

lang-seg - 语言驱动的零样本语义图像分割模型
CLIPGithubLSeg开源项目计算机视觉语义分割零样本学习
LSeg是一种语言驱动的语义图像分割模型,结合文本编码器和Transformer图像编码器。它能将描述性标签与图像像素对齐,实现高效零样本分割。LSeg在多个数据集上表现出色,无需额外训练即可泛化到新类别。该模型在固定标签集上可与传统算法媲美,为语义分割任务提供了灵活有力的解决方案。
Real3D - 基于真实图像的大规模3D重建模型
3D重建GithubReal3D开源项目深度学习自监督学习计算机视觉
Real3D是一种创新的大规模3D重建模型系统,首次实现了使用单视图真实图像进行训练。该系统采用自训练框架,结合3D/多视图合成数据和单视图真实图像,并引入两种无监督损失函数,实现像素和语义层面的模型监督。在包含真实和合成数据、域内和域外形状的四种评估场景中,Real3D均显著优于现有方法。
regnety_120.sw_in12k_ft_in1k - 高级图像分类模型,优化大规模数据集的性能
GithubHuggingfaceRegNetY图像分类开源项目数据集模型特征提取预训练
RegNetY-12GF模型致力于图像分类,先在ImageNet-12k上预训练,再在ImageNet-1k上微调。其结构支持多项增强功能,如随机深度和梯度检查点,提高模型准确性和效率。基于timm库实现,广泛用于特征图提取和图像嵌入,适用于多种图像处理场景。
lcm-lora-sdxl - Stable Diffusion XL模型的低步数推理加速适配器
GithubHuggingfaceLCM-LoRASDXL图像生成开源项目模型深度学习生成式AI
lcm-lora-sdxl是为Stable Diffusion XL模型开发的加速适配器,可将推理步骤减少到2-8步。它支持文本生成图像、图像修复和ControlNet等功能,并能与其他LoRA模型结合。项目提供了使用指南和示例代码,适合需要快速AI图像生成的场景。
convnext_large_mlp.clip_laion2b_soup_ft_in12k_in1k_320 - ConvNeXt大型图像分类模型 LAION-2B预训练 ImageNet微调
ConvNeXtGithubHuggingfaceImageNetLAION-2Btimm图像分类开源项目模型
ConvNeXt大型图像分类模型采用CLIP方法在LAION-2B数据集上预训练,并在ImageNet-12k和ImageNet-1k上微调。模型包含2亿参数,320x320输入下top-1准确率达87.968%。支持图像分类、特征提取和嵌入等任务,可应用于多种计算机视觉场景。
iSeeBetter - 时空融合视频超分辨率方法
GithubPyTorch图像质量开源项目深度学习生成对抗网络视频超分辨率
iSeeBetter是一种新型视频超分辨率算法,结合循环生成反投影网络和SRGAN,从相邻帧中提取时空信息。采用四重损失函数优化模型,在多数场景下超越现有方法,实现更高质量的视频放大效果。该方法融合了单帧和多帧超分辨率技术,为视频画质提升提供了新的解决方案。
sparsegpt - 开源项目实现大型语言模型高效压缩
GithubSparseGPT开源项目模型压缩神经网络剪枝稀疏化语言模型
SparseGPT是一个致力于大型语言模型压缩的开源项目。它提供了一套工具,可在单次操作中对OPT、BLOOM和LLaMA等大规模语言模型进行精确剪枝。该项目支持非结构化、n:m结构化和稀疏量化压缩方法,并包含在WikiText2、PTB和C4子集上评估模型性能的脚本。SparseGPT能有效缩减模型规模的同时保持准确性,为研究人员和开发者提供了探索语言模型压缩的实用工具。
self-speculative-decoding - 无损加速大型语言模型的创新推理方案
GithubLLM加速Self-Speculative Decoding层跳过开源项目推理优化草稿验证
Self-Speculative Decoding是ACL 2024的一个开源项目,提出了一种无损加速大型语言模型(LLMs)的新方法。该技术通过草稿生成和验证两个阶段,在不增加额外训练和内存的情况下提高LLM推理速度。这一创新方案保证了输出质量和模型兼容性,为LLM加速提供了高效且易于实施的解决方案。
litdata - 优化数据处理和流式传输工具 提升AI模型训练效率
GithubLitData云存储开源项目数据优化数据处理模型训练
LitData是一个开源的数据处理和优化工具,专注于提升AI模型训练效率。它提供并行数据处理、向量嵌入创建、分布式推理和大规模网站抓取功能。LitData优化数据集以加速模型训练,支持云端大规模数据流式传输,并实现远程数据的无本地加载使用。这些特性使LitData成为提高数据处理效率和AI模型训练速度的有力工具。
lora - 使用低秩自适应技术进行快速稳定扩散模型微调
DreamboothGithubHuggingfaceLoRAPivotal TuningStable Diffusion开源项目
该项目使用低秩自适应技术进行快速稳定扩散模型微调,比dreambooth方法快两倍,支持inpainting,并且生成非常小的模型文件(1MB~6MB),便于共享和下载。兼容diffusers库,提供多向量核心调优反演功能,并实现更好的性能。项目集成了Huggingface Spaces,增加了LoRA合并、Resnet应用和转换脚本功能。通过仅微调模型的残差,该方法显著缩小模型大小,同时保持高保真度,适用于需要快速高效微调的用户。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号