Project Icon

frugally-deep

在C++中运行Keras模型,无需依赖TensorFlow的小型的头文件库

frugally-deep是一个小型的头文件库,允许在C++中运行Keras模型进行预测而无需依赖TensorFlow。它依赖于FunctionalPlus、Eigen和json头文件库,支持复杂的模型拓扑,并显著减小二进制大小。项目特点包括支持多种层类型、节省RAM以及通过并行处理提高预测性能。frugally-deep在单核CPU上表现相对较快,适合内存敏感和需要快速部署的应用。

Phi-3-mini-128k-instruct-onnx-tf - 多平台高性能运行的指令微调大语言模型优化版本
AI模型GithubHuggingfaceONNXONNXRuntimePhi-3开源项目模型模型优化
该项目提供Phi-3-mini-128k-instruct模型的ONNX优化版本,支持多种设备和平台高性能推理。模型适配CPU、GPU和移动设备,提供不同精度版本。经指令微调和安全优化,推理能力出色。项目配备ONNX Runtime Generate API,便于开发集成。与PyTorch相比,ONNX版本性能全面提升,FP16 CUDA版本最高提速5倍,INT4 CUDA版本最高提速9倍。
Phi-3.1-mini-128k-instruct-GGUF - 量化指导优化内存资源使用
GithubHuggingfacePhi-3-mini-128k-instruct下载文件开源项目模型模型选择量化高质量
项目利用llama.cpp和imatrix技术对模型进行量化,提供适合不同内存需求的文件。用户可通过huggingface-cli根据硬件选择量化格式,实现速度与质量平衡。同时,项目提供特性图表以指引用户选择‘I-quant’或‘K-quant’方法,满足不同硬件环境性能要求。
deepseek-coder-6.7B-instruct-GGUF - Deepseek全新GGUF格式 高效代码智能助手专注计算机科学
Deepseek Coder 6.7B InstructGPU加速GithubHuggingface开源项目模型模型格式计算机科学量化
DeepSeek引入新型GGUF格式,提供高效代码助手,专注计算机科学问题。该模型经Massed Compute硬件进行量化优化,兼容llama.cpp、text-generation-webui及KoboldCpp等多种框架,并支持GPU加速。用户能接触到从小尺寸到高保真度的量化模型文件,多样化应用场景支持丰富。资源库还提供未量化的DeepSeek原始fp16模型及适用于GPU推理的AWQ和GPTQ模型。
DeepSeek-Coder-V2-Lite-Base-GGUF - 文本生成量化模型的高效选择方案
DeepSeek-Coder-V2-Lite-BaseGithubHuggingfacegguf格式开源项目文件下载模型量化高质量模型
该项目通过llama.cpp和imatrix技术对文本生成模型进行量化处理,为不同硬件配置提供优化选择。模型文件允许根据RAM和VRAM大小选择最佳方案,从而提升运行效率。K-quants在多数应用中表现理想,而I-quants提供更优性能但在硬件兼容性上有特定要求。项目提供的工具和文档为用户在进行文本生成任务的过程中提供指导,帮助选择兼顾速度与质量的量化模型。
Keras-TextClassification - 多样预训练模型支持的高效文本分类工具
GithubKeras-TextClassification嵌入式模型开源项目文本分类深度学习神经网络
为中文用户提供高效的文本分类解决方案,支持FastText、BERT、Albert等多种预训练模型,涵盖词、字、句子嵌入。详细介绍数据处理与模型训练流程,通过下载与调用数据,实现多标签分类和文本相似度计算,简化复杂的自然语言处理任务。
AutoFP8 - 量化库优化大语言模型推理性能
AutoFP8FP8量化GithubvLLM开源项目模型压缩神经网络
AutoFP8是一个开源FP8量化库,用于生成vLLM兼容的压缩检查点。它提供FP8_E4M3精度的量化权重、激活和KV缓存比例,支持静态和动态激活方案。AutoFP8能将预训练模型转换为FP8格式,与vLLM无缝集成,提高大语言模型推理效率,同时保持模型精度。这个工具适用于优化和部署大规模语言模型。
carefree-learn - 简化深度学习流程,支持PyTorch高效训练与推理
AI模型GithubMIT许可PyTorchdeep learning开源项目模块化
carefree-learn项目致力于简化深度学习流程,特别是基于PyTorch的训练与推理。采用模块优先、原生兼容的设计原则,支持AI模型推理,符合现代AI的发展趋势,并遵循MIT许可证。项目提供易于使用的接口和高性能模块,适合开发者与使用者。
onnxruntime - 跨平台的机器学习模型推理与训练加速工具
GithubONNX Runtime开源项目机器学习模型训练深度学习硬件加速
ONNX Runtime是一款跨平台的机器学习推理和训练加速工具,兼容PyTorch、TensorFlow/Keras、scikit-learn等深度学习框架及传统机器学习库。它支持多种硬件和操作系统,通过硬件加速和图优化实现最佳性能,显著提升模型推理和训练速度,尤其在多节点NVIDIA GPU上的Transformer模型训练中表现出色。
DeepSpeed - 大模型的训练工具
AI工具AI开发AI系统技术DeepSpeed大规模训练模型压缩模型训练热门高性能计算
DeepSpeed是一个先进的深度学习优化工具库,专门设计用于简化和增强分布式训练。通过一系列创新技术,如ZeRO、3D并行处理、MoE和ZeRO-Infinity,DeepSpeed能大幅提高训练速度,同时降低成本。这些技术支持在数千GPU上扩展模型训练,并实现低延迟和高吞吐量的推理性能。DeepSpeed同时提供了先进的模型压缩技术,优化模型存储与推理效率,是大规模AI模型训练和推理的优选方案。
model-optimization - TensorFlow 模型优化工具包, 支持量化和稀疏化
GithubKerasTensorFlow Model Optimization Toolkit剪枝开源项目机器学习模型量化
TensorFlow Model Optimization Toolkit 提供稳定的 Python API,帮助用户通过量化和稀疏化技术优化机器学习模型,包括针对 Keras 的专用 API。该工具包还提供详细的安装指南、教程和 API 文档,显著提升模型在部署和执行时的性能。该项目由 TensorFlow 团队维护,并遵循其行为准则,开发者可以通过 GitHub 提交问题和贡献代码。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号