Project Icon

DeepSpeed-MII

开源低延迟模型推理库

DeepSpeed-MII是一款开源Python库,专注于高吞吐量、低延迟和成本效益的模型推理。支持的技术包括块状KV缓存、连续批处理、高性能CUDA内核等,适用于37000多个模型,如Llama-2、Mixtral和Phi-2。v0.2版本提升了性能和功能,吞吐量提高至2.5倍。适用于语言模型及图像生成任务。

Llama-3.2-1B-Instruct-bnb-4bit - Unsloth技术加速大型语言模型微调
GithubHuggingfaceLlama 3.2TransformersUnsloth开源项目性能优化模型模型微调
本项目展示了利用Unsloth技术微调Llama 3.2等大型语言模型的方法。该技术可将微调速度提升2-5倍,同时降低70%内存占用。项目为Llama 3.2、Gemma 2和Mistral等多个模型提供免费Google Colab笔记本,便于用户进行模型微调。这一方法适合各层级用户,能有效提升模型训练效率。
DeepSeek-Coder-V2-Instruct - 高性能开源MoE代码语言模型支持338种编程语言
AI编程DeepSeek-Coder-V2GithubHuggingface大型语言模型开源模型开源项目模型混合专家模型
DeepSeek-Coder-V2是一个开源的MoE代码语言模型,通过6万亿token的额外预训练,大幅提升了编码和数学推理能力。该模型支持338种编程语言,具有128K的上下文长度,在多项标准基准测试中表现优异。DeepSeek-Coder-V2不仅在代码相关任务中媲美GPT4-Turbo,还在某些方面超越了多个知名闭源模型。
Llama-3.2-1B-Instruct-GGUF - Llama 3.2语言模型微调加速与优化工具
GithubHuggingfaceLlama-3.2人工智能大语言模型开源项目模型模型训练自然语言处理
该项目针对Meta的Llama 3.2-1B-Instruct模型提供开源微调解决方案。通过Unsloth技术,实现2-5倍训练速度提升和70%内存节省。项目提供多种量化版本的GGUF模型文件,支持Llama 3.2、Gemma 2等主流大语言模型。免费Google Colab笔记本便于用户进行微调和部署。适合需要高效定制大语言模型的开发者和研究人员使用。
DeepSeek-LLM - 多语言大模型展现卓越编码与数学能力
DeepSeek LLMGithub人工智能开源开源项目自然语言处理语言模型
DeepSeek LLM是一个包含67亿参数的先进语言模型,经过2万亿英文和中文token的训练。该模型在推理、编码、数学和中文理解等方面表现优异,超越多个同类模型。其67B Chat版本在编码和数学方面尤为出色,在HumanEval和GSM8K等基准测试中名列前茅。项目开源了7B和67B的base与chat版本,可用于学术和商业研究。
nn-Meter - 准确预测深度神经网络边缘设备推理延迟的系统
Githubnn-Meter延迟预测开源项目深度学习神经网络边缘计算
nn-Meter是一个用于预测深度神经网络模型在边缘设备上推理延迟的系统。其核心是将模型推理分解为内核级别进行预测。系统在26000个模型的数据集上评估了4个主流平台,在移动CPU、GPU和VPU上达到较高预测精度。无需部署即可预测延迟,可用于硬件感知的神经架构搜索,并支持构建自定义设备的延迟预测器。
fasterai - 开源工具库助力神经网络缩小与加速
FasteraiGithub剪枝开源项目模型压缩神经网络稀疏化
fasterai是一个致力于优化神经网络规模和速度的开源库。该库提供稀疏化、剪枝、知识蒸馏和彩票假设等多种网络压缩技术。其核心特性为高度可定制的稀疏化功能,允许用户调整粒度、上下文、标准和调度。此外,fasterai还包含正则化和知识蒸馏功能,有助于提升模型性能和效率。该库与fastai兼容,可轻松集成到现有深度学习工作流程中。
llama-3-8b-bnb-4bit - 大语言模型微调工具提升训练速度并降低内存使用
AI训练GithubHuggingfaceLlama 3MetaUnsloth大语言模型开源项目模型
llama-3-8b-bnb-4bit项目是一种高效的大语言模型微调方法,能将训练速度提升2-5倍,同时减少70%内存使用。支持Llama 3.1、Gemma 2和Mistral等热门模型,并提供面向初学者的Google Colab笔记本。用户可以快速微调模型并导出为GGUF、vLLM格式或上传至Hugging Face。该工具降低了LLM微调的门槛,为开发者和研究者提供了便利。
mistral-7b-instruct-v0.3 - 高效finetune解决方案,减少内存占用提升速度
GithubHuggingfaceMistralUnsloth开源项目性能提升模型神经网络调优
这款通过Unsloth技术的Google Colab笔记本集合,简化了Mistral、Gemma和Llama等AI模型的finetune过程。简单操作即可提高模型速度超过两倍,并显著降低内存占用,同时允许将优化的模型导出为GGUF、vLLM,或上传至Hugging Face,适合初学者使用。
modelz-llm - 开源大语言模型推理服务器,支持本地和云端部署并兼容OpenAI API
GithubModelz LLMOpenAI兼容 API云原生开源LLMs开源项目自托管
Modelz LLM 是一款推理服务器,支持在本地或云端环境中运行开源大语言模型(LLM),如FastChat、LLaMA和ChatGLM,并兼容OpenAI API。用户可以通过OpenAI Python SDK或LangChain与模型交互,支持将不同LLM的Docker镜像部署在Kubernetes等云原生环境,便于开发者快速上手和灵活部署各种AI应用。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号