Project Icon

llm-analysis

大型语言模型训练与推理的延迟和内存使用分析工具

llm-analysis 是一款为大型语言模型(LLMs),如Transformer设计的工具,用于在不同的模型、GPU、数据类型和并行配置下估算训练与推理的延迟和内存使用。通过简单设置,可以快速计算出不同训练和推理方案的系统性能,以确定最优和可行的配置方案。此外,llm-analysis 支持多种并行化和重计算策略,并提供多种预定义配置和命令行接口,极大简化了配置和调试流程。它功能强大且易于集成,是开发和优化LLMs的理想工具。

llama-2-7b-chat-bnb-4bit - 开源LLM模型训练加速工具实现2至5倍速提升并节省70%内存
GithubHuggingfaceLlama-2Unsloth人工智能大语言模型开源项目模型模型微调
该开源项目致力于优化大语言模型的训练过程,通过创新技术为Mistral、Gemma、Llama 2等主流模型提供训练加速解决方案。基于Colab平台的多个训练笔记本支持对话及文本补全功能,可实现2-5倍的训练速度提升,并将内存占用降低70%。项目支持GGUF格式导出及vLLM、Hugging Face平台部署,为计算资源受限的AI开发团队提供了高效的模型训练方案。
llm-ls - 基于LLMs的LSP服务器
GithubLSP服务器llm-ls功能特性多后端兼容开发效率开源项目
llm-ls是一个基于LLMs的LSP服务器,致力于提升开发效率。它提供一个通用平台供IDE扩展使用,负责与LLMs的交互,支持代码AST解析、遥测数据收集和多后端兼容。llm-ls兼容Hugging Face和OpenAI API,并支持llm.nvim、llm-vscode、llm-intellij等多种扩展,帮助开发者优化IDE工具。
open-llms - 开放源代码大型语言模型及其商业应用全景解析
Apache 2.0GithubLarge Language Models商业使用许可开源开源项目模型发布
Open-llms 项目展示了众多采用开源许可证的大型语言模型(LLMs),支持商业应用,涵盖如T5、GPT-NeoX、YaLM等模型。每款模型设有详细说明及许可信息,鼓励社区交流与贡献,是机器学习研究和应用的重要资源库。
LLMTest_NeedleInAHaystack - LLM长上下文检索能力测试工具
AnthropicCohereGithubLLMsNeedle In A HaystackOpenAI开源项目
LLMTest_NeedleInAHaystack是一个用于评估长上下文语言模型检索能力的开源工具。通过在长文本中插入特定信息并要求模型检索,它可以测试OpenAI、Anthropic和Cohere等主流LLM的性能。该项目提供灵活的参数配置和结果可视化,有助于研究人员和开发者分析不同模型的上下文理解能力。
gpu_poor - LLM运行所需GPU内存及每秒处理Token数计算工具
GPU memoryLLM
该工具计算GPU/CPU运行任意LLM所需的内存和每秒处理的Token数,并提供详细的训练和推理内存分配。支持多种量化及推理框架,适用于评估GPU运行特定LLM的能力、调整量化方式及优化GPU内存使用。
autollm - 统一API的高效LLM应用开发解决方案
APIAutoLLMFastAPIGithubLLMRAG开源项目
AutoLLM 提供简化的 LLM 应用开发体验,支持 100 多种语言模型和 20 多种向量数据库,具有成本计算、快速创建 RAG LLM 引擎和 FastAPI 应用等功能。通过一行代码即可实现高效的查询引擎和 API 部署,适用于多种应用场景。
TrustLLM - TrustLLM:全面大语言模型可信度研究工具
GithubICML 2024LLMTrustLLM工具包开源项目性能评估
TrustLLM是一款专注于评估大型语言模型(LLMs)可信度的工具包。涵盖八个维度的可信度原则,并在真相、安全、公平、鲁棒性、隐私和机器伦理等方面建立基准。TrustLLM提供便捷的评估工具,可以快速评估16种主流LLMs,帮助开发者提升模型可信度。项目已被ICML 2024接受,并持续更新以包括最新的模型和功能。详情请访问项目网站。
self-llm - 开源大模型部署与应用指南
AutoDLGithub开源大模型开源项目微调方法环境配置部署使用
探索开源大模型如LLaMA、ChatGLM的全流程部署与微调指南,涵盖环境配置至应用实践,专为国内初学者设计,通过AutoDL平台简化操作流程,助力大模型技术的普及和应用。
llm.js - JavaScript实现浏览器直接运行大语言模型
GithubJavaScriptLLM.jsWebAssembly大语言模型开源项目浏览器推理
llm.js是一个JavaScript库,实现了在浏览器中直接运行大语言模型。该项目支持TinyLLaMA、GPT-2和Qwen等多种模型,利用WebAssembly技术在浏览器端进行高效推理,可在智能手机等设备上运行。llm.js提供结构化响应、Web Worker支持和模型缓存等功能,方便开发者将AI能力整合到Web应用中。
modelz-llm - 开源大语言模型推理服务器,支持本地和云端部署并兼容OpenAI API
GithubModelz LLMOpenAI兼容 API云原生开源LLMs开源项目自托管
Modelz LLM 是一款推理服务器,支持在本地或云端环境中运行开源大语言模型(LLM),如FastChat、LLaMA和ChatGLM,并兼容OpenAI API。用户可以通过OpenAI Python SDK或LangChain与模型交互,支持将不同LLM的Docker镜像部署在Kubernetes等云原生环境,便于开发者快速上手和灵活部署各种AI应用。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号