Project Icon

aphrodite-engine

开源高性能语言模型推理引擎

Aphrodite是一个开源的语言模型推理引擎,采用vLLM的分页注意力机制实现高效推理。它支持连续批处理、多种量化方法和分布式推理,可为大规模用户提供快速服务。该引擎还具备多种采样方法和8位KV缓存,能够处理更长的上下文并提高吞吐量。Aphrodite目前作为PygmalionAI的官方后端引擎使用。

ai00_server - 基于RWKV模型的高效且易用的推理API服务器
AI00 RWKV ServerChatGPT兼容GithubLLM推理Vulkan加速开源开源项目
AI00 RWKV Server是一款高效且易用的推理API服务器,基于RWKV模型,支持Vulkan兼容的所有GPU进行加速,包括AMD显卡和集成图形。无需依赖庞大的pytorch或CUDA环境,开箱即用,并兼容OpenAI的ChatGPT API接口。此服务器完全开源和商用友好,适用于文本生成、翻译、问答等多种任务,是开发大语言模型应用的理想选择。
Athina AI - 全栈AI应用开发与管理平台
AI工具AI应用开发AthinaLLM评估实验原型生产监控
Athina AI为团队提供AI应用开发和管理平台,10倍加速AI功能生产部署。其IDE工具支持快速实验、原型设计和评估,具备多模型比较、数据集管理和动态列转换功能,显著提升AI应用开发效率。平台提供企业级控制,包括自托管部署、角色访问控制和多工作区,保障数据安全。适用于各规模团队,从初创公司到大型企业,帮助快速实现AI功能落地。
Phi-3-mini-4k-instruct-gguf - 轻量级通用AI模型支持推理分析与代码生成
GithubHuggingfacePhi-3人工智能大语言模型开源项目机器学习模型模型训练
Phi-3-mini-4k-instruct-gguf采用GGUF格式实现的轻量级语言模型,具备3.8B参数规模和4K上下文长度支持。该模型在常识理解、数学计算、代码生成等方面表现突出,适合在计算资源受限环境下运行。模型经过安全性优化,可用于英语场景的商业及研究应用。
Delphic - 使用LlamaIndex构建和部署大型语言模型(LLM)代理的简单框架
DelphicDjangoDockerGithubLangchainOpenAI开源项目
Delphic是一个使用LlamaIndex构建和部署大型语言模型(LLM)代理的简单框架,可用于分析和处理文档中的文本数据。虽然框架基于OpenAI的API,但兼容其他LLM,例如Langchain,支持使用Postgres作为向量存储,并通过Docker Compose实现快速本地部署。虽然Delphic项目目前不再维护,但它作为构建流式响应应用的概念验证工具仍具有参考价值。
speculative-decoding - 推测解码技术,优化大型语言模型推理速度
GithubSpeculative Decoding大语言模型开源项目性能优化推理加速自然语言处理
该开源项目聚焦于推测解码技术的研究与实现,旨在提升大型语言模型的文本生成效率。项目涵盖了多种推测解码策略,包括提前退出、推测采样和先知变压器。同时,项目致力于优化批处理推测解码,以增强整体性能。研究计划还包括对比不同策略的效果,并探索微观优化方法。这些工作为加快AI模型推理速度提供了新的技术思路。
Tess-v2.5-Phi-3-medium-128k-14B - 提高大型语言模型指令处理的效率与准确性
AxolotlGithubHuggingfacemicrosoft/Phi-3-medium-128k-instruct中等模型开源开源项目模型
Tess-v2.5-Phi-3-medium-128k-14B基于微软的Phi-3模型,利用Axolotl平台提升其指令理解和生成能力。通过优化模型结构,提高用户交互的精准性,从而提升文本生成质量。
OpenHermes-2.5-Mistral-7B-AWQ - 使用AWQ方法提升Transformer推理速度的低位量化技术
AI模型GithubHuggingfaceOpenHermes-2.5-Mistral-7B人机对话合成数据开源项目模型量化
AWQ通过4-bit量化提供高效、快速的Transformer推理体验,与GPTQ相比具有更优性能。它在Text Generation Webui、vLLM、Hugging Face的Text Generation Inference和AutoAWQ等多个平台上支持,为AI应用带来了显著的性能提升,适用于多用户推理服务器的开发以及Python代码中的集成使用。
phoenix - AI应用开发的全方位观测与评估工具
AI观察平台GithubLLM评估Phoenix开源项目数据可视化
Phoenix是一款开源AI观测平台,为大语言模型应用提供全面的跟踪、评估和实验功能。该平台集成了OpenTelemetry跟踪、LLM性能测试、数据集管理、实验记录和推理分析等特性。Phoenix支持主流AI框架和LLM服务,适用于本地和云端环境,为AI开发人员提供了强大的实验、评估和问题诊断能力。
Aidget - 边端AI算法部署工具链 高性能推理和自动化模型压缩
AidgetGithub开源项目模型压缩深度学习推理引擎边端AI高性能计算
Aidget是一款边端AI算法部署工具链,集成高性能深度学习推理引擎和模型自动化压缩功能。适用于多种边端系统和平台,支持ONNX和TFLite等多种模型格式。特点包括轻量级部署、强通用性、易用性和高性能推理。已在智能家电领域得到实际应用,有效解决AI算法部署中的资源限制、性能优化和跨平台兼容性等问题。
Entry Point AI - 现代化大语言模型优化与管理平台
AI优化平台AI工具AI应用场景Entry Point AILLM提供商语言模型微调
Entry Point AI为专有和开源语言模型提供优化服务。平台集成了提示词管理、模型微调和性能评估功能,支持多家领先AI模型提供商。用户无需编码即可进行模型微调,同时平台提供团队协作、模板编写和数据导入导出等功能。Entry Point AI致力于帮助用户规避常见问题,提升模型质量和效率。该平台适用于内容生成、数据分类、信息提取和优先级排序等多种商业应用场景。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号