Project Icon

openai-forward

语言模型转发服务,支持本地及云端语言模型

OpenAI-Forward 提供高效的语言模型转发服务,具备用户请求速率控制、Token速率限制、智能预测缓存、日志管理和API密钥管理等功能。依托 uvicorn、aiohttp 和 asyncio 实现卓越的异步性能。支持代理本地语言模型(如 LocalAI)和云端语言模型(如 OpenAI),并通过最新版本的 WebUI 进行配置管理,提升用户体验。

model_server - 高性能AI模型部署系统 支持多框架和多设备
AI部署GithubOpenVINO Model Server开源项目微服务架构模型推理模型管理
OpenVINO Model Server是一个高性能AI模型部署系统,针对Intel架构优化。支持TensorFlow、PaddlePaddle和ONNX等多种框架,可在不同AI加速器上运行。系统通过gRPC和REST API提供服务,具备模型版本控制、动态输入和DAG调度等功能。适用于边缘计算和云环境,可提高资源利用率和推理效率。该系统还支持Python代码执行、gRPC流式传输和MediaPipe图形服务。OpenVINO Model Server适合微服务架构应用和Kubernetes环境部署,可实现水平和垂直推理扩展。
Delphic - 使用LlamaIndex构建和部署大型语言模型(LLM)代理的简单框架
DelphicDjangoDockerGithubLangchainOpenAI开源项目
Delphic是一个使用LlamaIndex构建和部署大型语言模型(LLM)代理的简单框架,可用于分析和处理文档中的文本数据。虽然框架基于OpenAI的API,但兼容其他LLM,例如Langchain,支持使用Postgres作为向量存储,并通过Docker Compose实现快速本地部署。虽然Delphic项目目前不再维护,但它作为构建流式响应应用的概念验证工具仍具有参考价值。
WebAI-to-API - 自托管API整合Google Gemini和Claude 3的统一接口方案
APIClaude 3FastAPIGithubGoogle GeminiWebAI开源项目
WebAI-to-API是一个研究性项目,为Google Gemini和Claude 3等AI模型提供统一的Web API接口。该项目支持自托管部署,具备实时流式响应功能,基于FastAPI构建,轻量且可扩展。无需API密钥即可使用,并提供Web UI配置界面。此项目适合追求灵活、高性能AI接口的开发者和研究人员。
vercel-llm-api - 免费获取多种LLM模型的API封装
API封装ChatGPTGithubLLMVercel AI Playground开源项目模型下载
这是一款经过反向工程的API封装,提供对多种大型语言模型(LLM)的免费访问,包括OpenAI的ChatGPT和Cohere的Command Nightly。用户可以下载模型、生成文本和聊天消息,自定义参数并进行流式传输。支持使用代理,但目前不支持认证和高级模型。
FastChat - 大语言模型聊天机器人开源训练与部署平台
APIFastChatGithub大语言模型开源平台开源项目聊天机器人
FastChat是一个用于训练、部署和评估基于大语言模型聊天机器人的开源平台。该平台提供先进模型的训练评估代码和分布式多模型服务系统,包含Web界面和OpenAI兼容的RESTful API。FastChat支持Vicuna、LongChat等多种语言模型,提供命令行和Web图形界面。此外,它还具备多GPU并行、CPU推理和模型量化等功能,可适配不同硬件平台。
SwiftOpenAI - Swift开源库,全面集成OpenAI、Azure、AIProxy及流媒体支持
APIGithubSwiftOpenAIiOSopen sourceswift开源项目
SwiftOpenAI是一个开源的Swift库,设计用于与OpenAI的API轻松交互,支持所有OpenAI端点。新增对Azure、AIProxy及助手流API的支持,用户只需API Key即可访问音频转录、翻译、生成、聊天、图像处理等功能。通过Swift Package Manager安装,简化集成,提供网络错误代码处理示例,方便开发者优化代码。
onprem - 本地运行大型语言模型 安全处理私密数据
GithubOnPrem.LLM代码生成向量数据库大语言模型开源项目本地部署
OnPrem.LLM是一个Python工具包,支持在本地机器上运行大型语言模型,处理非公开数据。该工具兼容本地LLM和OpenAI API,提供文档问答、文本摘要和信息提取等功能。适用于需要在防火墙内处理敏感信息的企业,可轻松将本地LLM集成到实际应用中。
ScaleLLM - 优化大语言模型推理,兼容多种开源模型
GithubScaleLLM大模型推理开源项目生产环境集成开发高效性能
ScaleLLM是一个为大语言模型(LLMs)设计的高效推理系统,适用于生产环境。支持Llama3.1、Gemma2、Bloom、GPT-NeoX等多种开源模型,集成了CUDA图、前缀缓存、分块填充和推测解码等高级功能。项目正在积极开发,目标是提高效率并加入更多特性。现已上架PyPI,可通过pip安装。ScaleLLM还提供兼容OpenAI的REST API和本地聊天机器人UI,支持离线批量推理和在线分布式推理。
awesome-local-ai - 全面收录开源本地AI工具和解决方案
AI应用Github大语言模型开源工具开源项目推理引擎本地AI
awesome-local-ai收录了多种开源本地AI工具和解决方案,包括推理引擎、用户界面、完整平台、开发工具、用户工具和AI代理等。项目旨在为开发者和用户提供丰富的本地AI资源,便于探索和应用最新AI技术,同时确保数据隐私。此外,还涵盖了LLM排行榜和相关研究论文,为AI领域从业者和爱好者提供全面参考。
LLM-X - 多模型集成的大语言模型API管理平台
AI工具API集成LLM-X.AI大语言模型安全管理开发工具
LLM-X平台通过单一API整合多个大语言模型,提供安全的令牌管理和统一的LLM集成。该平台支持OpenAI、Anthropic等知名提供商,并具备API使用可视化功能。LLM-X简化了开发流程,无需管理基础设施,使开发者能专注于创新而非技术细节,从而提高工作效率。平台支持多个领先的大语言模型,让开发者能够轻松地在工作流中使用各种LLM,并通过成本跟踪功能优化资源利用。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号