Project Icon

Paddle-Lite

轻量级且高性能的深度学习推理框架

Paddle Lite 是为移动端、嵌入式和边缘设备设计的高性能深度学习推理框架。支持多种硬件平台和操作系统,提供丰富的优化工具和多语言 API,便于快速部署和执行推理任务。通过量化和子图融合等策略,Paddle Lite 实现了轻量化和高性能,并已广泛应用于百度和其他企业。用户可以通过简单步骤完成模型优化和部署,并快速上手示例。

LiteLLM - 集成多种大语言模型的统一API代理平台
AI工具API统一LiteLLM代理服务器大语言模型开源项目
LiteLLM是一个统一的API代理平台,集成了100多种大语言模型,提供认证管理、负载均衡和支出跟踪功能。采用OpenAI格式,简化了多个LLM提供商的接入流程。LiteLLM具有开源和企业版本,支持高可用性,拥有活跃的社区。核心功能涵盖模型添加、负载均衡、密钥创建和支出监控,适合需要灵活管理多个LLM资源的开发团队和企业。
MNN - 高效轻量的深度学习框架,支持多设备推理和训练
GithubMNN开源项目推理引擎深度学习框架轻量级高性能
MNN是一个高效轻量的深度学习框架,支持设备上的推理和训练。已被阿里巴巴30多个应用集成,覆盖直播、短视频、搜索推荐等70多种场景。MNN适用于嵌入式设备,支持TensorFlow、Caffe、ONNX等多种模型格式,并优化了ARM和x64 CPU及多种GPU的计算性能。通过MNN Workbench,用户可以下载预训练模型、进行可视化训练并一键部署到设备上。
lite.ai.toolkit - C++ AI模型工具包,包括目标检测、面部识别、图像分割和抠图等
GithubLite.Ai.ToolKit人脸识别分割开源项目抠图模型检测
一款轻量级的C++工具包,支持多种AI模型,包括目标检测、面部识别、图像分割和抠图等。依赖最小,仅需OpenCV和ONNXRuntime,兼容GPU和CPU设备,提供300多种C++实现和500多种预训练模型,易于使用和集成。
PaddleGAN - 基于PaddlePaddle的开源GAN框架 支持快速开发和部署
GithubPaddleGAN图像生成开源项目生成对抗网络超分辨率风格迁移
PaddleGAN是基于PaddlePaddle开发的开源GAN框架,实现了多种经典和前沿GAN模型。框架支持快速开发和部署GAN应用,适用于学术研究和工业应用。主要功能包括图像翻译、人脸编辑、视频修复等,并提供详细教程和在线体验。PaddleGAN持续更新最新GAN技术,为开发者提供高效易用的GAN开发工具。
bolt - 增强深度学习模型部署的高效轻量级库
BoltGithub华为开源项目推理精度模型转换深度学习
Bolt是一款轻量级深度学习库,旨在提升模型部署效率。它支持Caffe、ONNX、TFLite和Tensorflow的模型转换,提供从FP32到1-BIT的多种推理精度,并适用于ARM和X86 CPU以及多种GPU。该库在华为多个部门广泛应用,具备高性能、丰富的图优化和高效的线程亲和性设置,提升时序数据处理效率。
XNNPACK - 多平台优化的神经网络推理引擎 支持移动和嵌入式系统
GithubXNNPACK开源项目深度学习框架神经网络推理移动平台优化算子支持
XNNPACK是一个用于加速高级机器学习框架的神经网络推理引擎。它支持ARM、x86、WebAssembly和RISC-V等多种平台,提供低级性能原语,优化TensorFlow Lite、PyTorch等框架的运行效率。XNNPACK实现了丰富的神经网络操作符,在移动设备和嵌入式系统上表现出色,能高效运行各代MobileNet模型。在Pixel 3a上,XNNPACK能在44毫秒内完成FP32 MobileNet v3 Large的单线程推理,展现了其卓越的性能。
InferLLM - 轻量化语言模型推理框架,兼容多种模型格式和设备
GithubInferLLMllama.cpp多模型兼容开源项目模型推理高效率
InferLLM 是一个高效简洁的语言模型推理框架,源于 llama.cpp 项目。主要特点包括结构简单、高性能、易于上手,并支持多模型格式。目前兼容 CPU 和 GPU,可优化 Arm、x86、CUDA 和 riscv-vector,并支持移动设备部署。InferLLM 引入了专有 KVstorage 类型以简化缓存和管理,适合多种应用场景。最新支持的模型包括 LLama-2-7B、ChatGLM、Alpaca 等。
jupyterlite - 浏览器中的轻量级Jupyter开发环境
GithubJupyterJupyterLitePython交互式计算开源项目浏览器
JupyterLite是一个基于浏览器的JupyterLab发行版,无需服务器即可运行。支持Python和JavaScript内核,提供交互式可视化和文件操作功能。特点包括易部署、可嵌入其他应用,适合快速搭建轻量级计算环境。目前处于开发阶段,已实现多项Jupyter核心功能,为数据分析和科学计算提供便捷的在线平台。
paddler - 专为优化llama.cpp服务器设计的负载均衡和反向代理工具
AWS集成GithubPaddlerllama.cpp反向代理开源项目负载均衡
Paddler是一个开源、生产就绪的负载均衡和反向代理工具,专为优化llama.cpp服务器设计。它支持动态添加和移除服务器、自动扩展、请求缓冲、AWS集成以及StatsD协议。Paddler通过监控服务器的可用槽位,实现高效的请求分配,适用于需要可配置和可预测内存分配的环境。
DeepSeek-V2-Lite - 创新架构驱动的高效混合专家语言模型
DeepSeek-V2GithubHuggingface多头潜在注意力大规模语言模型开源项目模型混合专家模型自然语言处理
DeepSeek-V2-Lite是一款采用创新架构的混合专家(MoE)语言模型。通过多头潜在注意力(MLA)和DeepSeekMoE技术,该模型实现了训练和推理的高效性。模型总参数量为16B,激活参数为2.4B,在多项英文和中文基准测试中表现优异,超越了同类7B密集模型和16B MoE模型。DeepSeek-V2-Lite支持单40G GPU部署和8x80G GPU微调,为自然语言处理研究提供了一个高性能且资源友好的选择。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号