Project Icon

modelmesh-serving

高效机器学习模型管理与部署平台

ModelMesh Serving是一个开源的机器学习模型管理控制器,用于管理ModelMesh这一通用模型服务管理和路由层。它实现了高效的模型部署、扩展和负载均衡,支持Triton、MLServer和TorchServe等多种主流模型服务运行时。通过自定义ServingRuntime功能,ModelMesh Serving可灵活集成其他模型服务器,为机器学习模型的生产环境部署提供了可靠的解决方案。

InstantMesh - 高效单图3D网格生成技术,利用稀疏视图大型重建模型
3D网格生成GithubInstantMesh单图重建开源项目深度学习计算机视觉
InstantMesh是一个基于LRM/Instant3D架构的前馈框架,能从单张图像高效生成3D网格。它采用稀疏视图大型重建模型,提供多种模型变体,支持白色背景图像生成。项目开源了推理和训练代码、模型权重,并提供Gradio在线演示。InstantMesh在3D内容创作和计算机视觉等领域有广泛应用潜力。
dstack - 轻量级AI模型管理工具,兼容Kubernetes与主流云服务
AI模型管理GithubGoogle Cloud TPUNVIDIA GPUdstack云提供商开源项目
dstack是一款轻量级工具,专为AI模型的开发、训练和部署而设计,可以作为Kubernetes的替代品。支持NVIDIA GPU和Google Cloud TPU,并兼容多种云服务提供商(如AWS、GCP、Azure等)和本地集群。dstack使用简单,无论是在云端还是本地,都能轻松配置和管理集群。其最新版本不断更新,提供高效便捷的体验。
MeshLib - 高性能3D数据处理和计算机视觉库
3D数据处理GithubMeshLib开源项目点云处理网格操作计算机视觉
MeshLib是一个注重简洁性和高性能的3D数据处理库,支持点云、网格和体积等数据结构。该库提供丰富的计算算法,涵盖数学基础、3D数据处理、布尔运算和问题修复等功能。MeshLib可通过Python和.NET集成,并支持pip或NuGet安装。这个开源库适用于机器人自动化、自动驾驶以及工业、医疗和科学领域的各种计算机视觉应用。
FedML - 跨平台生成式AI和大型语言模型的训练与部署方案
GithubTensorOperaTensorOpera AI分布式训练开源项目生成式AI联邦学习
TensorOpera AI简化了生成式AI和大型语言模型的训练与部署。通过集成的MLOps、调度器和高性能机器学习库,开发者可以在去中心化GPU、多云、边缘服务器和智能手机上经济高效地运行复杂的AI任务。TensorOpera Launch自动配对最经济的GPU资源,消除环境设置和管理难题,支持大规模训练和无服务器部署。TensorOpera Studio和Job Store帮助开发者微调和部署模型,实现高效的跨平台AI工作流。
Mooncake - 大语言模型服务架构采用KVCache分离设计
GithubKVCacheLLM服务Mooncake分离架构吞吐量开源项目
Mooncake是一种创新的大语言模型服务架构。它采用以KVCache为中心的分离设计,将预填充和解码集群分开,并充分利用GPU集群的闲置资源实现KVCache的分布式缓存。Mooncake的核心调度器在确保延迟服务水平目标的同时,最大化系统的有效吞吐量。通过实施预测性早期拒绝策略,该架构在高负载情况下表现优异,尤其适合长上下文场景。实验结果表明,在特定模拟环境中,Mooncake能够在满足服务水平目标的前提下,将系统吞吐量提升525%。
starwhale - 一体化机器学习运维平台 加速AI模型开发流程
GithubLLMOpsMLOpsStarwhale开源项目机器学习运营模型开发
Starwhale是一个开源的MLOps/LLMOps平台,致力于优化机器学习运维流程。平台提供模型、运行时和数据集的统一管理,支持模型评估、在线演示和大语言模型微调等功能。Starwhale支持独立版、服务器版和云端版部署,适应不同应用场景。其开放架构允许开发者自定义MLOps功能,为AI团队打造高效、标准化的开发环境。
HyperMink - 简化AI推理部署的开源服务器平台
AIAI工具HyperMinkSystem-1开源推理服务器
HyperMink是一个开源AI推理服务器平台,核心服务Inferenceable基于Node.js构建,简单易用且适合生产环境。平台整合了llama.cpp和llamafile的C/C++核心,提供强大的AI推理能力。除支持本地部署外,HyperMink还推出了便携式System-1 USB产品。该平台支持网页阅读和自然语言处理等功能,为开发者和企业提供灵活高效的AI应用开发解决方案。HyperMink适用于各种AI应用场景,如智能客服、内容生成和数据分析,显著提高了AI部署效率和可访问性。
GPT-SoVITS-Server - 轻量级语音克隆模型部署工具
GPT-SoVITSGithub开源项目推理合成服务器部署模型训练语音克隆
GPT-SoVITS-Server是一个简化语音克隆模型部署的轻量级项目。无需复杂环境搭建,用户可在多种设备上轻松运行训练好的GPT-SoVITS模型,包括手机和服务器。项目适用于CPU推理,提供简化的代码结构和配置选项,便于新手使用。未来计划包括优化代码结构、增加语言支持和开发图形界面。
meilisearch-kubernetes - Kubernetes集群中轻松部署Meilisearch搜索引擎
GithubKubernetesMeilisearch容器化开源开源项目搜索引擎
通过清单文件或Helm图表,meilisearch-kubernetes项目简化了Meilisearch在Kubernetes环境中的部署流程。开发者可以轻松将这一强大的搜索引擎集成到现有的Kubernetes应用中,实现高效的搜索功能。
SmartSim - 为高性能计算环境优化的机器学习集成框架
GithubOrchestratorSmartRedisSmartSim开源项目机器学习高性能计算
SmartSim是为高性能计算(HPC)环境设计的工作流库,简化了PyTorch和TensorFlow等机器学习库在HPC模拟和应用中的使用。该框架能在HPC系统上启动机器学习基础设施,与用户工作负载并行运行。通过基础设施库和SmartRedis客户端,SmartSim实现了HPC应用与机器学习模型间的高效数据交换和远程执行,支持Fortran、C、C++和Python等多种语言,无需MPI即可实现运行时数据交换。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号