Project Icon

SynapseML

简化大规模机器学习管道的开源工具

SynapseML是一个开源库,旨在简化大规模机器学习管道的创建。它提供简单、可组合和分布式的API,支持文本分析、视觉处理、异常检测等多种任务。基于Apache Spark,SynapseML与SparkML/MLLib共享相同的API,能够无缝集成到现有的Spark工作流中。该库支持Python、R、Scala、Java和.NET,适用于各种数据库和云数据存储,助力构建智能系统。

spark - 统一分析引擎 支持多语言API及丰富工具集
Apache SparkGithub分布式计算大数据处理开源项目数据分析机器学习
Apache Spark是一个大规模数据处理的统一分析引擎,提供Scala、Java、Python和R的高级API。它支持多种高级工具,如Spark SQL、pandas API on Spark、MLlib、GraphX和Structured Streaming,分别用于SQL查询、pandas操作、机器学习、图处理和流处理。Spark的优化引擎支持通用计算图,适用于多种大数据分析场景。
mleap - 快速部署机器学习流水线与算法的实用工具包
GithubMLeapScikit-learnSpark开源项目性能机器学习数据管道
MLeap提供高性能、便携、易于集成的生产库,支持将Spark和Scikit-learn的机器学习流水线导出为便携格式并执行。通过其执行引擎和序列化格式,数据科学家和工程师可以无需依赖Spark或Scikit-learn环境,将数据流水线和算法轻松部署到生产环境中。MLeap支持多种序列化格式(如JSON、Protobuf),并与现有技术高度集成,提供用户灵活定制数据类型和转换器的能力。
sparseml - 神经网络优化工具,简化代码实现高效稀疏模型
GithubSparseML开源项目推理优化模型优化神经网络稀疏化
SparseML是开源模型压缩工具包,使用剪枝、量化和蒸馏算法优化推理稀疏模型。可导出到ONNX,并与DeepSparse结合,在CPU上实现GPU级性能。适用于稀疏迁移学习和从零开始的稀疏化,兼容主流NLP和CV模型,如BERT、YOLOv5和ResNet-50,实现推理速度和模型大小的显著优化。
flink-ml - Apache Flink ML,简化机器学习流水线构建的开源库
APIApache FlinkFlink MLGithub开源项目机器学习流处理
Flink ML是Apache Flink旗下的开源机器学习库,旨在简化ML流水线的构建过程。它提供标准化的机器学习API和基础设施,支持算法实现、训练和推理流水线的构建。该库提供Python和Java接口,具备快速入门指南、项目构建工具和性能基准测试功能。Flink ML作为社区驱动的项目,欢迎开发者参与贡献。
zenml - 帮助数据科学家和机器学习工程师标准化机器学习流程的框架
GithubMLOpsZenML云基础设施开源项目数据科学机器学习
ZenML是一个MLOps框架,帮助数据科学家和机器学习工程师标准化机器学习流程。用户可以通过Python装饰器创建机器学习流水线,并在AWS、GCP、Azure等云平台上运行。ZenML提供一键部署功能,支持远程堆栈快速设置和使用。其优势包括简化的端到端MLOps流程、与现有工具的无缝集成及全面的模型跟踪和审计功能。适合在复杂基础设施上构建和管理ML流水线的用户。
spark-nlp - 高效自然语言处理与大规模语言模型开源库
Apache SparkGithubSpark NLP开源项目机器学习自然语言处理预训练模型
Spark NLP 是一个基于 Apache Spark 的开源库,提供高效且准确的自然语言处理注释,支持机器学习管道的分布式扩展。该库包含超过 36000 个预训练管道和模型,支持 200 多种语言,涵盖分词、词性标注、嵌入、命名实体识别、文本分类、情感分析、机器翻译等任务。兼容 BERT、RoBERTa 等主流变压器模型,支持 Python、R、Java、Scala 和 Kotlin。
machinelearning - 跨平台开源框架,简化.NET应用中的模型开发与部署
GithubML.NET开源框架开源项目机器学习模型训练自定义模型
ML.NET是一个跨平台的开源机器学习框架,使开发者无需机器学习经验即可在.NET应用中构建、训练和部署定制模型。它支持从文件和数据库加载数据,并进行数据转换,具备多种机器学习算法。ML.NET适用于分类、预测和异常检测等多种场景,并兼容TensorFlow和ONNX模型,扩展性强。支持Windows、Linux和macOS操作系统,以及ARM64和Apple M1处理器架构。
TransmogrifAI - 自动化机器学习工作流
Apache SparkAutoMLGithubSalesforceScalaTransmogrifAI开源项目
TransmogrifAI是一个基于Apache Spark的自动化机器学习库,使用Scala编写,旨在提高开发效率。它提供类型安全、模块化和可重用的API,使用户能快速构建生产级机器学习应用,无需深厚的机器学习知识。该库显著减少模型调优时间,同时实现高精度。
openmlsys-zh - 现代机器学习系统设计与实现全面指南
GithubOpenMLSys实现经验开源项目机器学习系统设计原理
该开源项目全面介绍现代机器学习系统的设计和实现,涵盖编程接口、计算图、编译器技术、硬件加速等核心内容。同时探讨推荐系统、联邦学习、强化学习等前沿领域的系统实现。项目内容适合学生、研究人员和开发者,有助于读者深入理解机器学习系统,提升实际应用和开发能力。
clearml - ML/DL 开发和生产套件
ClearMLGithubMLOps实验管理开源项目数据管理模型部署
ClearML是一个开源平台,集成了实验管理、MLOps/LLMOps、数据管理、模型服务和报告生成功能。支持云端和本地部署,帮助用户实现AI项目的高效管理和自动化,包括实验记录、数据版本控制、模型部署与监控等。ClearML支持多种机器学习和深度学习框架,并与Jupyter Notebook无缝集成,适合团队协作和远程任务执行,提升AI工作流效率。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号