Project Icon

openinference

开放式AI应用程序追踪标准和工具集

OpenInference是一套用于AI应用程序追踪的开放标准和工具集,与OpenTelemetry相辅相成。它能深入洞察LLM调用过程及其应用环境,包括向量存储检索和外部工具的使用情况。该项目提供了技术规范和多语言支持的机器学习SDK与框架检测库,可无缝对接各类OpenTelemetry兼容后端。OpenInference致力于为AI应用提供全方位的可观测性方案。

HoneyHive - AI应用评估测试和可观测性的综合解决方案
AI工具AI应用OpenTelemetry提示管理监控分析评估测试
HoneyHive为GenAI应用开发团队提供全面的AI评估和可观测性解决方案。平台集成了AI应用追踪、评估、监控和提示管理等功能,支持多种AI模型和框架。开发团队可在统一的LLMOps环境中协作,进行应用性能测试、评估,监控和调试LLM生产故障,以及管理提示。HoneyHive旨在帮助团队更高效地构建可靠的AI产品。
openlit - 开放的 LLM 监控和评估工具
GPU性能监测GithubLLM性能监测OpenLITOpenTelemetry开源项目成本追踪
OpenLIT 是一款 OpenTelemetry 原生的工具,帮助开发者在生产环境中监控 LLM 应用的性能。它能够自动收集 LLM 的输入输出元数据,监控自托管 LLM 的 GPU 性能。OpenLIT 可以无缝集成 OpenAI 和 HuggingFace 等流行 LLM 提供商,只需一行代码即可实现性能监控。此外,还能跟踪自定义和微调模型的成本,优化资源使用并提高系统可靠性。
onnx - 一个为 AI 开发人员提供支持的开放生态系统
AI模型GithubONNX开源项目推理机器学习深度学习
ONNX是一个开放生态系统,提供AI模型的开源格式,支持深度学习和传统机器学习。通过定义可扩展的计算图模型和内置操作符及标准数据类型,ONNX增强了不同框架间的互操作性,加速了从研究到生产的转化。ONNX广泛支持各种工具和硬件,助力AI社区快速创新。了解ONNX的文档、教程和预训练模型,加入社区,共同推动ONNX的发展。
server - 开源AI推理服务,兼容多种深度学习和机器学习框架
AI推理GithubNVIDIA AI EnterpriseTriton Inference Server开源项目模型优化深度学习框架
Triton Inference Server是一款开源推理服务软件,支持TensorRT、TensorFlow、PyTorch等多种深度学习和机器学习框架。它优化了云端、数据中心、边缘和嵌入式设备的推理性能,适用于NVIDIA GPU、x86和ARM CPU,以及AWS Inferentia。主要功能包括动态批处理、模型流水线、HTTP/REST和gRPC协议支持等。通过Triton,用户可以轻松部署和优化AI模型,提升推理效率。
dash-infer - 面向x86和ARMv9的高性能大语言模型推理引擎
CPU优化DashInferGithubLLM推理开源项目模型量化高性能计算
DashInfer是一款针对x86和ARMv9硬件架构优化的C++推理引擎,支持连续批处理和NUMA感知功能。该引擎可充分发挥现代服务器CPU性能,支持推理参数规模达14B的大语言模型。DashInfer采用轻量架构,提供高精度推理和标准LLM推理技术,兼容主流开源大语言模型,并集成了量化加速和优化计算内核等功能。
KuiperInfer - 开源轻量级深度学习推理框架
C++GithubKuiperInfer大模型开源项目推理框架深度学习
KuiperInfer是一个开源深度学习推理框架,支持Resnet、Yolov5和LLama2等主流模型。基于现代C++设计,该框架提供高效算子实现和优化技术,适用于图像分类、目标检测和自然语言处理任务。KuiperInfer不仅是实用的推理工具,还是学习深度学习框架设计和C++工程实践的优质资源。
Infer - 人工智能驱动的企业关键绩效指标分析优化工具
AI工具Infer人工智能商业优化数据分析预测分析
Infer是一个基于人工智能的企业关键绩效指标(KPI)分析优化平台。该平台能分析历史数据,识别业务关键驱动因素,提供易懂洞察。它可预测特定结果并向相关系统发送警报,有助把握商机。Infer实时监控KPI变化并解释原因,无需深入分析即可为决策提供数据支持。平台集成多种数据源,提供探索、预测和衡量功能,适用于多个业务领域。
MInference - 动态稀疏注意力加速长上下文语言模型
GithubMInference动态稀疏注意力大语言模型开源项目性能优化长文本处理
MInference是一项新技术,通过利用长上下文语言模型注意力机制的动态稀疏性来加速预填充过程。该技术离线确定注意力头的稀疏模式,在线近似稀疏索引,并使用优化内核动态计算注意力。在A100 GPU上,MInference实现了预填充速度提升10倍,同时保持模型准确性。它支持LLaMA-3、GLM-4等多种长上下文模型,有效处理百万级别token的上下文。
text-embeddings-inference - 快速上手Ai理论及应用实战
API文档BERTDockerGithubtext-embeddings-inference开源项目模型部署
Text Embeddings Inference 为文本嵌入模型提供高效的推理服务,支持多种模型配置,适合AI及深度学习需求。快速部署和卓越的服务器级性能使其成为企业和研究机构面对大规模文本处理和复杂查询时的理想选择,支持包括 [BERT](https://link-to-bert) 和 [RoBERTa](https://link-to-roberta) 在内的多种模型,并兼容 Docker 和完备的 API 文档。
Confident AI - 开源LLM评估平台加速企业AI应用落地优化
AI工具AI评估DeepEvalLLM测试开源工具性能分析
Confident AI作为开源大语言模型评估平台,提供全面LLM测试方案。平台支持多种评估指标和快速单元测试,并具备A/B测试、输出分类和报告功能。这些特性有助于企业优化LLM工作流程,提高投资回报率,加快AI解决方案的市场化进程。Confident AI为企业提供了可靠的工具,以更高效地将LLM应用部署到生产环境。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号