Project Icon

puck

高效近似最近邻搜索库 专注大规模数据集性能

Puck是一个高效的C++近似最近邻(ANN)搜索库,其名称来源于莎士比亚作品中的精灵角色。该项目包含Puck和Tinker两种算法,在多个1B数据集上表现出色。Puck采用两层倒排索引架构和多级量化,可在有限内存下实现高召回率和低延迟,适用于大规模数据集。Tinker则针对较小数据集优化,性能超过Nmslib。该库支持余弦相似度、L2和IP距离计算,并提供Python接口,方便开发者集成使用。

NeumAI - 优化大规模检索增强生成的开发者数据平台
GithubNeum AIRAG向量数据库大语言模型开源项目数据平台
Neum AI是一个数据平台,帮助开发者利用检索增强生成(RAG)技术。它从现有数据源提取数据,生成向量嵌入,并导入向量数据库进行相似性搜索。平台具有高吞吐量分布式架构,处理数十亿数据点,内置数据连接器和实时同步功能,确保数据最新,并支持元数据混合检索,提供全面的RAG解决方案。
tantivy - Rust编写的快速全文搜索引擎库
GithubRustTantivy全文搜索引擎开源开源项目性能
Tantivy是一个Rust编写的全文搜索引擎库,提供类似Apache Lucene的功能。它支持全文搜索、多语言分词、BM25评分和自然语言查询。Tantivy以快速性能和低启动时间见长,适合构建各类搜索应用。该库具备增量索引、多线程处理、压缩存储等特性,为开发者提供了构建搜索引擎的灵活选择。
flashlight - 用C++编写的机器学习库
C++FlashlightGithub开源项目机器学习神经网络高性能
Flashlight是完全用C++编写的灵活高效的机器学习库,源自Facebook AI Research及其他知名项目。它包括内部接口可修改、核心小于10 MB以及高性能默认设置等特点,支持自动语音识别、图像分类、物体检测和语言建模等应用。提供简单的安装方式和全面的文档,适合研究者和开发者使用。
lancedb - 高效管理与检索嵌入的开源多模态向量数据库
GPU支持GithubLanceDB多模态数据嵌入管理开源项目矢量搜索
LanceDB 是一款开源的多模态向量数据库,具备持久存储功能,能够简化嵌入的管理与检索。它支持生产级别的向量搜索,无需管理服务器,可存储、查询和过滤向量、元数据以及多模态数据(包括文本、图片、视频、点云等)。它还支持向量相似性搜索、全文搜索和SQL查询,并提供原生的Python和JavaScript/TypeScript支持,同时实现零拷贝和自动版本管理。LanceDB 与 LangChain、LlamaIndex、Apache-Arrow、Pandas、Polars、DuckDB 等多个生态系统集成。其核心由Rust编写,基于Lance构建,专为高性能机器学习工作负载而设计。
cudaKDTree - CUDA加速的左平衡k-d树构建与查询库
CUDAGPU计算Githubk-d树开源项目数据结构查询算法
cudaKDTree是一个基于CUDA的k-d树库,提供高效的构建和查询功能。它支持多种可定制输入数据类型,可在主机和GPU上构建树结构。该库提供三种设备端构建器,在性能和内存使用间权衡。支持空间k-d树和Bentley风格的平衡k-d树,适用于多种数据类型。还包含多种遍历算法,如最近点查找(FCP)和k近邻(KNN)等示例查询。
XNNPACK - 多平台优化的神经网络推理引擎 支持移动和嵌入式系统
GithubXNNPACK开源项目深度学习框架神经网络推理移动平台优化算子支持
XNNPACK是一个用于加速高级机器学习框架的神经网络推理引擎。它支持ARM、x86、WebAssembly和RISC-V等多种平台,提供低级性能原语,优化TensorFlow Lite、PyTorch等框架的运行效率。XNNPACK实现了丰富的神经网络操作符,在移动设备和嵌入式系统上表现出色,能高效运行各代MobileNet模型。在Pixel 3a上,XNNPACK能在44毫秒内完成FP32 MobileNet v3 Large的单线程推理,展现了其卓越的性能。
voy - Rust实现的WebAssembly向量相似搜索引擎
GithubRustVoyWebAssembly向量相似度搜索嵌入索引开源项目
Voy是一款轻量级WebAssembly向量相似搜索引擎,基于Rust开发。它采用k-d树索引技术,提供高效的搜索性能。Voy支持树摇优化,可生成便携式嵌入索引,适合在全球CDN边缘服务器部署。该项目正处于活跃开发阶段,未来将增加内置文本转换等新特性。
punica - 在单个预训练模型上高效运行多LoRA微调模型,文本生成吞吐量提升至12倍
GithubLoRAPunica多租户服务开源项目模型微调高效计算
Punica采用分段聚集矩阵-向量乘法(SGMV)技术,使多个LoRA微调模型在单个预训练模型上高效运行,仅增加1%的存储和内存开销。相比其他系统,Punica在各种LoRA模型请求下的文本生成吞吐量提升至12倍,适用于不同版本的CUDA和Python,支持二进制包和源码构建。
FlashRank - 为优化搜索和检索流程设计的超轻量的Python库
FlashRankGithub开源项目模型神经网络跨编码器重排序
FlashRank是一款极速、超轻量的Python库,专为优化搜索和检索流程设计。基于最新的SoTA大规模语言模型和交叉编码器,支持多种再排序模式并能在常规CPU上运行。模型轻至4MB,适合AWS Lambda等无服务器环境,有效减低运行成本,提升处理效率。适合多样化的部署场景和搜索策略,是提升搜索效率的优选工具。
kumo-search - 端到端搜索引擎框架支持全文和垂直领域检索
EA平台Githubkumo search向量检索开源项目搜索引擎端到端搜索
kumo search是一个端到端搜索引擎框架,运行在EA平台上。它支持全文检索、倒排索引、排序等功能,适用于数据量中等、业务复杂的垂直领域搜索。该框架允许使用Python编写业务逻辑,通过AOT编译器自动生成C++代码,实现快速迭代。kumo search提供多个基础库和服务项目,包括向量引擎和综合搜索引擎,为搭建全面搜索解决方案提供支持。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号