Project Icon

havenask

阿里巴巴自研分布式搜索引擎 支持千亿级实时检索

Havenask是阿里巴巴开源的分布式搜索引擎,支持千亿级数据实时检索和百万级QPS查询。它采用C++底层构建,提供SQL查询支持和丰富的插件机制。Havenask具有高性能、低延迟和灵活定制的特点,可快速迭代算法,适用于构建各类智能搜索服务。该项目已在阿里巴巴集团多个业务中广泛应用。

awesome-data-engineering - 数据工程全面技术资源指南
Github大数据开源项目数据处理数据存储数据工程数据库
本资源列表全面覆盖数据工程领域,包括数据库、数据摄取、文件系统和序列化格式等核心技术。汇集Kafka、Hadoop、Spark等主流开源项目和创新解决方案,为数据工程实践提供系统性参考。内容涵盖从基础设施到前沿技术,是数据工程师深入学习和技术选型的重要指南。
liqe - 轻量高效的类Lucene查询语言解析和搜索工具
GithubJSON文档Liqe开源项目搜索引擎查询语言解析器
Liqe是一个轻量高效的类Lucene查询语言(LQL)工具,提供了强大的解析、序列化和搜索功能。它支持复杂查询语法,包括关键词匹配、数值比较、范围搜索、通配符匹配和布尔运算。Liqe能够解析查询、序列化结果,并对JSON文档执行搜索。作为JavaScript生态中较为完整的类Lucene实现,Liqe为命令行和Web应用提供了灵活的高级搜索能力。
bisheng - 开源大模型应用开发平台
BishengGithub大模型应用开源开源项目数据治理智能应用热门
Bisheng是一款开源大模型应用开发平台,旨在加速大模型技术在多种业务场景下的应用落地,通过提供灵活、可靠的开发组件和流程编排能力,支持包括文档摘要、知识库问答和对话等智能应用的构建。平台强调实用功能和数据治理,专为高并发和企业级应用设计。于2023年8月底正式开源,提供全面的开发者文档和社区支持。
sparkey - 高性能键值存储库 专为读密集型系统设计
GithubSparkey哈希表开源项目数据库读取优化键值存储
Sparkey是一款高性能键值存储库,专为读密集型系统优化。支持最大2^63 - 1字节数据,提供迭代、读写和删除功能。采用不可变哈希表,支持并发读取和块级压缩。Sparkey适用于高吞吐低延迟场景,尤其适合定期数据重建。提供C库和命令行工具,易于集成。其特点包括批量写入优化、跨平台存储文件、低开销和快速随机访问。
SeekAll - 多引擎搜索对比浏览器插件
AI工具AI搜索SeekAll多引擎搜索效率工具浏览器插件
SeekAll是一款浏览器多屏助手,支持一键打开多个搜索引擎进行结果对比。内置Perplexity、ThinkAny、Devv等AI搜索引擎,以及Google、Bing等传统搜索引擎。最新版本新增自定义搜索引擎功能和侧边栏垂直标签页模式,优化了搜索效率和标签管理。该插件旨在帮助用户快速在多个窗口中搜索信息,提高信息获取效率。
bitsail - ByteDance开源的分布式数据集成引擎
BitSailGithub分布式架构字节跳动开源开源项目数据集成
BitSail是一个开源的分布式数据集成引擎,支持多种异构数据源间的同步。该引擎提供批处理、流处理和增量场景的数据集成解决方案,采用分布式和云原生架构,具备高性能和可靠性。BitSail在ByteDance多个业务线中得到应用,每日处理海量数据,展现了其强大的数据集成能力。
databend - 高性能云数据仓库,基于 Rust 构建,适合大规模数据分析与人工智能
AI分析DatabendGithub云数据仓库开源项目性能基准测试数据格式热门
Databend 是一个开源、高性能的云数据仓库,使用 Rust 构建,专为复杂的数据分析设计。它整合了 AWS S3、Azure Blob 等服务,支持 ACID 事务、版本控制和无模式的数据存储,确保数据完整性与灵活性。Databend 支持多种数据格式,如 JSON、CSV、Parquet 等,提供高速查询执行与数据摄入,是成本效益高的 Snowflake 替代方案。此外,Databend 的 AI 功能支持高级分析,提供社区驱动的用户友好体验,适合企业和开发者快速部署和使用。
ambry - 企业级分布式对象存储系统
AmbryGithub低延迟分布式对象存储可扩展性开源项目高可用性
Ambry是一个分布式对象存储系统,可高效管理海量小型和大型对象。系统具备高可用性、可扩展性、低延迟和高吞吐量等特性。除了适用于Web公司的媒体对象存储,Ambry还可用于数据库备份、搜索索引和业务报告等多种场景。其易用性和成本效益使其成为企业级存储的理想选择。
pagefind - 无需基础设施的静态网站搜索库
GithubPagefind带宽优化开源项目无服务器网站搜索静态搜索
Pagefind是一个全静态搜索库,适用于大型网站,能够最小化用户带宽占用,无需额外基础设施。该库为静态网站提供高效搜索功能,具有轻量级和易集成的特点,无需复杂后端配置即可实现。详细使用文档可在官方网站 pagefind.app 查阅。
querqy - Java搜索引擎查询预处理开源框架
GithubJavaQuerqy开源框架开源项目搜索引擎查询预处理
Querqy是一个为Java搜索引擎设计的查询预处理框架,支持Solr、Elasticsearch和OpenSearch。它提供查询重写和优化功能,有助于提高搜索相关性、简化查询逻辑和优化性能。该开源项目遵循Apache 2.0许可。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号