Project Icon

SemanticFinder

浏览器端实时语义搜索与文档对话工具

SemanticFinder是一款基于transformers.js的浏览器端语义搜索和文档对话工具。它利用最新的嵌入模型,在浏览器中完成嵌入计算和余弦相似度计算,无需服务器端推理。用户可在2秒内快速搜索大型文本,如圣经或《悲惨世界》。该工具支持多语言,可自定义参数,并提供Chrome扩展程序版本。SemanticFinder将所有处理在本地完成,保护用户数据隐私,是一个高效灵活的语义搜索解决方案。

gte-small - 基于ONNX权重的Transformers.js模型嵌入及余弦相似度计算
GithubHuggingfaceJavaScriptONNXTransformers.js开源项目模型特征提取相似度计算
本项目介绍了使用ONNX权重与Transformers.js库计算模型嵌入和余弦相似度的过程。通过安装Transformers.js库,可以轻松地创建特征提取管道,并进行句子嵌入和相似度计算。项目默认采用8位量化模型,同时支持全精度版本。ONNX模型为未来的WebML应用做好了准备,建议通过Optimum工具进行ONNX格式转换以实现网络兼容。
headless-vector-search - 无头向量搜索解决方案,提升文档检索效率
Edge FunctionsGitHub ActionsGithubHeadless Vector SearchOpenAISupabase开源项目
该项目提供了一种向量搜索功能,旨在提高文档站点的检索效率。作为无头软件,它可以轻松集成到现有网站中。项目通过初始化数据库中的架构,并借助GitHub Action将Markdown文档转换为向量存储。在Supabase和OpenAI技术的支持下,系统处理用户查询并生成类似ChatGPT的响应。配置简单,只需几步即可完成设置。目前已在Supabase官方文档站点得到应用。
sensei - AI驱动的智能问答引擎 提供精准答案
AI搜索引擎FastAPIGithubNext.jsSensei Search开源大语言模型开源项目
Sensei Search是一款基于AI技术的智能问答引擎,集成多种先进的大型语言模型。采用现代web技术构建,支持本地和云端部署,提供快速、准确的信息检索和问题解答服务。能够处理日常查询和复杂问题,提供智能化的解决方案。这个开源项目结合了先进的AI搜索和问答技术,为用户提供全面的信息检索体验。
deep-seek - 大规模LLM驱动互联网检索引擎的实验性架构
DeepSeekGithub互联网安装开源项目检索引擎研究代理
该项目引入了一种基于LLM的大规模互联网检索引擎的实验性架构,与传统的答案引擎不同,它旨在处理大量来源,收集综合实体列表。项目展示了检索代理通过计划、搜索、提取和丰富等步骤生成包含信任评分的详细表格。该架构的亮点在于其高效的令牌使用和广泛的数据处理能力,适用于需要深入检索和详细信息的场景。用户可以访问示例结果,深入了解其架构特点和潜在改进空间。
semantic-search-nextjs-pinecone-langchain-chatgpt - 使用Next.js、Langchain和Pinecone构建语义搜索应用的入门指南
GPT3GithubLangchainJSNext.jsPinecone开源项目语义搜索
这是一个使用Next.js、LangchainJS、Pinecone向量数据库和GPT3构建的全栈入门项目。从文本文件嵌入向量、存储在Pinecone到进行语义搜索,提供了完整的指导,包括克隆仓库、安装依赖、配置API密钥和运行应用程序的步骤。项目的构建基于Node.js教程,并移植到Next.js。同时,提供了Lens协议开发文档的查询示例和自定义数据处理的建议,非常适合希望快速上手上述工具进行语义搜索项目的开发者。
dom-to-semantic-markdown - HTML DOM到语义化Markdown的智能转换工具
Exam NumbersGithubxkcd内容创作开源许可开源项目网络漫画
dom-to-semantic-markdown是一款为大型语言模型优化的HTML DOM转换工具。它保留网页内容的语义结构,提取关键元数据,通过URL重构和内容精简降低token使用量。该项目具备主要内容检测和表格列跟踪功能,提升了语言模型处理网页信息的效率。这为开发者提供了一个高效的网页内容语义化解析方案。
bge-base-en-v1.5 - 高效英文文本嵌入模型 支持语义搜索与相似度计算
GithubHuggingfaceONNX权重Transformers.js嵌入计算开源项目文本检索模型特征提取
bge-base-en-v1.5是一个基于Transformers.js的英文文本嵌入模型,专门用于语义搜索和文本相似度计算。该模型提供高效的特征提取功能,支持多句嵌入和余弦相似度计算。它易于集成到各种自然语言处理任务中,如信息检索、文档分类和语义匹配。开发者可通过简洁的JavaScript代码实现文本嵌入和相似度计算。
typesense - 快速、容错且易用的开源搜索引擎
GithubTypesense全文检索开源软件开源项目搜索引擎数据库
Typesense是一款高性能、容错的开源搜索引擎,专注于提供卓越的搜索体验。它具有简单易用的API、智能默认配置和丰富功能,包括拼写错误容忍、实时搜索、地理搜索和向量搜索等。Typesense部署简便、易于扩展,支持多种编程语言,适合各种规模的应用。作为Algolia和ElasticSearch的替代方案,Typesense为开发者提供了快速实现高质量搜索功能的选择。
metasearch - 高效多源并行搜索工具 实现信息检索效率提升
DockerGithubMetasearch开源项目搜索工具数据源
Metasearch是一个开源的多源并行搜索工具,支持同时检索超过25种数据源,包括AWS、GitHub、Google Drive、Confluence、Jira和Slack等。此工具能显著提高信息检索效率,适合企业内部资源管理。Metasearch支持Docker和Git部署,设置简便,并欢迎社区贡献新的数据源支持。它为企业提供了一个统一的平台,用于快速搜索和访问分散在各种工具和平台上的信息。作为一个轻量级工具,Metasearch仅由约3000行TypeScript代码构成,具有出色的扩展性。
Findr - 智能知识管理平台 提升团队协作效率
AI助手AI工具Findr企业搜索工作效率知识管理
Findr是一款AI驱动的知识管理平台,整合多个应用程序数据,提供智能搜索和信息检索服务。通过统一界面,用户可快速获取所需信息。平台支持全文搜索和AI对话,提供即时答案和洞察。Findr旨在提高工作效率,帮助企业充分利用集体知识,加速决策过程,提升工作质量。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号