Project Icon

clip-image-sorter

浏览器中基于OpenAI CLIP模型的本地图像排序与搜索

基于OpenAI的CLIP模型和文件系统访问API,在浏览器内轻松实现本地文件夹中的图像排序与搜索功能,无需安装额外软件,简化图像处理流程。

search_with_ai - 构建基于对话的AI搜索系统,集成多种搜索引擎与语言模型
AI搜索Docker部署GithubNode.jsOpenAIVue3开源项目
search_with_ai是一个开源项目,基于Node.js和Vue3创建,支持OpenAI、Google等多个语言模型及Bing、Google等搜索引擎。该系统特色包括响应式设计、多语言选项以及夜间模式,可通过Docker快速部署,不需密钥便可使用默认设置运行。
vit_large_patch14_clip_336.openai - 通过CLIP模型探索计算机视觉鲁棒性
CLIPGithubHuggingfaceOpenAI偏见开源项目数据集模型计算机视觉
OpenAI开发的CLIP模型通过ViT-L/14 (336x336)架构提高视觉任务的鲁棒性,专注于零样本图像分类,供研究人员深入探索。这个模型针对英语场景,其数据主要源自发达国家的互联网用户,目前不建议用于商用部署,但在学术界具备多学科研究的重要价值。
awesome-local-ai - 全面收录开源本地AI工具和解决方案
AI应用Github大语言模型开源工具开源项目推理引擎本地AI
awesome-local-ai收录了多种开源本地AI工具和解决方案,包括推理引擎、用户界面、完整平台、开发工具、用户工具和AI代理等。项目旨在为开发者和用户提供丰富的本地AI资源,便于探索和应用最新AI技术,同时确保数据隐私。此外,还涵盖了LLM排行榜和相关研究论文,为AI领域从业者和爱好者提供全面参考。
FunClip - 开源的视频剪辑工具
FunClipGithub人工智能开源软件开源项目视频剪辑工具语音识别
FunClip 是一个开源的自动化视频剪辑工具,使用阿里巴巴 TONGYI 语音实验室的 FunASR 模型系列进行语音识别。用户可以选择识别结果中的文本片段或发言人,一键获取对应的视频片段。支持 LLM AI 剪辑、多段剪辑和字幕生成等功能,操作简单,提供 Gradio 交互界面和命令行使用方式,可部署在服务器上,通过浏览器访问。现已支持中英文音频文件剪辑,提供智能剪辑和热词定制功能。
Cliclic - AI驱动的产品图片场景生成工具
AI工具AI绘图品牌产品照片商业摄影场景生成自定义尺寸
Cliclic是一款AI驱动的产品图片生成工具,提供100多种预设场景和自定义画布尺寸功能。用户可以独立匹配场景元素,快速创建专业级产品图像。这款全域兼容的工具适用于电商、社交媒体营销等各种营销渠道,无需专业摄影设备或技能即可高效、经济地生成引人入胜的品牌产品照片。Cliclic运用人工智能技术,为商家提供了一种简单易用的方式来提升产品展示效果。
japanese-clip-vit-b-16 - 日语CLIP模型实现跨模态文本图像语义匹配
CLIPGithubHuggingfaceViT-B/16japanese-clip图像识别开源项目模型深度学习
rinna公司开发的日语CLIP模型采用ViT-B/16 Transformer架构,通过CC12M数据集的日语翻译版本训练而成。该模型实现了日语文本与图像的跨模态理解和语义匹配,提供简洁的API接口,适用于图像检索和跨模态搜索等场景。作为Apache 2.0许可的开源项目,它为日语视觉语言处理领域提供了实用的基础工具。
imageprocessing-labs - 实现计算机视觉与图像处理的开源项目
FFTGithubImage processingWebGL开源项目机器学习计算机视觉
该项目在网页和Node环境中实现了计算机视觉、图像处理和机器学习功能,包括FFT、立体匹配、Poisson图像编辑等。还支持决策树、K-Means++、逻辑回归等机器学习算法,并提供WebGL样例和ONNX Runtime支持。项目开源,采用MIT许可证。
WebcamGPT-Vision - 通过OpenAI GPT-4 Vision API实现实时图像分析的轻量应用
FlaskGithubOpenAI GPT-4 Vision APIWebcamGPT-Visionwebcam图像处理实时图像捕获开源项目
WebcamGPT-Vision是一款轻量级Web应用,利用OpenAI的GPT-4 Vision API实现实时图像处理,支持PHP、Node.js和Python/Flask三种版本,具备简洁直观的界面设计,能够从摄像头捕获图像并显示AI生成的描述。需要现代网络浏览器、相应的软件安装和OpenAI API密钥。
DiffusionToolkit - 图片元数据索引和管理工具
AI生成图像Diffusion ToolkitGithub图像元数据图像搜索图像查看开源项目
Diffusion Toolkit是一款面向AI生成图片的元数据索引和查看工具,帮助用户高效组织、搜索和排序不断增长的图片集。支持JPG、PNG、WebP等常见格式,并处理多种元数据格式。用户可轻松查看、管理并按日期、评分等条件排序图片,支持标签和NSFW内容模糊处理。界面友好的拖放操作和多种快捷键提升使用体验。仅适用于Windows系统,提供详细的安装和使用指南。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号