Project Icon

SeeAct

基于多模态GPT模型的网页任务自动化解决方案

SeeAct采用多模态GPT模型(如GPT-4V(ision)),提供网页任务自动化的解决方案,支持OpenAI和Google的多种语言模型,并与Playwright浏览器无缝集成。适用于网页代理测试与评估,支持多种配置和自定义任务,实现安全操作和实时监控。Multimodal-Mind2Web数据集提供丰富的网页截图和HTML文本,便于实验和评估。

Cool GPTs - 展示和发现OpenAI平台上最佳GPT模型的导航平台
AIAI工具GPTs创意开发生产力
Cool GPTs汇集了OpenAI平台上最优质的GPT模型,提供多领域精选GPT导航。网站包含热门推荐、分类浏览和GPT提交功能,覆盖艺术、翻译、生产力和开发等多个类别。通过每周更新的精选内容,帮助用户轻松发现适合需求的GPT工具,提升工作效率和创新潜力。作为OpenAI平台上GPT模型的导航中心,Cool GPTs为用户持续推荐最新最佳的GPT资源,助力发掘适合个人需求的AI工具,促进工作效率和创新能力的提升。
gptscript - 连接大语言模型与多元系统的开源框架
GPTScriptGithubOpenAI大型语言模型开源项目框架系统交互
GPTScript是一个开源框架,旨在促进大语言模型与多样化系统的互动。它支持本地执行文件、OpenAPI应用、SDK库和RAG解决方案等多种系统类型。开发者通过简洁的提示即可实现LLM与本地或远程系统的集成。GPTScript具备多种应用场景,如CLI交互、API调用、文件操作和自动化流程。该框架兼容MacOS、Linux和Windows,安装便捷,为LLM应用开发提供了灵活高效的工具支持。
gptshare - GPT模型目录与应用探索中心
AI助手AI工具GPTsOpenAIgptshare搜索服务
gptshare是专业的GPTs模型目录服务平台,提供多样化的AI应用浏览、搜索和分享功能。平台涵盖顾问、角色扮演、创意、教育、娱乐等多个领域,满足不同用户的AI应用需求。用户可以轻松查找适合的GPT模型,同时也支持注册和分享自创模型。作为OpenAI生态系统的重要组成部分,gptshare促进GPTs技术的交流与创新,为AI爱好者和专业人士提供丰富的资源和探索机会。
multimedia-gpt - 通过OpenAI简单集成视觉及音频的多媒体AI工具
ChatGPTGithubMultimedia GPTOpenAIOpenAI DALLEOpenAI Whisper开源项目
Multimedia GPT是一款利用OpenAI GPT和视觉音频相结合的多媒体工具。它支持图片、音频和PDF文件输入,并以文字和图像形式输出结果。这个项目不需要自己准备GPU,实现了语音识别和图像生成,基于微软的Visual ChatGPT架构,未来计划支持视频处理。它兼容多种OpenAI语言模型,包括ChatGPT和GPT-4,用户可以自定义模型并在不同设备上运行。
BrainyAI - 浏览器插件集成多款顶级AI模型,提供免费AI辅助功能
AI聚合BrainyAIGithub免费替代大语言模型开源项目浏览器插件
BrainyAI是一款开源的Chrome浏览器扩展,集成GPT-4、Claude、Gemini等多款顶级AI模型。该插件提供AI聊天聚合、搜索、阅读和网页浏览增强功能,用户可在当前页面进行对话、搜索、网页摘要和文件阅读等任务。BrainyAI重视隐私保护,所有数据本地存储,确保安全可靠的AI辅助体验。
geekai - 基于AI大语言模型API的开源AI助手解决方案
AI助手AI绘画GeekAIGithub大语言模型开源开源项目
GeekAI是一款基于AI大语言模型API的开源AI助手解决方案,包含前端应用和后台管理系统。支持OpenAI、Azure、ChatGLM、讯飞星火、文心一言等多平台大语言模型以及MidJourney和Stable Diffusion的AI绘画功能。内置预训练角色和多种支付方式,支持插件开发,适用于多种应用需求。
Awesome-AI - 全面收录AI工具和资源的开源项目
AI工具ChatGPTGithub人工智能开源项目机器学习自然语言处理
Awesome-AI是一个开源项目,旨在收集和整理人工智能相关的高质量工具与资源。该项目涵盖了对话式AI、综合工具、AI搜索引擎、写作辅助、视频制作、音频处理、图像生成等多个AI应用领域。项目内容持续更新,为开发者、研究人员和AI爱好者提供一站式的资源导航,有助于快速了解AI生态系统的最新发展。
Video-ChatGPT - 创新视频对话技术开启细致视频理解新纪元
GithubVideo-ChatGPT多模态大型视觉语言模型开源项目视频理解问答系统
Video-ChatGPT是一个融合大型视觉和语言模型的视频对话系统。该项目构建了10万条视频-指令对数据集,开发了首个视频对话量化评估框架,在视频推理、创意生成、空间和时间理解等任务中表现出色。这一开源项目为视频内容理解和人机交互带来了新的发展方向。
Test-Agent - 智能测试助理助力软件质量提升
GithubTest-AgentTestGPT-7B大模型开源项目测试用例生成质量技术
Test-Agent是一个开源的智能测试助理项目,融合大模型与质量工程技术。它提供多语言测试用例生成和Assert补全功能,支持Java、Python和JavaScript。项目开源的TestGPT-7B模型在用例执行通过率和场景覆盖方面表现优异。Test-Agent支持本地部署,保障数据安全。未来将持续迭代,扩展更多测试应用场景和模型规模。
chatgpt-web - 开源ChatGPT网页应用 支持双模型和多功能
APIChatGPTDockerGithub开源项目部署
ChatGPT Web是基于OpenAI API的开源项目,支持双模型和两种非官方ChatGPT API方法。项目功能包括多会话存储、上下文逻辑、代码格式化、访问控制和数据导入导出。提供Docker部署和详细配置指南,便于开发者学习和二次开发。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号