SwiftSage

采用人类双系统认知理论的复杂任务推理新架构

SwiftSage 行为克隆 GPT-4 双重处理理论复杂任务 Github 开源项目

SwiftSage 是一种新的代理框架，基于双系统认知理论设计，用于复杂的互动推理任务。该框架结合了行为克隆和大语言模型提示功能，显著提高任务完成效率。其组成包括代表快速直觉思维的 Swift 模块和模拟深思熟虑过程的 Sage 模块，两者配合提升问题解决的效率和稳定性。在 ScienceWorld 基准的30项任务中，SwiftSage 显示出优于其他方法的性能，证明了其处理复杂任务的有效性。

访问官网

Github

Huggingface

介绍相关项目

awesome-ai-agents - 人工智能项目实践与框架的探索

AI AgentDevonE2BGithubPromptly开源项目项目专有名称

深入了解 awesome-ai-agents 项目，探讨开源与闭源项目的差异和特点。了解如何通过集成AI代理至SDK、框架和工具中，提升AI应用的部署、测试和监控效率。

Advanced_RAG - 深入探索RAG和Langchain框架在语言理解中的应用

Advanced_RAGGithubLLMsLangchainMulti Query RetrieverSelf-Reflection-RAG开源项目

该项目通过Python笔记本展示了RAG的高级技术，旨在优化大型语言模型(LLMs)的知识丰富度和上下文感知能力。从基础流程到多查询检索、自我反思、和自适应代理等高级架构，全面覆盖了核心组件及其工作方式。项目提供了构建RAG应用的详细指南，展示了如何通过Langchain框架提升文本生成的准确性和信息丰富度。内容包括查询转换、数据源路由和向量数据库索引等关键技术，为LLM应用提供坚实支持。

ScreenAgent - 由视觉语言大模型驱动的电脑控制工具

GithubIJCAI 2024ScreenAgentVLM Agent开源项目数据集自动控制

ScreenAgent项目创建了一个由视觉语言模型驱动的电脑控制环境，允许代理通过截图与真实屏幕互动并操作GUI。自动控制流程分为规划、执行和反思三个阶段，使代理能够完成多步骤任务。项目包含丰富的截图和操作序列数据集，支持包括GPT-4V、LLaVA-1.5、CogAgent和ScreenAgent在内的多种模型，并提供简化体验的网页版客户端。

Solo-Performance-Prompting - 多角色自我协作提升认知协同

GPT-3.5GithubLLama2NAACL2024Solo Performance Prompting大语言模型开源项目

Solo Performance Prompting项目展示了通过多角色自我协作，提升大型语言模型在任务解决中的认知协同能力。项目提供创意写作、协作游戏和逻辑谜题的任务脚本，并通过GPT-3.5和LLama2进行实验。配置和运行基于OpenAI API。实验结果和数据集均可查阅，项目论文已被NAACL2024接收，欢迎学术引用和关注。

Qwen-Agent - 基于千问大模型的应用开发框架支持工具调用和长文本处理

GithubLLM应用Qwen-Agent代理框架工具使用开源项目自定义助手

Qwen-Agent是基于通义千问大语言模型的应用开发框架。该框架提供指令跟随、工具使用、规划和记忆等功能，包含浏览器助手和代码解释器等示例应用。它支持自定义工具开发，提供原子级和高级组件，能处理超长文档问答，并在多个基准测试中表现出色。开发者可以利用Qwen-Agent创建智能助手，实现复杂的人工智能应用。

crewAI - 提升AI代理合作效率的前沿框架

AI代理GithubcrewAI任务管理多代理系统开源开源项目热门

crewAI是一款尖端的框架，专为编排角色扮演的自治AI代理而设计。通过促进协同智能，crewAI赋能代理以无缝协作，共同应对复杂任务。该平台支持自定义代理角色、目标和工具，提供灵活的任务管理，并支持顺序和分层处理流程。适用于构建智能助手平台、自动化客户服务团队或多代理研究团队。

SWE-bench - 基于GitHub问题的语言模型评估

DockerGitHubGithubICLR 2024Princeton NLPSWE-bench开源项目

SWE-bench是一个基准测试平台，用于评估语言模型在解决GitHub问题中的表现。提供代码库和问题描述，模型生成修复补丁。项目支持Docker容器实现高效可重复测试。最新更新包括SWE-agent的引入，提升评估基准表现。支持x86_64和实验性arm64架构，提供多样数据集和模型下载选项。欢迎NLP、机器学习和软件工程领域的贡献和反馈。

Agent-Driver - 革命性智能驾驶系统融合人类智慧与AI技术

Agent-DriverGithub人工智能大型语言模型开源项目自动驾驶认知代理

Agent-Driver是一个创新型自动驾驶系统，通过大型语言模型作为认知代理，将人类智能整合到自动驾驶中。系统包括多功能工具库、认知记忆和推理引擎，实现类人的推理和决策能力。在nuScenes基准测试中，Agent-Driver性能显著超越现有方法，并展现出优秀的可解释性和少样本学习能力。这一项目为自动驾驶领域提供了新的研究方向，向实现人类级别驾驶迈进。

cumulative-reasoning - 累积推理方法提升大语言模型复杂任务表现

GPT-4Github人工智能大语言模型开源项目数学问题解决累积推理

Cumulative Reasoning项目开发了新型累积推理方法，显著提升大语言模型在复杂任务中的表现。该方法在24点游戏中达到98%准确率，在MATH数据集上实现72.2%准确率。项目还基于元提示技术开发CR Agent Assistant，为解决数学问题提供高效工具。研究表明，累积推理方法在各类数学问题上优于现有方法，尤其在高难度问题上表现出色。

search-agents - 树搜索算法助力语言模型智能体优化网页交互决策

AI代理GithubTree SearchVisualWebArena开源项目网页环境语言模型

这个开源项目开发了一种创新的树搜索算法，提升了语言模型智能体在网页环境中的探索和规划能力。该方法在VisualWebArena和WebArena基准测试中得到验证，支持GPT-4和Llama-3等多种模型。项目提供完整文档，包括安装指南、评估流程和基线复现方法，为研究人员和开发者提供了实用工具。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号