Project Icon

insuranceqa-corpus-zh

开源中文保险问答语料库 支持机器学习和NLP研究

insuranceqa-corpus-zh是一个开源的中文保险行业问答语料库,包含真实用户问题和专业回答。作为保险领域首个开放QA语料库,它提供问答语料和问答对语料两种格式,支持答案选择、阅读理解等多种机器学习任务。数据集划分为训练集、测试集和验证集,并附有详细使用说明和格式介绍,方便研究人员快速应用。该项目适合进行保险领域自然语言处理和问答系统相关研究。

efaqa-corpus-zh - 开源中文心理咨询对话数据集
Github人工智能对话数据开源项目心理咨询语料库标注研究用途
efaqa-corpus-zh是一个包含20,000条标注数据的中文心理咨询对话语料库,为人工智能在心理咨询领域的应用提供支持。该数据集包含多轮对话内容和分类信息,涵盖学业、职场、家庭等多种心理问题。项目提供详细的数据格式说明和标签定义,研究人员可通过购买证书获取使用权限。作为目前最大的公开中文心理咨询对话数据集,efaqa-corpus-zh为相关研究提供了宝贵的语料资源。
nlp_chinese_corpus - 中文自然语言处理高质量多任务语料库
Github中文自然语言处理开源项目数据集词向量语料预训练
该中文自然语言处理项目提供丰富的高质量语料,包括维基百科条目、新闻、百科问答等,目标是解决中文大规模语料匮乏的问题。项目支持10大任务和9个模型的基准测试,并提供一键运行和详细性能比较,旨在提升中文NLP标准。适用于多种实际应用场景,如词向量训练、关键词生成和标题生成,方便研究人员和从业者获取和利用中文语料。
ToolQA - 评估工具增强型大语言模型的开源数据集
GithubToolQA大语言模型工具增强开源项目数据集评估基准
ToolQA是一个开源数据集,专门用于评估工具增强型大语言模型。数据集涵盖8个领域,包含需要综合使用多个工具解答的问题,分为简单和困难两个级别。ToolQA通过人机协作创建,提供了数据统计、下载链接、工具实现和基准代码,为研究人员评估和改进大语言模型的外部工具使用能力提供全面资源。
primeqa - PrimeQA:多语言问答系统的开源研究和开发平台
GithubPrimeQA信息检索多语言问答开源项目机器阅读理解问题生成
PrimeQA是一个开源平台,帮助研究人员和开发人员训练先进的问答模型。用户可以在PrimeQA上复制NLP会议中的实验,下载预训练模型并应用于自定义数据。该平台支持信息检索、多语言阅读理解、问题生成及检索增强的生成技术。PrimeQA在多个排行榜中名列前茅,整合Transformers工具包以提供强大的问答功能,满足领先的研究和开发需求。
Knowledge-QA-LLM - 开源本地知识库智能问答系统
GithubKnowledge QA LLM大语言模型开源项目本地知识库模块化设计问答系统
Knowledge-QA-LLM是一个开源的本地知识库智能问答系统,基于大语言模型构建。系统采用模块化设计,支持多种常见文档格式,易于部署和扩展。项目独立于lanchain库,组件可灵活替换,代码结构清晰。除大语言模型接口外,其他部分支持CPU运行,适用于各种规模的应用场景。
ChatKBQA - 知识库问答的生成,检索框架
GithubKBQALLM开源项目知识库问答知识检索语义解析
ChatKBQA是一个创新的知识库问答框架,采用生成-检索方法。该框架首先利用微调的大语言模型生成逻辑形式,再通过无监督检索替换实体和关系,有效提升了生成和检索效果。ChatKBQA解决了知识检索效率、错误传播和方法复杂性等问题,在WebQSP和CWQ基准测试中展现出优异性能。
roberta-base-chinese-extractive-qa - 中文提取式问答模型简介与使用指南
GithubHuggingfaceRoBERTa开源项目提问回答普希金模型腾讯云训练数据
该项目提供了一种中文提取式问答的完整方案,通过UER-py和TencentPretrain进行模型微调,支持大规模参数和多模态预训练拓展。模型可通过UER-py或HuggingFace获取,便于快速部署问答管道。训练数据包括cmrc2018、webqa和laisi,旨在提高模型的语义理解能力,并在腾讯云上进行三轮训练以优化性能。项目还提供了详细指导,便于导入和转换模型格式,从而提高问答系统的精准性。
LLMDataHub - 大语言模型训练数据集合
GithubLLMDataHub大语言模型开源社区开源项目数据集聊天机器人
LLMDataHub汇聚高品质大语言模型训练数据,为研究人员和从业者提供丰富的数据资源。该平台涵盖多种数据集,适合提升聊天机器人对话质量、应答生成及语言理解。同时,平台更新最新数据集,助您获取行业前沿资源。
paper-qa - 基于文档的智能问答系统 实现精准信息检索和回答生成
GithubLLMPaperQA嵌入式向量开源项目异步处理文献问答
paper-qa是一款轻量级文档问答工具包,专门从PDF和文本文件中提取信息并生成回答。通过文档嵌入、向量搜索和摘要生成等技术,结合大型语言模型,paper-qa能够提供高质量且有据可依的回答。支持OpenAI、Anthropic等多种嵌入和语言模型,并可集成本地托管模型。工具提供异步API,支持自定义文档添加和引用格式推断,还可整合外部向量存储。这些特性使paper-qa成为科研和信息检索领域的实用解决方案。
qlib - 开源AI量化投资平台
GithubQlib人工智能开源项目机器学习模型量化投资
Qlib是一个开源AI量化投资平台,利用AI技术赋能金融研究和价值创造。支持监督学习、市场动态建模和强化学习等多种机器学习模式,覆盖量化投资的全部流程,如alpha寻求、风险管理、投资组合构建及订单执行。平台不断更新,引入最新量化研究成果和论文。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号