Project Icon

camembert-L4

精简版法语BERT模型,支持文本分类和语义搜索

CamemBERT-L4是CamemBERT模型的精简版本,通过裁剪顶部层次来提高性能。适合在文本分类、抽取式问答、语义搜索等领域进行微调,用于决策的完整句子任务,而非文本生成。支持掩码语言建模(MLM)与文本特征提取,模型参数和大小均有减少,提升了处理效率,同时保持其重要功能。

classifier-multi-label - 基于BERT的多标签文本分类算法实现
BERTGithubSeq2SeqTextCNNtf.nn.softmax_cross_entropy_with_logits多标签分类开源项目
本项目介绍了如何使用BERT结合TextCNN、Denses、Seq2Seq等多种算法实现多标签文本分类。涵盖了模型结构、损失函数和解码方法等细节,展示了不同方法在推理速度和分类效果上的表现,提供了实验数据和结论,帮助开发者选择最佳解决方案。
llms - 大型语言模型的原理与实践应用全面解析
BERTGPTGithubTransformer开源项目自然语言处理语言模型
本项目全面介绍大型语言模型(LLMs)的基本概念、应用场景和技术演进。内容涵盖统计语言模型、神经网络语言模型,以及基于Transformer的预训练模型如GPT和BERT等。系统讲解LLMs核心原理,并探讨模型评估、文本生成和提示工程等实用技术。同时展示LLMs在计算机视觉等领域的创新应用,通过理论与实践结合,为读者提供深入了解LLMs技术的全面指南。
BertWithPretrained - 基于PyTorch实现的BERT模型及相关下游任务
BERTGithubPyTorchTransformer中文文本分类开源项目英文文本分类
该项目基于PyTorch实现了BERT模型及其相关下游任务,详细解释了BERT模型和每个任务的原理。项目支持分类、翻译、成对句子分类、多项选择、问答和命名实体识别等任务,涵盖中文和英语的自然语言处理。此外,项目还含有丰富的数据集和预训练模型配置文件。
neural-cherche - 专注于神经搜索模型微调和快速推理的工具库
BM25ColBERTGithubNeural-ChercheSparseEmbedSplade开源项目
Neural-Cherche 是一个专为微调和推理神经搜索模型(如 Splade、ColBERT 和 SparseEmbed)设计的库,兼容多种设备。通过该库,用户可以高效地进行模型微调,并在离线和在线环境中执行推理。此外,Neural-Cherche 提供多种检索器和排序器,支持保存嵌入以避免重复计算,适用于多种信息检索任务,并附有便捷的安装步骤和详细文档。
GLM-4 - 多语言支持与长文本处理能力
AI对话GLM-4Github多模态大语言模型开源项目长文本
GLM-4-9B系列是智谱AI推出的开源预训练模型,包括基础版、支持128K上下文的Chat版、1M长文本版及多模态版。该系列支持26种语言,在语义理解、数学计算、逻辑推理等多项评测中表现优异。GLM-4-9B-Chat具备网页浏览、代码执行等功能,GLM-4V-9B则增加了视觉理解能力。这些模型在多项基准测试中均超越了同规模竞品。
llm-compressor - 开源大型语言模型压缩优化库
GithubHugging FaceLLM Compressorvllm开源项目模型优化量化
llm-compressor是一个专注于大型语言模型优化和压缩的开源库。它提供全面的量化算法集,支持权重和激活量化,并与Hugging Face模型和仓库无缝集成。该项目采用safetensors文件格式,确保与vllm兼容,同时通过accelerate支持大规模模型处理。llm-compressor涵盖多种量化格式和算法,包括激活量化、混合精度和稀疏化技术,为模型优化提供灵活多样的选择。
scikit-llm - 无缝集成大型语言模型到Scikit-Learn,提升文本分析能力
ChatGPTGithubScikit-LLM开源软件开源项目文本分析机器学习
Scikit-LLM通过将ChatGPT等强大语言模型无缝集成到Scikit-Learn中,增强文本分析任务效果。该工具支持零样本文本分类,并提供简单的Python代码实现快速部署。项目为数据科学家和开发者提供高效的文本分析解决方案,支持快速安装和详细文档,社区反馈和支持也是其重要组成部分。
cherche - 神经搜索和语义检索的开源工具
ChercheGithub安装指南开源项目排序器检索器神经搜索
Cherche是一款开源工具,用于开发神经搜索流水线,支持预训练语言模型和检索器,特点是在于构建端到端检索管道,适用于离线语义搜索。它支持多种检索器和排名模型,包括TF-IDF、BM25、Lunr、DPR等,并与SentenceTransformers和Hugging Face模型兼容。项目提供详细文档和安装指南,欢迎社区参与贡献。
vercel-llm-api - 免费获取多种LLM模型的API封装
API封装ChatGPTGithubLLMVercel AI Playground开源项目模型下载
这是一款经过反向工程的API封装,提供对多种大型语言模型(LLM)的免费访问,包括OpenAI的ChatGPT和Cohere的Command Nightly。用户可以下载模型、生成文本和聊天消息,自定义参数并进行流式传输。支持使用代理,但目前不支持认证和高级模型。
UltraFastBERT - 指数级加速的BERT语言模型训练与推理方案
BERTGithubUltraFastBERT开源项目机器学习神经网络语言模型
UltraFastBERT是一个开源项目,旨在通过创新的快速前馈(FFF)层设计实现BERT语言模型的指数级加速。项目提供了完整的训练代码,以及在CPU、PyTorch和CUDA平台上的高效实现。包含训练文件夹、各平台基准测试代码,以及UltraFastBERT-1x11-long模型的配置和权重,可通过HuggingFace轻松加载使用。研究人员可以方便地复现结果,并进一步探索该突破性技术在自然语言处理领域的广泛应用潜力。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号