codet5p-220m

CodeT5+：多语言代码理解与生成的开放源代码模型

CodeT5+代码理解性能评估预训练代码生成 Github 模型开源项目 Huggingface

CodeT5+是一种开源的多语言模型，支持多种编码器-解码器模式操作，适用于多种代码理解和生成任务。相比原始CodeT5系列，CodeT5+通过多样化的预训练任务和高效的计算方法显著提升性能，支持九种编程语言，并在多个任务中优于现有基线，特别是在HumanEval基准的零样本任务中表现突出。

deepseek-coder-6.7B-base-AWQ - 大规模训练的代码语言模型，支持项目级代码补全和填充

GithubHuggingfaceIris数据集PyTorch开源项目模型模型训练深度学习神经网络

deepseek-coder-6.7B-base是一个在2万亿token上训练的大规模代码语言模型。采用16K窗口大小和填空任务训练，支持项目级代码补全和填充。在多个编程语言基准测试中表现优异，擅长代码补全、生成和理解。模型由87%的代码和13%的中英文自然语言构成，可支持多语言编程任务。

T5ForConditionalGeneration-correct-vocab-calibrated - T5条件生成模型的词汇校准优化

GithubHuggingfacetransformers人工智能开源项目机器学习模型模型卡自然语言处理

这是一个基于Hugging Face Transformers库的T5条件生成模型，通过词汇校准进行了优化。该模型致力于提升文本生成任务的性能，尤其注重词汇准确性。它可应用于摘要生成、问答和文本翻译等多种下游任务。虽然模型的具体细节、训练过程和评估结果尚未完全披露，但其应用潜力值得关注。用户在使用时应当了解模型可能存在的偏见和局限性。

Qwen2.5-Coder-7B-Instruct-GPTQ-Int4 - Qwen2.5-Coder高效代码生成与长文本处理

GithubHugging FaceHuggingfaceQwen2.5-Coder代码生成开源项目模型量化长上下文支持

Qwen2.5-Coder项目通过5.5万亿训练令牌的使用，显著提升了代码生成、推理和修正能力。该模型支持长达128K的上下文长度，采用GPTQ 4位量化，并保持数学与通用能力优势。搭载transformers架构，具备RoPE和SwiGLU等技术，优化代码生成和处理过程。

Qwen2.5-Coder-7B-Instruct-GGUF - 基于5.5万亿数据训练的大规模代码生成模型

GithubHuggingfaceQwen2.5-Coder人工智能代码代码生成代码调试开源项目模型模型量化

Qwen2.5-Coder-7B-Instruct的量化版本模型，经过5.5万亿数据规模训练，具备代码生成、推理和bug修复等核心功能。模型支持128K长文本处理，可满足大规模代码开发需求。基于llama.cpp实现量化，在保持原有性能的同时优化了模型部署效率。

byt5-large - 字节级多语言自然语言处理模型

ByT5GithubHuggingface多语言支持字节级处理开源项目模型自然语言处理预训练模型

ByT5-large是一种创新的自然语言处理模型，直接处理原始UTF-8字节，无需分词器。这个Google开发的模型在mC4多语言数据集上预训练，适用于100多种语言。它采用标准Transformer架构，性能与基于token的模型相当，但在处理噪声文本、拼写和发音敏感任务方面表现更佳。ByT5-large简化了文本预处理流程，提高了模型的通用性和鲁棒性。

starcoder2-3b - 多语言代码生成模型专注17种主流编程语言

GithubHuggingfaceStarCoder2代码生成开源项目机器学习模型编程语言自然语言处理

StarCoder2-3B是一个基于30亿参数训练的代码生成模型,专注于17种主流编程语言。该模型采用分组查询注意力和滑动窗口技术,具有16384个token的上下文理解能力。StarCoder2-3B可根据上下文生成代码片段,适用于多种代码生成和补全任务,但生成的代码可能需要进一步优化。模型在大规模多语言代码数据集上训练,旨在提供灵活的编程辅助功能。

MFTCoder - 优化代码大模型性能的多任务微调框架

CodeFuseGithubHumanEvalMFTCoder代码大语言模型多任务微调开源项目

MFTCoder是一个开源的多任务微调框架,致力于提升代码大模型性能。该框架支持多种主流开源大模型,采用LoRA和QLoRA等高效微调方法,实现多任务平衡训练。MFTCoder还开源了多个高性能代码大模型和高质量数据集,在HumanEval等基准测试中表现优异。这一框架旨在促进代码大模型领域的协作与创新。

nanoT5 - 轻量高效的T5模型训练框架

GithubPyTorchT5模型nanoT5开源项目自然语言处理预训练

nanoT5是一个开源项目,旨在提供高效训练T5模型的方案。该项目在单GPU上仅用16小时就能达到与原始T5模型相当的性能,显著降低了训练成本。nanoT5优化了数据预处理、优化器选择等训练流程,为NLP研究人员提供了易用的研究模板。作为首个PyTorch实现的T5预训练框架,nanoT5为计算资源有限的研究者提供了宝贵工具。

multitask-text-and-chemistry-t5-base-augm - 多任务文本与化学T5适用于化学与自然语言的多领域模型

GithubHuggingfaceIBM研究院Multitask Text and Chemistry T5化学多任务开源项目模型语言模型

Multitask Text and Chemistry T5是一个基于Transformer的多任务语言模型，应用于化学和自然语言领域的多种任务。它以t5-small为预训练基础，并通过增强数据集进行训练。2023年发布，该模型由IBM Research与丹麦技术大学合作开发并集成于GT4SD。应用领域包括正向反应预测、逆合成、分子注释、文本条件的生成和段落到动作的转换。

SkyCode-AI-CodeX-GPT3 - 多语言支持与中文优化的开源代码生成模型

GPT3GithubSkyCode代码生成多语言开源模型开源项目

SkyCode是一款由奇点智源发布的多语言开源代码生成模型，基于GPT3架构并使用大量代码进行训练。支持Java、JavaScript、C、C++、Python、Go和shell等主流编程语言，并能理解中文注释。SkyCode在中文编码优化和HumanEval数据集的解题性能上表现卓越，使开发者能够高效完成编程任务。了解更多信息，请访问Hugging Face模型主页。

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com