Project Icon

deepseek-coder-7b-instruct-v1.5

基于2T代码数据训练的4K上下文智能编程模型

DeepSeek Coder是一个开源的代码生成语言模型,通过2T代码数据预训练和2B指令数据微调,具备4K上下文窗口。该模型支持代码生成与理解功能,开发者可通过Hugging Face平台便捷部署,并允许商业应用场景。

DeepSeek-Coder-V2-Lite-Instruct-FP8 - FP8量化模型优化提高大语言模型部署效率
DeepSeek-Coder-V2-Lite-Instruct-FP8FP8GithubHuggingfacevLLM开源项目文本生成模型量化
DeepSeek-Coder-V2-Lite-Instruct-FP8是一种经过FP8量化优化的模型,旨在提升商业与研究中英文聊天助手的效率。此优化通过减少参数位数,有效降低内存和存储器需求,达到了79.60的HumanEval+基准测试得分。在vLLM 0.5.2及以上版本中实现高效部署。
Qwen2.5-Coder-7B-Instruct-AWQ - AWQ量化7B参数代码模型支持128K长文本处理
AWQ量化GithubHuggingfaceQwen2.5-Coder人工智能代码生成大语言模型开源项目模型
Qwen2.5-Coder-7B-Instruct-AWQ是一个AWQ量化的4比特指令微调模型,具有7B参数。该模型在代码生成、推理和修复方面表现出色,支持处理长达128K tokens的上下文。它采用28层、28个注意力头的因果语言模型架构,并应用RoPE、SwiGLU等技术。这一模型在提升编码能力的同时,保持了数学和通用领域的性能,为代码智能助手等应用提供了坚实基础。
starcoder2-self-align - 自我校准的代码生成大型语言模型
GithubStarCoder2-Instruct代码生成大语言模型开源项目数据生成流水线模型训练
StarCoder2-15B-Instruct-v0.1是一款完全自我校准的代码生成大型语言模型,采用公开透明的工作流程,无需人工注释或专有数据。模型通过生成大量指令-响应对,进一步微调自身。专为Python代码生成任务优化,支持语法验证和定制排序。提供详细的训练和评估信息,包括数据生成、模型优化和性能验证,适用于多种编程任务。模型强调透明度和开放许可,提升代码生成的准确性和效率。
Qwen2.5-Coder-7B-Instruct-GGUF - 基于Qwen2.5的7B参数代码专用模型支持超长文本输入与代码生成
GGUF格式GithubHuggingfaceQwen2.5-Coder代码生成大语言模型开源项目指令微调模型
Qwen2.5-Coder-7B-Instruct-GGUF是一款开源的代码专用大语言模型,通过5.5万亿token的训练提升了代码生成和推理能力。模型采用transformers架构,参数规模为7.61B,具备32K-128K的长文本处理能力。该模型在保持通用能力的同时优化了编程相关任务,支持GGUF格式并可通过llama.cpp部署,适用于代码智能体等实际应用场景。
magicoder - 开源代码生成与指令数据的高质量低偏见模型
GithubMagicoderOSS-Instruct人类评估大模型开源代码开源项目
Magicoder项目采用OSS-Instruct方法,通过开源代码片段生成低偏见、高质量的指令数据。Magicoder-S-DS-6.7B模型在HumanEval测试中表现优于GPT-3.5-turbo-1106和Gemini Ultra,展示了卓越的代码生成能力。项目提供多个模型和数据集,并支持在线和本地Gradio演示,适用于多种代码生成场景。
Yi-Coder-9B - 涵盖52种编程语言的高效代码生成模型
GithubHuggingfaceYi-Coder代码性能开源模型开源项目文本生成模型编程语言
Yi-Coder系列拥有高效的代码生成能力,支持52种编程语言,尤其在长文本上下文使用表现出色,最多128K tokens。Yi-Coder-9B-Chat在LiveCodeBench中达23%通过率,适用于代码生成与智能交互。详情参见Yi-Coder博客和README。
Qwen2.5-Coder-7B-Instruct-GPTQ-Int4 - Qwen2.5-Coder高效代码生成与长文本处理
GithubHugging FaceHuggingfaceQwen2.5-Coder代码生成开源项目模型量化长上下文支持
Qwen2.5-Coder项目通过5.5万亿训练令牌的使用,显著提升了代码生成、推理和修正能力。该模型支持长达128K的上下文长度,采用GPTQ 4位量化,并保持数学与通用能力优势。搭载transformers架构,具备RoPE和SwiGLU等技术,优化代码生成和处理过程。
codegen-2B-multi - 提供多语言程序合成的自回归语言模型
CodeGenGithubHuggingface多编程语言开源项目机器学习模型模型程序合成自动生成代码
CodeGen-Multi 2B模型是一种自回归语言模型,经过多个编程语言的大规模数据集预训练,能够合成可执行代码。模型以CodeGen-NL 2B为基础,并在多语言数据上进一步训练,能够从自然语言和编程语言中提取特征。模型在主要代码生成基准上经过评估,可用于从注释生成代码或完成部分代码。用户可借助AutoModelForCausalLM功能加载模型,适用于多种编程语言。
codet5-large - 支持多编程语言的代码理解与生成大模型
CodeSearchNetCodeT5GithubHuggingface代码生成开源项目模型深度强化学习语言模型
CodeT5-large预训练模型支持多语言代码处理,并在CodeXGLUE基准中展示了卓越的性能。
Qwen2.5-Coder-1.5B - 提高代码生成和推理的新一代开源模型
GithubHuggingfaceQwen2.5-Codertransformers代码推理代码生成开源项目模型长上下文支持
Qwen2.5-Coder通过扩展训练数据集,提高了在代码生成、推理和修复方面的性能,支持最长128K标记的文本处理,适用于多种实际应用。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号