TACO

推动算法代码生成模型发展的新基准数据集

TACO 代码生成算法数据集模型评估 Github 开源项目

TACO是一个大规模算法代码生成数据集，包含25,443个训练问题和1,000个测试问题。它提供具挑战性的编程竞赛题目，旨在提升代码生成模型的实际应用能力。TACO的特点包括规模大、质量高的问题-解答对，以及细粒度的任务主题、算法、技能和难度标签。这些特性为代码生成模型的训练和评估提供了精确参考，有助于推动相关研究和应用的进展。

访问官网

Github

Huggingface

介绍相关项目

ToRA - 改进数学推理问题解决的工具集成代理

GithubToRA工具集成开源开源项目数学推理模型发布

ToRA是一款工具集成推理代理，能够通过与外部工具互动解决复杂的数学推理问题。ToRA模型结合了自然语言推理和计算工具的优势，在多个数学任务中表现优异，尤其是ToRA-Code-34B和ToRA-70B，显著提升了数学数据集的准确率。此项目的开源代码和模型为进一步研究数学问题的解决提供了强大的资源。

tacotron - 开源文字到语音合成系统，采用TensorFlow实现

GithubTacotronTensorFlow开源开源项目训练模型语音合成

Tacotron是基于TensorFlow的开源语音合成系统，能够直接将文本转换为语音。本项目独立实现了Google的论文'Tacotron: Towards End-to-End Speech Synthesis'，虽然当前性能未及Google的演示，但已具备一定参考价值。支持包括LJ Speech和Blizzard 2012在内的多种语音数据集，并允许通过命令行调整和优化参数。项目还提供了预训练模型的下载与部署指南，便于用户快速开始使用及测试。

ToolBench - 大规模工具使用指令数据集与开源语言模型

AI工具APIGithubToolBench大规模语言模型工具使用能力开源项目

ToolBench项目构建了大规模的指令微调数据集，旨在提升语言模型的工具使用能力。该项目收集了16464个真实API，覆盖单工具和多工具场景，采用深度优先搜索决策树方法生成注释。项目提供训练脚本和微调后的ToolLLaMA模型，其工具使用能力达到了与ChatGPT相当的水平。

codegen-350M-multi - 支持多种编程语言的程序合成模型

CodeGenGithubHuggingface多语言模型开源项目模型程序合成行业应用训练数据

CodeGen-Multi 350M是一种程序合成模型，旨在生成可执行代码。其预训练数据来自GitHub的多语言代码库，包括C、C++、Go、Java、JavaScript和Python等。模型具备350M个参数，可以高效生成和补全代码。适用于HumanEval和MTPB等基准测试，为程序合成任务提供了良好的支持。

AutoCoder - 新一代代码生成模型，自动安装和运行所需包

AutoCoderGPT-4 TurboGithub代码生成代码解释器开源项目深度学习

AutoCoder发布了新一代代码生成模型，其测试准确率超过了GPT-4 Turbo。主要功能包括自动安装和执行所需包，解决了之前模型仅在验证代码时启动解释器的问题。该模型支持多个数据集，提供详细的快速入门指南，适合在Linux环境中部署，适用于高效代码生成和执行需求的用户。

magicoder - 开源代码生成与指令数据的高质量低偏见模型

GithubMagicoderOSS-Instruct人类评估大模型开源代码开源项目

Magicoder项目采用OSS-Instruct方法，通过开源代码片段生成低偏见、高质量的指令数据。Magicoder-S-DS-6.7B模型在HumanEval测试中表现优于GPT-3.5-turbo-1106和Gemini Ultra，展示了卓越的代码生成能力。项目提供多个模型和数据集，并支持在线和本地Gradio演示，适用于多种代码生成场景。

bigcodebench - 高难度代码生成基准测试评估LLM编程能力

BigCodeBenchGithub代码生成大语言模型开源项目编程能力评估基准

BigCodeBench是一个具有挑战性的代码生成基准测试，用于评估大型语言模型的实际编程能力。它提供复杂指令和多样函数调用，包括数据集、生成和评估脚本。基于EvalPlus框架，BigCodeBench实现精确评估和排名，提供预生成样本以加速研究。支持多种评估环境，采用unittest进行代码测试，为研究人员提供全面工具。

deepseek-coder-6.7B-base-AWQ - 大规模训练的代码语言模型，支持项目级代码补全和填充

GithubHuggingfaceIris数据集PyTorch开源项目模型模型训练深度学习神经网络

deepseek-coder-6.7B-base是一个在2万亿token上训练的大规模代码语言模型。采用16K窗口大小和填空任务训练，支持项目级代码补全和填充。在多个编程语言基准测试中表现优异，擅长代码补全、生成和理解。模型由87%的代码和13%的中英文自然语言构成，可支持多语言编程任务。

bigcode-evaluation-harness - 开源代码生成模型评估框架

BigCodeGithub代码生成多语言支持开源项目模型评估评估框架

bigcode-evaluation-harness是一个评估代码生成模型的开源框架。它支持多种编程语言和任务,如代码补全、插入和翻译。该框架兼容Hugging Face上的自回归模型,具备多GPU生成能力,并可在Docker容器中运行以保证安全性和可重复性。框架集成了HumanEval、APPS等多个代码生成基准,为研究人员和开发者提供了全面评估代码模型性能的工具。

Tabular-LLM - 表格智能数据集的收集与LLM模型优化

Alpaca-CoTGithubLLMTabular LLM开源项目微调平台表格智能

此项目利用Alpaca-CoT平台，集合和整理多种表格智能任务的数据集，并对现有的大型语言模型进行微调，以提升其对表格数据的理解和处理能力。主要涵盖表格问答和表格-文本生成等任务。项目提供开源训练代码和格式统一的表格数据，并开放训练模型，助力研究者复现及优化表格智能任务。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能，包括文生视频、动态画面和形象生成等，帮助用户快速上手，创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台，用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品，帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型，为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能，满足事务性工作的高频需求，帮助撰稿人节省精力，提高效率，优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号