Project Icon

datasets

最大的 ML 模型即用型数据集中心,具有快速、易用且高效的数据操作工具

🤗 Datasets是一个高效的轻量级数据处理库,支持一行代码完成数据集的下载和预处理。库支持Numpy、Pandas、PyTorch、TensorFlow和JAX等框架,并提供智能缓存及大规模数据集的流式处理,有效减轻内存限制的压力,简化机器学习和数据分析的前置工作。

ML-DL-scripts - 机器学习和深度学习的全面脚本库 从分类到部署的解决方案
GitHubGithubPython开源项目数据科学机器学习深度学习
ML-DL-scripts是一个综合性的机器学习和深度学习Python脚本库。这个项目涵盖了从分类、回归到聚类和时间序列分析等多个领域,同时提供了PyTorch、Fastai和Keras等主流深度学习框架的使用示例。项目还包括图像处理、自然语言处理和异常检测等实际应用案例,以及基于Docker的模型部署配置。这个代码库为数据科学研究和机器学习应用提供了丰富的技术参考资源。
nlp-recipes - 使用最新深度学习模型加速自然语言处理系统开发
Azure Machine LearningBERTGithubNLPtransformers开源项目深度学习
该资源库提供构建NLP系统的示例和最佳实践,重点关注最新的深度学习方法和常见场景,如文本分类、命名实体识别和文本摘要。支持多语言,特别是利用预训练模型应对不同语言任务。内容基于与客户的合作经验,旨在简化开发过程,帮助数据科学家和工程师快速部署AI解决方案。
DataFrame - 高效C++数据分析库,支持多种统计和多线程功能
C++DataFrameGithub多线程开源项目数据分析算法
DataFrame是一个高效的C++数据分析库,提供类似于Python的Pandas和R的DataFrame功能。它支持数据切片、连接、分组操作,并具备统计、金融及机器学习算法。该库特别适合处理大数据集,拥有优异的性能和多线程支持。通过多种内置算法和可添加的自定义算法,用户可以灵活分析和处理数据。DataFrame还与Polars等工具进行了性能对比,展现了其在大数据处理上的显著优势。
biomedical - 生物医学数据集库促进机器学习研究
BigBIOGithub开源项目数据标准化机器学习生物医学数据集自然语言处理
BigBIO是一个基于Huggingface datasets库开发的生物医学数据加载器库。该项目提供超过126个生物医学数据集的轻量级访问,覆盖10余种语言和12个任务类别。BigBIO致力于提高数据处理的可重复性,完善数据集来源和许可等属性的文档,并简化自然语言提示和多任务学习的元数据集生成。此外,BigBIO还支持多个主流英语生物医学基准测试中的大部分数据集。
dgl - 图深度学习框架加速图神经网络应用与研究
DGLGithub分布式训练图神经网络大规模图开源项目深度学习
DGL是一个高效易用的Python包,支持在图上执行深度学习。兼容PyTorch、Apache MXNet和TensorFlow等多种框架,提供GPU加速的图库、丰富的GNN模型示例、全面的教学材料及优化的分布式训练功能。适合从研究人员到行业专家的各类用户。广泛应用于学术及实践领域,无论是基础教学还是高级图分析,DGL均能有效支持。
Great-Deep-Learning-Tutorials - 全面深度学习教程和实用资源集锦
GithubPyTorch人工智能开源项目机器学习深度学习神经网络
该项目汇集了深度学习领域的优质教程和资源,覆盖计算机视觉、自然语言处理、语音处理等多个方向。内容包括入门教程、高级课程、技术博客和开源代码库,涵盖模型量化、AutoML、图神经网络等前沿主题。同时提供深度模型训练的实践指南,适合系统学习和深入研究深度学习的人员参考。
aws-open-data-geo - AWS地理空间开放数据集的简化访问工具
AWSGitHubGithubpandas地理空间数据集开放数据开源项目
aws-open-data-geo项目整合了AWS Open Data平台上的地理空间数据集,每日更新并提供CSV和JSON格式。这种整理方式便于程序化调用和数据分析,简化了地理空间数据的获取和处理流程。项目通过提供标准化的数据访问方式,促进了开放地理数据在实际应用中的使用。
DALI - 加速深度学习应用的GPU加速数据加载与预处理库
GPU加速GithubNVIDIA DALI多框架支持开源项目数据预处理深度学习
NVIDIA DALI是一个GPU加速的数据加载和预处理库,专为提高深度学习应用效率而设计。它提供了一套优化的工具,改善图像、视频和音频的处理,同时解决CPU瓶颈,支持跨多平台框架使用。此外,DALI利用GPUDirect Storage技术,从而实现从存储到GPU内存的直接数据传输,显著提升处理速度。
colab - 开源自然语言处理库
GithubHuggingfaceTransformers人工智能开源项目机器学习模型深度学习自然语言处理
Transformers是一个开源的自然语言处理库,提供预训练模型和工具。支持文本分类、问答等多种NLP任务,适用于研究和实际应用。库定期更新,集成新技术,为开发者和研究人员提供丰富资源。
1 - 开源自然语言处理工具库提升文本处理效率
AI模型GithubHuggingfacetransformers开源项目机器学习模型深度学习自然语言处理
transformers是一个开源自然语言处理工具包,旨在通过简化模型训练和应用,提升机器学习项目的效率。该库提供丰富功能和预训练模型,便于执行各种文本分析和生成任务。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

问小白

问小白是一个基于 DeepSeek R1 模型的智能对话平台,专为用户提供高效、贴心的对话体验。实时在线,支持深度思考和联网搜索。免费不限次数,帮用户写作、创作、分析和规划,各种任务随时完成!

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

Trae

Trae是一种自适应的集成开发环境(IDE),通过自动化和多元协作改变开发流程。利用Trae,团队能够更快速、精确地编写和部署代码,从而提高编程效率和项目交付速度。Trae具备上下文感知和代码自动完成功能,是提升开发效率的理想工具。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号