Project Icon

imbalanced-learn

Python库解决机器学习不平衡数据问题

imbalanced-learn是一个Python库,专门解决机器学习中的数据不平衡问题。它提供了多种重采样技术,如过采样、欠采样和组合方法,以获得更公平和稳健的模型。该库与scikit-learn完全兼容,使用简单,并提供详细文档和示例。作为scikit-learn-contrib项目的一部分,imbalanced-learn为数据科学家和机器学习工程师提供了处理不平衡数据集的有力工具。

.. -- mode: rst --

.. _scikit-learn: http://scikit-learn.org/stable/

.. _scikit-learn-contrib: https://github.com/scikit-learn-contrib

|Azure|_ |Codecov|_ |CircleCI|_ |PythonVersion|_ |Pypi|_ |Gitter|_ |Black|_

.. |Azure| image:: https://dev.azure.com/imbalanced-learn/imbalanced-learn/_apis/build/status/scikit-learn-contrib.imbalanced-learn?branchName=master .. _Azure: https://dev.azure.com/imbalanced-learn/imbalanced-learn/_build

.. |Codecov| image:: https://codecov.io/gh/scikit-learn-contrib/imbalanced-learn/branch/master/graph/badge.svg .. _Codecov: https://codecov.io/gh/scikit-learn-contrib/imbalanced-learn

.. |CircleCI| image:: https://circleci.com/gh/scikit-learn-contrib/imbalanced-learn.svg?style=shield .. _CircleCI: https://circleci.com/gh/scikit-learn-contrib/imbalanced-learn/tree/master

.. |PythonVersion| image:: https://img.shields.io/pypi/pyversions/imbalanced-learn.svg .. _PythonVersion: https://img.shields.io/pypi/pyversions/imbalanced-learn.svg

.. |Pypi| image:: https://badge.fury.io/py/imbalanced-learn.svg .. _Pypi: https://badge.fury.io/py/imbalanced-learn

.. |Gitter| image:: https://badges.gitter.im/scikit-learn-contrib/imbalanced-learn.svg .. _Gitter: https://gitter.im/scikit-learn-contrib/imbalanced-learn?utm_source=badge&utm_medium=badge&utm_campaign=pr-badge&utm_content=badge

.. |Black| image:: https://img.shields.io/badge/code%20style-black-000000.svg .. _Black: :target: https://github.com/psf/black

.. |PythonMinVersion| replace:: 3.8 .. |NumPyMinVersion| replace:: 1.17.3 .. |SciPyMinVersion| replace:: 1.5.0 .. |ScikitLearnMinVersion| replace:: 1.0.2 .. |MatplotlibMinVersion| replace:: 3.1.2 .. |PandasMinVersion| replace:: 1.0.5 .. |TensorflowMinVersion| replace:: 2.4.3 .. |KerasMinVersion| replace:: 2.4.3 .. |SeabornMinVersion| replace:: 0.9.0 .. |PytestMinVersion| replace:: 5.0.1

imbalanced-learn

imbalanced-learn是一个提供多种重采样技术的Python包,这些技术通常用于处理类别间严重不平衡的数据集。它与scikit-learn_兼容,并且是scikit-learn-contrib_项目的一部分。

文档

安装文档、API文档和示例可以在文档_中找到。

.. _文档: https://imbalanced-learn.org/stable/

安装

依赖


`imbalanced-learn`需要以下依赖项:

- Python (>= |PythonMinVersion|)
- NumPy (>= |NumPyMinVersion|)
- SciPy (>= |SciPyMinVersion|)
- Scikit-learn (>= |ScikitLearnMinVersion|)

此外,`imbalanced-learn`还需要以下可选依赖项:

- Pandas (>= |PandasMinVersion|) 用于处理数据框
- Tensorflow (>= |TensorflowMinVersion|) 用于处理TensorFlow模型
- Keras (>= |KerasMinVersion|) 用于处理Keras模型

示例还需要以下额外依赖项:

- Matplotlib (>= |MatplotlibMinVersion|)
- Seaborn (>= |SeabornMinVersion|)

安装

从PyPi或conda-forge仓库 .....................................

imbalanced-learn目前可在PyPi仓库中获得,你可以通过pip安装:

pip install -U imbalanced-learn

该包也在Anaconda Cloud平台上发布:

conda install -c conda-forge imbalanced-learn

从GitHub上的源代码 ...............................

如果你更喜欢,你可以克隆它并运行setup.py文件。使用以下命令从Github获取副本并安装所有依赖项:

git clone https://github.com/scikit-learn-contrib/imbalanced-learn.git cd imbalanced-learn pip install .

请注意,你可以以开发者模式安装:

pip install --no-build-isolation --editable .

如果你希望在GitHub上提交拉取请求,我们建议你安装pre-commit:

pip install pre-commit pre-commit install

测试


安装后,你可以使用`pytest`运行测试套件:

  make coverage

开发
-----------

这个scikit-learn-contrib的开发与scikit-learn社区的开发方式一致。因此,你可以参考他们的`开发指南<http://scikit-learn.org/stable/developers>`_。

关于
-----

如果你在科学出版物中使用imbalanced-learn,我们将感谢你引用以下论文:

  @article{JMLR:v18:16-365,
  author  = {Guillaume  Lema{{\^i}}tre and Fernando Nogueira and Christos K. Aridas},
  title   = {Imbalanced-learn: A Python Toolbox to Tackle the Curse of Imbalanced Datasets in Machine Learning},
  journal = {Journal of Machine Learning Research},
  year    = {2017},
  volume  = {18},
  number  = {17},
  pages   = {1-5},
  url     = {http://jmlr.org/papers/v18/16-365}
  }

大多数分类算法只有在各个类别的样本数量大致相同时才能达到最佳性能。高度倾斜的数据集,其中少数类别被一个或多个类别严重outnumber,已经被证明是一个挑战,同时这种情况也越来越普遍。

解决这个问题的一种方法是通过重新采样数据集来抵消这种不平衡,希望能得到比原来更稳健和公平的决策边界。

你可以参考`imbalanced-learn`_文档以了解已实现算法的详细信息。

.. _imbalanced-learn: https://imbalanced-learn.org/stable/user_guide.html
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号