Project Icon

RecSysDatasets

推荐系统公开数据集汇总及处理工具

RecSysDatasets是一个汇总公开推荐系统数据集的开源项目。该项目收集了电商、广告、电影等多个领域的数据集,并提供将数据集转换为统一格式的工具。这有助于研究人员更便捷地获取和使用各类推荐系统数据集,为算法开发和评估提供支持。项目与RecBole推荐系统库集成,便于进行算法测试。

Data-science - 数据科学项目的综合资源库和实践指南
GitHubGithubMLOpsPython开源项目数据科学机器学习
Data-science项目汇集了丰富的数据科学资源,涵盖MLOps、数据管理、测试和生产力工具等领域。通过文章、代码和视频教程,该项目全面展示了数据科学工作流程,从项目管理到部署。它为数据科学家和机器学习工程师提供了提高效率、构建可靠项目的实用指南。
img2dataset - 高效处理大规模图像数据集的开源工具
Githubimg2dataset下载工具图像数据集开源项目数据处理机器学习
img2dataset是一个开源工具,用于将大量图像URL转换为结构化数据集。它能在20小时内处理1亿个URL,支持下载、调整大小和打包功能。该工具提供多种输出格式、编码选项,以及增量模式和过滤功能,适用于机器学习训练等需要处理大规模图像数据的场景。img2dataset还支持保存URL和标题对,为研究人员和开发者提供了灵活的数据处理选项。
ai-audio-datasets - 提供多语言、多情感的语音、音乐和音效数据支持AI模型训练
AI Audio DatasetsAI model trainingAIGCGenerative AIGithub开源项目音频应用
AI Audio Datasets (AI-ADS) 🎵 提供多样化的语音、音乐和音效数据集,适用于生成式AI、AIGC、AI模型训练、智能音频工具开发及音频应用。该项目包含多种数据集,如AISHELL、阿拉伯语语音语料库、AudioMNIST等,覆盖多种语言和情感,适合多种语音识别和合成研究。用于训练多语种语音识别、语音转文字及语音情感转换等AI系统,提升AI音频技术的应用和开发水平。
pattern_classification - 机器学习和模式分类资源集合
Github开源项目数据预处理机器学习模型评估模式分类聚类分析
该项目汇集了机器学习和模式分类领域的全面资源。内容包括教程、示例代码、数据集、工具和技术说明等。涵盖数据预处理、特征选择、多种算法实现等方面。还提供数据可视化案例、统计模式分类研究、相关书籍和讲座资料。适合学习和应用机器学习技术的研究者和从业者参考使用。
awesome-chatgpt-dataset - 综合性AI对话数据集资源助力自定义语言模型训练
ChatGPTGithub开源项目指令调优数据集训练语言模型
awesome-chatgpt-dataset项目汇集了多样化的人工智能对话数据集资源。该项目囊括了不同规模、语言和领域的高质量指令数据,范围从数千到数百万条不等,涵盖多语言、代码生成、视觉对话等多个方面。这些数据集为研究人员和开发者提供了训练和优化大型语言模型的重要素材,有助于推动更智能、更多元化的AI对话系统的发展。
Awesome-Deep-Learning-Papers-for-Search-Recommendation-Advertising - 搜索推荐广告领域深度学习论文精选集
Github嵌入技术广告系统开源项目推荐系统搜索引擎深度学习
该项目汇集了搜索、推荐和广告领域的前沿深度学习论文,收录了100多篇顶级会议论文。内容涵盖嵌入、匹配、排序(如CTR/CVR预测)、后排序、迁移学习和强化学习等关键技术,包括DSSM、YouTube DNN等经典模型。收录了Google、Facebook、Alibaba等顶级科技公司的研究成果,为从业者提供全面的学习资源和研究参考。通过这些精选论文,读者可深入了解行业前沿技术和实践应用。
awesome-python-data-science - Python数据科学资源集合,详解机器学习与深度学习工具
GithubPython工具库开源项目数据科学机器学习深度学习
该项目收集了全面的Python数据科学资源,包括机器学习、深度学习、自动化机器学习、自然语言处理、计算机视觉、时间序列分析和强化学习等领域的开源库。从通用型机器学习算法到深度学习框架(如PyTorch和TensorFlow),再到特征工程和数据可视化,用户可以找到适用于各种数据分析和建模需求的工具。项目旨在帮助数据科学家和工程师高效选择工具,以提高开发和分析效率。
Data-Provenance-Collection - 跨学科倡议推动AI训练数据集透明度和责任使用
AI数据集Data Provenance InitiativeGithub开源项目文档化负责任使用透明度
Data-Provenance-Collection项目致力于提高AI训练数据集的透明度和负责任使用。该项目审计了44个数据集合,涵盖1800多个文本微调数据集,记录了其来源、许可和创建者等元数据。开发者可通过项目脚本筛选符合许可和特征要求的数据集,促进AI训练数据的规范使用。
ogb - OGB开源项目的图机器学习数据集及标准评估工具
GithubOpen Graph Benchmark图机器学习开源项目数据加载器深度学习框架评估器
OGB项目集成了图机器学习所需的基准数据集、数据加载器和标准化评估工具,兼容PyTorch Geometric和DGL等主流深度学习框架。支持处理节点、链接和图级别的预测任务,数据集广泛涵盖科学、社交网络和异构知识图等领域,并适应从单GPU到多GPU的处理需求。OGB为研究人员提供了简化数据下载、标准化拆分和性能评估的便利工具。
AI-Competition-Collections - 全面的AI竞赛经验和技巧开源资源集
AI比赛经验Github开源项目数据竞赛机器学习自然语言处理计算机视觉
这是一个综合性AI竞赛资源库,囊括计算机视觉、自然语言处理、语音识别等领域的比赛经验和技巧。项目汇总了顶级赛事的解决方案,同时提供竞赛平台和相关公众号信息。对AI开发者和竞赛参与者而言,此资源库提供了丰富的学习和参考材料。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号