Project Icon

param

全面评估AI训练平台性能的综合基准测试套件

PARAM (PyTorch based Arbitrary Range Micro-benchmarks) Benchmarks是一个评估AI训练和推理平台的综合基准测试库。它包括通信和计算微基准测试以及完整工作负载,弥补了独立C++基准测试和应用级基准测试之间的空白。PARAM能够深入分析系统架构和框架级开销,涵盖通信、计算和端到端工作负载评估。该开源项目采用MIT许可证,欢迎社区贡献。

benchmark - 开源基准测试集评估PyTorch性能
GithubPyTorch基准测试安装开源项目性能评估模型
PyTorch Benchmarks是评估PyTorch性能的开源基准测试集。它提供修改过的流行工作负载、标准化API和多后端支持。项目包含安装指南、多种基准测试方法和低噪声环境配置工具。支持自定义基准测试和库集成。通过夜间CI运行,持续评估PyTorch最新版本性能。
benchmarks - TensorFlow模型性能评估工具集
CNNGithubPerfZeroTensorFlow基准测试开源项目性能评估
TensorFlow benchmarks 是一个用于评估TensorFlow模型性能的开源工具集。它主要包含PerfZero基准测试框架,同时还保留了不再维护的CNN基准测试脚本。这些工具可用于测试各种神经网络模型的性能,进行跨平台比较,以及优化深度学习应用。对于研究TensorFlow模型性能的开发者,这是一个有价值的资源。
benchmarks - 主流机器学习库全面性能基准测试
CatBoostGPU加速Github基准测试开源项目性能比较机器学习
Benchmarks是GitHub上的开源项目,致力于多个主流机器学习库的性能对比。该项目涵盖CatBoost、XGBoost、LightGBM和H2O等库,对比范围包括二元分类、训练速度、模型评估、排序任务和SHAP值计算。此外还提供CPU与GPU性能对比和Kaggle竞赛数据集上的质量评估。这些全面的基准测试为机器学习从业者提供了客观的性能参考数据。
FrameworkBenchmarks - Web应用框架性能评测开源基准项目
GithubTechEmpowerWeb应用框架开源项目性能测试框架基准测试
FrameworkBenchmarks是一个对Web应用框架进行性能评测的开源项目。它测试多种编程语言框架,包括Go、Python和Java等,评估纯文本响应、JSON序列化和数据库操作等性能。作为业内权威的Web框架性能评测平台,FrameworkBenchmarks为开发者提供了宝贵的参考依据。该项目提供客观数据,助力开发者选择合适框架。社区可参与贡献,持续扩展测试范围。
bench - LLM性能评估与工作流标准化工具
BenchGitHubGithubLLMpython开源项目评估
Bench是一款适用于生产环境的LLM评估工具,支持比较不同的LLM、提示词和生成超参数(如温度和令牌数量)。它提供统一接口,实现LLM评估流程标准化,可测试开源LLM在特定数据上的表现,并将排行的排名转化为实际用例评分。用户可以安装Bench、创建并运行测试套件,通过本地UI查看结果。
promptbench - 大语言模型的评估与理解综合工具包
GithubPrompt EngineeringPromptBench大语言模型对抗性提示开源项目评估
基于Pytorch的Python包,提供评估和理解大语言模型的友好API。支持快速模型性能评估、提示工程、对抗性提示评估和动态评估框架。兼容多种模型(如GPT-4、Llama2、BLIP2)和数据集(如GLUE、SQuAD、VQAv2)。适合研究人员和开发者使用与扩展。
benchmark - Google Benchmark C++性能基准测试库
BenchmarkC++Github代码优化开源库开源项目性能测试
Google Benchmark是一个C++性能基准测试库,用于精确测量代码片段的执行效率。它支持C++03以上版本,提供简洁API便于开发者对比代码性能。该库具备详细文档、跨平台兼容性和CMake集成,是一个强大的代码性能分析工具。
Parameter-Efficient-Transfer-Learning-Benchmark - 统一视觉参数高效迁移学习评测基准
GithubV-PETL Bench参数高效迁移学习基准测试开源项目模型评估计算机视觉
V-PETL Bench是一个统一的视觉参数高效迁移学习评测基准。该项目选择30个多样化数据集,涵盖图像识别、视频动作识别和密集预测任务,评估25种主流PETL算法。提供模块化代码库和完整训练资源,为计算机视觉研究提供全面评测平台。
TabularBenchmarks - 机器学习算法在表格数据上的性能评估基准
Github开源项目性能评估数据集机器学习算法表格数据
TabularBenchmarks是一个开源项目,提供多种数据集和评估脚本,用于测试机器学习算法在表格数据上的性能。项目将数据集存放在input文件夹,算法实现则位于scripts文件夹。这些资源使研究人员能够客观比较不同算法处理表格数据的效果,有助于为特定任务选择合适的算法。
BIG-bench - 评估大型语言模型能力的开放基准
BIG-benchGithub任务创建基准测试开源项目模型评估语言模型
BIG-bench是一个开放的基准测试项目,致力于评估大型语言模型的能力并预测其未来发展。该项目包含200多个多样化任务,涉及算术、推理等多个领域。研究人员可通过JSON或编程方式贡献新任务,并利用公开模型进行评估。BIG-bench Lite作为24个精选任务的子集,提供了高效的模型性能评估方法。这一平台为深入研究语言模型能力提供了宝贵资源。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号