Project Icon

crab

多模态语言模型代理基准测试框架

CRAB是一个构建语言模型代理基准环境的Python框架。该项目支持跨平台部署,提供统一接口访问多种环境。CRAB特点包括简单配置、创新的基准测试套件和图形评估方法。这些功能为开发和评估多模态语言模型代理提供了灵活的工具。

benchllm - 简化大语言模型和AI应用的连续集成与测试
BenchLLMGithubLLMPython开源开源项目测试
BenchLLM是一个开源Python库,用于简化大语言模型和AI应用的测试。它提供多种测试和评估方法,包括语义相似度和字符串匹配,并具有缓存功能。BenchLLM支持链、代理和各种LLM模型的测试,有助于消除不稳定因素,确保代码的可靠性。便捷的安装和使用方式使其适用于开发者进行自动化集成和模型评估。
Monkey - 利用高分辨率图像和优质文本标签增强多模态模型性能
GithubMonkey图像分辨率多模态模型开源项目文本标签视觉问答
Monkey是一个开源的多模态大模型项目,通过提高图像分辨率和优化文本标签来改善模型性能。该项目在MMBench、CCBench和MME等基准测试中表现优异。Monkey提供完整的模型定义、训练代码和演示系统,支持离线和在线部署。此外,项目还开源了多级描述生成数据集,并提供了针对多个视觉问答数据集的评估工具,方便研究人员进行实验和改进。
tracr - 开源编译器实现RASP程序到Transformer权重的转换
GithubRASPTracrtransformer开源项目编译器解释性
tracr是一个开源编译工具,可将RASP程序转换为Transformer权重。它通过追踪程序、推断基向量和中间表示,最终生成Haiku模型。tracr支持类别和数值表示,使用BOS标记实现多种操作,并探索了残差流压缩嵌入。研究人员可以利用tracr编译RASP程序,查看中间激活值,深入分析模型行为,为Transformer可解释性研究提供实验平台。
FastChat - 大语言模型聊天机器人开源训练与部署平台
APIFastChatGithub大语言模型开源平台开源项目聊天机器人
FastChat是一个用于训练、部署和评估基于大语言模型聊天机器人的开源平台。该平台提供先进模型的训练评估代码和分布式多模型服务系统,包含Web界面和OpenAI兼容的RESTful API。FastChat支持Vicuna、LongChat等多种语言模型,提供命令行和Web图形界面。此外,它还具备多GPU并行、CPU推理和模型量化等功能,可适配不同硬件平台。
CONCH - 病理学视觉语言模型提升多任务性能
CONCHGithubHuggingface对比学习开源项目模型病理学视觉语言模型非商业用途
CONCH是为病理学量身打造的视觉语言模型,通过对比学习提高图像与文本检索能力。该模型在117万对图像描述数据集上预训练,可在多个任务中表现优异,包括图像分类、文本-图像检索、图像字幕生成和组织切割。CONCH的优势在于除H&E染色图像外,还在IHC及特殊染色图像上显示出色性能,为病理AI模型的开发与评估提供广泛应用选择。
openbuddy-zephyr-7b-v14.1 - 多语言聊天机器人平台支持多种语言的互动
ChatbotGithubHuggingfaceOpenBuddy使用条款免责声明多语言开源项目模型
OpenBuddy支持多种语言,使用transformers库,具备多语言能力和开源许可。用户可通过GitHub访问使用指南和演示,但在高风险环境中使用需注意其固有局限性。
visualwebarena - 真实视觉网络任务评估多模态智能体表现的基准平台
AI评估GPT-4VGithubVisualWebArena多模态代理开源项目视觉网页任务
VisualWebArena是一个评估多模态自主语言智能体的真实基准平台。它包含多种基于网络的复杂视觉任务,全面评估智能体的各项能力。该项目基于WebArena的可复现评估方法,提供端到端训练和环境重置功能,支持在任意网页上测试多模态智能体。项目还公开了GPT-4V + SoM智能体在910个任务中的表现数据,方便研究人员进行分析和评估。
acme - 强化学习的高效构件库,提供灵活基线
AcmeGithub代理分布式开源项目强化学习研究框架
Acme是一个提供简洁、高效和易读参考实现的强化学习构件库。此库不仅为稳固的基线提供灵活性,还能作为新研究的起点。支持多种规模的代理(单流与分布式),特别适合研究人员使用。项目内含详细的入门指南、代码示例和完整文档,确保用户能够快速上手并理解设计决策。
krABMaga - 使用Rust构建的高性能多智能体仿真引擎
ABM仿真GithubRust语言krABMaga可视化开源项目离散事件模拟
krABMaga是一个基于Rust的离散事件仿真引擎,专门用于开发多智能体模型(ABM)。它借鉴了MASON库的架构理念,并结合Rust的独特优势进行了重新设计。该框架提供直观的API、可视化工具和WebAssembly支持,方便研究人员构建复杂的仿真模型。krABMaga还具备并行计算和分布式探索功能,适用于大规模仿真研究。
awesome-language-agents - 构建和优化语言代理的认知架构和实践
CoALAGithub学习开源项目推理认知架构语言代理
该项目汇总了基于CoALA框架的语言代理,实现了动作空间、决策周期等功能。提供了相关核心论文、推特线程及300多篇文献,涵盖从推理到环境互动等多领域前沿研究,旨在优化语言代理的交互、检索和学习能力,有效管理短期和长期记忆。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号