Project Icon

free-solar-evo-v0.1

创新进化模型合并的客观探索

free-solar-evo-v0.1项目展示了进化模型合并的潜在应用,受Sakana项目启发,建立在hwkwon/S-SOLAR-10.7B-v1.5模型之上,由Freewheelin团队开发。

evolutionary-model-merge - 进化模型合并技术优化人工智能性能
EvoLLMEvoVLMGithub人工智能开源项目模型融合进化优化
evolutionary-model-merge项目展示SakanaAI开发的进化模型合并技术。该技术通过优化合并多个源模型,创造性能更优的新模型。项目提供改进的日语语言和视觉语言模型,在数学推理、通用任务和视觉问答方面取得显著提升。项目还包含评估代码和实验结果,为AI研究提供重要资源。
EvoLLM-JP-v1-7B - 探索日语语言模型的进化潜力
EvoLLM-JP-v1-7BGithubHuggingfaceSakana AI开源项目日语模型演化模型合并研究开发
EvoLLM-JP-v1-7B是由Sakana AI开发的实验性日语语言模型,采用进化模型合并方法,由多个源模型合并而成。用户可通过Hugging Face平台在研究与开发领域利用该模型,尽管其提供了语言处理的新机遇,但尚未针对商业用途进行验证,需谨慎应用。
SOLAR-10.7B-Instruct-v1.0 - 高效小巧的大型语言模型在多项NLP任务中超越更大规模对手
GithubHuggingfaceSOLAR-10.7B单轮对话大语言模型开源项目指令微调模型深度扩展
SOLAR-10.7B是一个参数量为10.7B的大型语言模型,通过创新的深度上扩展方法开发。该模型在多项自然语言处理任务中表现出色,经常超越参数量更大的模型。SOLAR-10.7B采用了监督微调和直接偏好优化等先进技术进行指令微调,展现出优秀的性能、鲁棒性和适应性,为进一步微调提供了良好基础。
SOLAR-10.7B-v1.0 - 深度扩展技术驱动的大语言模型实现超30B参数级性能
GithubHuggingfaceSOLAR-10.7B人工智能大模型开源项目模型深度学习语言模型
SOLAR-10.7B采用深度扩展(DUS)技术开发,通过整合Mistral 7B权重和持续预训练,实现10.7B参数达到30B级模型性能。在H6评测中得分74.20,高于Mixtral-8x7B等大型模型。模型以Apache-2.0许可开源发布,提供完整预训练版本。
evo-1-8k-base - 高效的生物长序列建模与设计的深度信号处理模型
EvoGithubHuggingfaceStripedHyena基因组学开源项目模型模型架构深度信号处理
Evo是一个基于生物的基础模型,通过StripedHyena架构支持长序列建模与设计。Evo拥有7亿参数,可在单核苷酸和字节级别进行建模,并在计算和内存使用上实现接近线性的扩展。Evo-1-8k-base模型适用于8,192上下文长度的分子层面微调,是Evo家族中的第一款产品。此模型不仅支持高效的自动回归生成,还能快速处理长上下文训练和微调,在自然语言和生物序列的大规模数据处理中展示出色的扩展性。作为开源科学的组成部分,该项目提供15个阶段的中间预训练检查点以供研究使用。
Sakura-SOLAR-DPO - 开源大语言模型性能新突破
DPOGithubLLMSakura-SOLAR开源项目模型性能训练代码
Sakura-SOLAR-DPO项目通过模型融合和DPO训练技术,使SOLAR模型在开源大语言模型排行榜上跃居首位。该项目在ARC、HellaSwag等多项基准测试中表现卓越,展现了强大的通用能力和数学推理水平。项目公开了详细的训练代码、超参数配置和提示词模板,为开源AI社区提供了宝贵的技术参考。
evo - 实现跨尺度DNA序列建模与设计的开源工具
DNA建模EvoGithub基因组尺度序列设计开源项目生物基础模型
Evo是一个开源的生物基础模型,专注于DNA序列的长上下文建模和设计。基于StripedHyena架构,Evo实现了单核苷酸级别的序列建模,具有近乎线性的计算和内存扩展性。该模型拥有70亿参数,在OpenGenome数据集上训练,包含约3000亿个原核全基因组标记。Evo提供8K和131K上下文长度的预训练模型,适用于从分子到基因组尺度的序列分析和生成任务。研究人员可通过HuggingFace和Together API等多种方式使用Evo,为DNA序列研究提供了强大而灵活的工具。
StopCarbon-10.7B-v5 - 使用slerp方法合并创建的实验性AI模型
GithubHuggingfaceStopCarbonmergekitslerp实验模型开源项目模型模型合并
StopCarbon-10.7B-v5是一个利用mergekit工具合并多个模型的实验性项目,包括Sakura-SOLAR-Instruct和CarbonVillain-en-10.7B-v1。该项目采用slerp方法进行模型合并,以研究其潜在用途和应用场景。
Sakura-SOLAR-Instruct-CarbonVillain-en-10.7B-v2-slerp - 通过LazyMergekit实现模型融合,探索AI创新应用
CarbonVillain-en-10.7B-v2GithubHuggingfaceLazyMergekitNeuralPipe-7B-slerpSakura-SOLAR-Instruct开源项目模型模型融合
NeuralPipe-7B-slerp项目使用LazyMergekit将CarbonVillain-en-10.7B-v2与Sakura-SOLAR-Instruct模型相结合,提供优化的AI解决方案。采用slerp方法实现模型层的组合与自然文本生成,适合多种应用场景。其高效的浮点16位数据类型和自适应设备映射提升性能表现,为AI开发者提供有力支持。
LDCC-SOLAR-10.7B - 基于SOLAR方法的深度学习模型,应用于数据通信与工程
GithubHuggingfaceLDCC-SOLAR-10.7BSOLAR论文开源项目模型模型优化深度学习硬件
项目详细描述了使用A100硬件和DeepSpeed、HuggingFace库训练的深度学习模型,通过SOLAR方法实现优化。建议使用特定版本的tokenizer文件进行模型精调,该模型适用于AI技术的多种应用场景。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号