#large language models
LLM.swift - 多平台兼容的大型语言模型交互Swift库
LLM.swiftSwiftHuggingFaceModellarge language modelsasyncGithub开源项目
`LLM.swift` 是一个简洁易用的库,支持在macOS、iOS、watchOS、tvOS和visionOS上与大型语言模型本地交互。开发者可通过SPM或直接复制代码在Xcode项目中使用。此库基于`llama.cpp`,性能优越,并保持与最新更新同步。其设计允许自定义输入预处理、输出后处理及动态更新功能,并支持从HuggingFace获取模型数据,适用于跨平台高效语言模型交互的需求。
bigscience - 大规模语言模型研究与进展更新
bigscienceMegatron-DeepSpeedlarge language modelsGPT2训练Github开源项目
BigScience项目专注于大规模语言模型的研究与训练,包含丰富的实验、数据集信息和训练进展。用户可以访问详细文档和实时日志,了解当前模型表现及关键发现。项目涵盖从基础GPT-2模型到不同规模与架构的大型模型,并提供详尽的操作流程及讨论记录。