Phi-CAT

在连续对抗训练中优化Phi-3-mini-4k模型

Huggingface 机器学习对抗性训练开源项目模型 Continuous Adversarial Training Phi-3-mini-4k-instruct Github 大语言模型

该项目通过Continuous Adversarial Training（CAT）算法，对Phi-3-mini-4k-instruct模型进行优化，增强其对抗性攻击的抵御能力，提升鲁棒性。项目详细信息可在Github查阅，有关研究发表在arXiv。

Sophia - 随机二阶优化器提升语言模型预训练效率

GithubSophia优化器开源项目机器学习语言模型预训练

Sophia是一种为大规模语言模型预训练设计的随机二阶优化器。它通过支持更大学习率，提高了训练速度和模型性能。该项目提供Sophia-G优化器的实现，包含超参数调优指南和GPT-2训练脚本，方便研究人员应用这一优化技术。Sophia适用于GPT-2等不同规模的模型，展现了良好的扩展性。

ATTACK-BERT - ATT&CK BERT网络安全语义分析模型

ATT&CK BERTGithubHuggingface句子嵌入开源项目模型网络安全语义相似度语言模型

ATT&CK BERT是一个专门针对网络安全领域的语言模型，基于sentence-transformers框架开发。该模型能够将描述攻击行为的句子转化为语义嵌入向量，有效分析句子间的语义相似度。ATT&CK BERT通过sentence-transformers库实现简单部署，还可与SMET工具配合使用，实现文本到ATT&CK技术的映射，为网络安全分析提供有力支持。

VLM2Vec-Full - 视觉语言模型VLM2Vec的多模态嵌入训练方法

GithubHuggingfaceTIGER-LabVLM2Vec多模态嵌入对比学习开源项目模型视觉语言模型

VLM2Vec在Phi-3.5-V模型中引入EOS标记，实现跨多模态输入的统一嵌入表达，高效结合文本与图像。通过对比学习在MMEB-train数据集上训练，并在36个数据集上进行评估，Lora训练方式表现最佳。项目提供模型检查点及完整训练记录，供用户在GitHub仓库克隆下载，通过代码实现文本与图像的嵌入和相似度计算，助力模型运用。

AdobeGigaGANGithubLAIONPyTorchStabilityAI开源项目

gigagan-pytorch项目实现了Adobe最新的生成对抗网络GigaGAN，优化了跳层激励和辅助重建损失，以提升训练收敛速度和模型稳定性。项目支持高分辨率上采样器，具备混合精度和多GPU训练功能。适合寻求高效稳定GAN训练的开发者和研究人员。可加入Discord社区，与LAION合作获取更多支持。

ALLaVA - GPT4V合成数据集助力轻量级视觉语言模型训练

ALLaVAGPT-4VGithub开源项目微调数据集视觉语言模型

ALLaVA项目推出大规模GPT4V合成数据集，旨在促进轻量级视觉语言模型的训练。项目发布了ALLaVA-Phi3-mini-128k、ALLaVA-StableLM2-1_6B和ALLaVA-Phi2-2_7B等多个模型版本，可直接从Hugging Face仓库加载。ALLaVA-4V数据集整合了LAION和Vision FLAN的图像标注与指令数据，以及GPT-4-Turbo生成的文本指令，总样本量超过140万。这一资源为视觉语言模型研究提供了丰富的训练数据和预训练模型，有望推动该领域的进一步发展。

v3_1_pt_ep1_sft_5_based_on_llama3_1_8b_final_data_20241019 - 探索先进的自然语言处理开源模型及其实际应用

GithubHuggingfacetransformers开源项目模型模型卡环境影响训练细节语言模型

了解先进自然语言处理开源模型的信息，包括用途、评估方法及风险提示。虽然详细信息未完全披露，但以上内容可为开发和应用提供重要参考。

pythia-12b-deduped - 面向解释性研究的大模型工具集

EleutherAIGithubHuggingfacePythiaPython大语言模型开源项目文本预测模型

Pythia Scaling Suite是EleutherAI开发的用于解释性研究的大语言模型集合。该套件包含八种尺寸的模型，每种尺寸有去重和非去重版本，均在相同的数据集和顺序下训练，提供科学实验的受控环境，支持对大型语言模型的行为与功能研究。用户可以在Hugging Face上获取154个中间检查点，并通过开源代码库进行调整和扩展。

SPIN - 通过使用自对弈机制提升语言模型性能

GithubHugging FaceLanguage ModelSPINfine-tuningself-play开源项目

SPIN项目通过使用自对弈机制提升语言模型性能，无需额外的人类注释数据。模型通过生成自旋数据并与其先前版本对弈来优化策略。多项基准测试结果表明，SPIN显著提升模型表现，超过直接偏好优化方法。开源的完整代码和训练脚本提供了从数据生成到模型微调的全套流程。

siglip-so400m-patch14-224 - 增强图像文本任务的性能，探索形状优化模型

GithubHuggingfaceSigLIPWebLI对比学习开源项目模型视觉零样本图像分类

SigLIP通过sigmoid损失函数优化了CLIP模型的图像和文本匹配性能。此模型在WebLi数据集上预训练，可实现更大的批量训练，同时在小批量下表现出色。适用于零样本图像分类和图像文本检索任务，能在不同环境下获得高效结果。该模型在16个TPU-v4芯片上训练三天，而图像预处理中使用标准化和归一化，提升了计算效率。

adversarial-robustness-toolbox - 机器学习安全与对抗性威胁防护库

Adversarial Robustness ToolboxGithubLinux Foundation AI & Data对抗性威胁开源项目机器学习安全模型防御

Adversarial Robustness Toolbox (ART) 是由 Linux Foundation AI & Data Foundation 托管的 Python 库，为开发者和研究人员提供评估和防护机器学习模型的工具，以抵御规避、投毒、提取和推理等对抗性威胁。ART 支持所有流行的机器学习框架（如 TensorFlow、Keras、PyTorch 等），适用于各种数据类型（图像、表格、音频、视频等）和任务（分类、目标检测、语音识别等）。持续开发中，欢迎反馈和贡献。

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com