llm-data-creation
llm-data-creation是一个基于大型语言模型的数据生成框架。该项目仅需一个格式示例即可创建多种问答任务的合成数据,通过迭代过程生成更多相同格式的数据。这一方法特别适用于缺乏人工标注数据的场景。项目提供完整的数据创建、模型微调和评估流程,在10个公开基准数据集上的评估显示出优秀的跨域性能。