MedQuAD
MedQuAD是一个包含47,457对医学问答的大规模数据集,源自12个美国国立卫生研究院(NIH)网站。它涵盖37种问题类型,涉及疾病、药物和其他医疗实体,并附有丰富的语义注释。此外,MedQuAD提供2,479个经人工评判的答案作为QA测试集,可用于评估信息检索和问答系统的性能。这一资源为医学自然语言处理和问答系统研究提供了重要支持。