May, 2024

在生物医学 NLP 中对检索增强的大型语言模型进行基准测试:应用、稳健性和自我意识

TL;DR本文通过系统调查研究,评估了检索增强型大型语言模型在 5 个不同的生物医学任务(三元组抽取、链接预测、分类、问题回答和自然语言推理)中的影响,并在医学领域建立了四个不同的测试组,测试了三个代表性的大型语言模型与三个不同的检索器在 9 个数据集上的性能。