EMNLPOct, 2023

探索 GPT-4 在放射学领域的边界

TL;DR本论文评估了目前最先进的大型语言模型 GPT-4 在放射学报告的文本应用中的表现,探索了各种提示策略,并发现 GPT-4 在常见放射学任务中表现要优于或与目前最先进的放射学模型相媲美。针对需要学习特定样式或架构的任务,GPT-4 通过基于示例的提示得到改进并与监督的最先进模型相匹配。通过与一名获得认证的放射科医生的广泛错误分析表明,GPT-4 在放射学知识方面具备足够水平,只偶尔在需要微妙领域知识的复杂上下文中出现错误。针对发现的总结,GPT-4 的输出整体上与现有的人工编写印象相当。