Mar, 2024

JDocQA: 用于生成语言模型的日语文档问答数据集

TL;DR日本文献の質問応答 (JDocQA) は、PDF形式の5,504の文書と日本語でアノテーションされた11,600の質問応答インスタンスから成る大規模な文書ベースのQAデータセットであり、質問応答アプリケーションにおいて実用的な質問を提供するために回答不可能な質問を組み込んでいます。