Replymessage unavailable
Kalau task information retrieval pakai metrics information reteieval juga.
Jadi bukan bandingin ground truth jawaban dengan hasil retrieval, itu me campurkan metrics QA dengan IR. Jadi yg benar bandingin ekspektasi chunk retrieval dengan hasil retrieval, nnti bisa didapet precision, recall, accuracy, F1 nya
Sesuaikan metrics yg dipake dengan task nya