Bỏ qua để đến nội dung
Search & RAG

8. Bảng quyết định — chọn metric nào

Tình huốngMetric chínhMetric phụ / kiểm tra
Tuning retrieval (BM25 params, embedding model)nDCG@10recall@100 để check trần
Chọn kretrievek_{\text{retrieve}} cho pipelinerecall@k vẽ theo kklatency, chi phí
Tuning rerankernDCG@5Δ\Delta so với trước rerankMRR, recall@5
Golden set 1 doc đúng/truy vấnMRR (≡ MAP)Success@k
Nhiều doc liên quan, nhãn nhị phânMAPR-Precision
Nghi ngờ kết quả trùng lặp/dư thừaERRα-nDCG nếu cần đo diversity thật
Nhãn không hoàn chỉnh, corpus lớnRBP + residualbpref, infAP
Đo chi phí context windowPrecision@k (kèm trần)số token vô ích
Báo cáo cho stakeholderSuccess@5nDCG@5
Đánh giá RAG end-to-endFaithfulness + Answer RelevanceContext Recall, Citation Accuracy
Phần 2 — Metrics