Evaluation of severals chunking strategies for MediaTech's LEGI dataset.
This dataset contains 51 experiments
from the EvalAP evaluation platform.
Datasets: LEGI Synthetic QA Dataset
Metrics: contextual_precision, contextual_recall, contextual_relevancy, faithfulness, judge_precision
Scores
LEGI Synthetic QA Dataset
model
contextual_precision
contextual_recall
contextual_relevancy… See the full description on the dataset page:
https://huggingface.co/datasets/AgentPublic/evalap-mediatechs-legi-chunking-evaluation-v1-116.