This dataset contains 10 experiments
from the EvalAP evaluation platform.
Datasets: MFS_questions_v01
Models evaluated: mistralai/Mistral-Small-3.2-24B-Instruct-2506
Metrics: contextual_relevancy, generation_time, judge_precision, output_length
model
contextual_relevancy
generation_time
judge_precision… See the full description on the dataset page:
https://huggingface.co/datasets/AgentPublic/evalap-albert-rag-assistant-ia-qa-v4-10-25-76.