本研究数据集是 txz32102/pediamed-mdle-challenge 的简体中文机器翻译版本。
本数据集包含 412 道简体中文医学问题,来自 401 篇病例报告;其中 216 道包含图像。
其中 406 道题的题干、标准答案、推理、评分量表、证据和评测说明作为一个完整 JSON,使用 Qwen/Qwen3.5-27B-FP8 一次性翻译。另有 6 道题因完整输出达到长度上限,关闭思考后按有界 JSON 槽位分批重译并按原结构合并。程序检查返回 JSON 的结构或槽位键,不进行数字、单位、缩写或措辞校验。
原有 Gemini 与 Opus 分数来自英文题目,不代表模型在中文译本上的表现。证据引文是机器翻译,不是论文原文。数据仅供研究评估,不得用于患者诊疗决策。
images:List[Image],图片字节已嵌入 Parquet,可在 Dataset Viewer 中直接渲染。… See the full description on the dataset page:
https://huggingface.co/datasets/txz32102/pediamed-mdle-challenge-zh.