Adapted training data (Adaption Labs AutoScientist pipeline, v5) used to fine-tune
Rishidar/autoscientist-healthcare-qlora
(Qwen2.5-0.5B-Instruct, QLoRA SFT + DPO).
healthcare_adapted.jsonl — SFT prompt/completion pairs (enhanced prompts + reasoning traces).
healthcare_v5_raw.csv — full v5 output incl. chosen/rejected preference pairs used for DPO.
Also mirrored on Kaggle: rishidard/autoscientist-healthcare-dataset.