SLM Synthetic DPO — code_explanation_no_code
Summary
Synthetic preference-pair dataset containing chosen and rejected assistant responses for code_explanation_no_code.
Dataset type: preference optimization
Total pairs: 6429
Signal: code_explanation_no_code
Language: English
Category: general_instruction_following
Difficulty: 2
Template family: code_explanation_plain_text
Eval family: code_explanation_no_code… See the full description on the dataset page:
https://huggingface.co/datasets/tohio/slm-synthetic-dpo-code-explanation-no-code.