This model is a fine-tuned version of
Qwen/Qwen3-8B on the /e/scratch/jureap59/raoof1/sft_data/hf_hub/datasets--DCAgent--g1_min_episodes_e1_gpt_long_d1_original_40k_glm47_traces_1k/snapshots/09c22b498460fd0ed83413eec6dbf62be30d205a_thinking_preprocessed dataset.