This model is a fine-tuned version of
Qwen/Qwen3-8B on the /e/scratch/jureap59/raoof1/sft_data/hf_hub/datasets--DCAgent--All_Puzzles_5k-sandboxes_10k_glm_4.7_traces_jupiter/snapshots/e84e3c6f83f0c9ecc35b2c56f1bb1f5d6e1f678a_thinking_preprocessed dataset.