Views
No views yet
| Domain | Math (symbolic) |
| Architecture | Qwen3_5ForCausalLM — 32 layers, hidden 2560 |
| Precision | bf16 (merged from FSDP via verl.model_merger) |
| Notes | No-reclaim, sequence-parallel=2 long-context, symbolic math. (Qwen3.5-4B) |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2tok = AutoTokenizer.from_pretrained("hyunseoki/mh-v1b-math-4b-sym-sp2")
3model = AutoModelForCausalLM.from_pretrained("hyunseoki/mh-v1b-math-4b-sym-sp2", torch_dtype="bfloat16")