Views
No views yet
Qwen/Qwen3-1.7Bq4f16_1 (group size 32, int4 weights + f16 scales)chatml ← match runtime prompt formatting with trainingmlc-chat-config.jsonparams_shard_*.bintensor-cache.jsontokenizer.json + vocab.json + merges.txt)mlc_llm chat HF://raining-codes/Qwen3-1.7B-LOMO-q4f16_1-MLC2 --temperature 0.7 --top-p 0.9 --max-gen-len 256raining-codes/Qwen3-1.7B-LOMO-q4f16_1-MLC2.