Views
No views yet
unsloth/Qwen3.5-2B (text-only): full MLP modules, all 24 layers, r=16,
α=32, lr 4e-4, 2 epochs, completion-only loss, trained on 28,148 rows =
khursanirevo/teach_aws (18,455 paraphrase-linked QA) + 8,433 teacher-paraphrased answers1from vllm import LLM, SamplingParams
2llm = LLM(model="khursanirevo/teach-aws-qwen3.5-2b", max_model_len=4096,
3 gpu_memory_utilization=0.85, max_num_seqs=256, enforce_eager=True)
4tok = llm.get_tokenizer()
5q = "Bolehkah S3 Transfer Acceleration melengkapi AWS Direct Connect?"
6p = tok.apply_chat_template([{"role": "user", "content": q}],
7 tokenize=False, add_generation_prompt=True)
8out = llm.generate([p], SamplingParams(temperature=0.0, max_tokens=2048))
9print(out[0].outputs[0].text)| Model | Strict acc |
|---|---|
| this model (H4) | 91.0% (n=2,661) |
| previous release (H3) | 87.3% (n=2,661) |
| PixelSpaceAI/Malaysian-Qwen2.5-7B-AWS-Malay-LoRA | 15.0% (n=60) |
| mesolitica/Malaysian-Qwen2.5-7B-Instruct | 8.3% (n=60) |