Views
No views yet
Qwen/Qwen3-0.6B.
Paper: Metacognitive Behavioral Tuning of Large Language Models for Multi-Hop Question Answering.Qwen/Qwen3-0.6B1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3repo = "metacognitive-behavioral-tuning/Qwen3-0.6B-MBT-R"
4tok = AutoTokenizer.from_pretrained(repo)
5model = AutoModelForCausalLM.from_pretrained(repo, dtype="bfloat16", device_map="auto")