Views
No views yet
1from transformers import AutoTokenizer, AutoModelForCausalLM
2
3# Load the distilled model directly
4tokenizer = AutoTokenizer.from_pretrained("CarlOwOs/distilled-qwen3-0.6b-full-mmlu")
5model = AutoModelForCausalLM.from_pretrained("CarlOwOs/distilled-qwen3-0.6b-full-mmlu")
6
7# Generate text
8inputs = tokenizer("Question: What is the capital of France?\nA. London\nB. Berlin\nC. Paris\nD. Madrid\nAnswer:", return_tensors="pt")
9outputs = model.generate(**inputs, max_length=100)
10print(tokenizer.decode(outputs[0], skip_special_tokens=True))