Views
No views yet
pip install transformers1# pip install transformers
2from transformers import AutoModelForCausalLM, AutoTokenizer
3checkpoint = "anothy1/SmolLM2-MoE-214M-A135M"
4device = "cuda" # for GPU usage or "cpu" for CPU usage
5tokenizer = AutoTokenizer.from_pretrained(checkpoint)
6model = AutoModelForCausalLM.from_pretrained(checkpoint, trust_remote_code=True).to(device)
7inputs = tokenizer.encode("Gravity is", return_tensors="pt").to(device)
8outputs = model.generate(inputs)
9print(tokenizer.decode(outputs[0]))| Metrics | SmolLM2-MoE-214M-A135M | SmolLM2-135M |
|---|---|---|
| HellaSwag | 44.1 | 43.1 |
| ARC Challenge | 30.7 | 29.5 |
| PIQA | 69.3 | 68.2 |
| CommonsenseQA | 19.7 | 19.5 |
| TriviaQA | 5.8 | 4.9 |
| Winogrande | 54.1 | 52.7 |
| OpenBookQA | 36.2 | 32.6 |