Views
No views yet
| Param | Value |
|---|---|
| Parameters | ~12.8B total, ~8B active |
| Layers | 80 |
| Hidden | 2048 |
| Heads | 8 × 128d |
| Experts | 16 (top-2) |
| Vocab | 262K |
| Context | 128K native, 1M with YaRN |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2model = AutoModelForCausalLM.from_pretrained("BeheraBoi/yasha-8b-abliterated")
3tokenizer = AutoTokenizer.from_pretrained("BeheraBoi/yasha-8b-abliterated")