Views
No views yet
| Variant | Description |
|---|---|
lora/ | WindyStandard — our proprietary production baseline. Stable, reliable, optimized for GPU inference. |
lora-ct2-int8/ | WindyStandard · CPU INT8 — CTranslate2 quantized version of WindyStandard. ~25% of the size, 2–4× faster on CPU, no measurable quality loss. |
1from transformers import MarianMTModel, MarianTokenizer
2tokenizer = MarianTokenizer.from_pretrained("WindyWord/translate-tc-big-de-zle", subfolder="lora")
3model = MarianMTModel.from_pretrained("WindyWord/translate-tc-big-de-zle", subfolder="lora")1import ctranslate2
2translator = ctranslate2.Translator("path/to/translate-tc-big-de-zle/lora-ct2-int8")