Intended for local inference without a GPU via llama.cpp, Ollama, LM Studio, or similar tools.
About the Base Model
mistral-sk-7b-alpaca-slovak-it is a Slovak instruction-following assistant built on top of slovak-nlp/mistral-sk-7b (itself derived from mistralai/Mistral-7B-v0.1). It was fine-tuned with LoRA on the saillab/alpaca-slovak-cleaned dataset — 41,601 Slovak Alpaca-style instructions — and the LoRA adapter was merged back into the base model weights.
1# Create a Modelfile2cat> Modelfile <<'MODELEOF'
3FROM ./mistral-sk-7b-alpaca-slovak-it-Q4_K_M.gguf
45SYSTEM "Si užitočný asistent. Riaď sa jazykom a požadovaným formátom používateľa. Ak používateľ nežiada iný jazyk, odpovedaj po slovensky."
6MODELEOF78ollama create mistral-sk-7b-sk -f Modelfile
9ollama run mistral-sk-7b-sk
Python (llama-cpp-python)
python
1from llama_cpp import Llama
23llm = Llama(4 model_path="mistral-sk-7b-alpaca-slovak-it-Q4_K_M.gguf",5 n_ctx=4096,6 n_gpu_layers=-1,# set to 0 for CPU-only7)89messages =[10{11"role":"system",12"content":(13"Si užitočný asistent. Riaď sa jazykom a požadovaným formátom "14"používateľa. Ak používateľ nežiada iný jazyk, odpovedaj po slovensky."15),16},17{"role":"user","content":"Stručne vysvetli, čo je kvantizácia."},18]1920response = llm.create_chat_completion(21 messages=messages,22 max_tokens=512,23 temperature=0.7,24 top_p=0.95,25)2627print(response["choices"][0]["message"]["content"])
Prompt Format
The model uses the Mistral chat template:
<s>[INST] <<SYS>>
Si užitočný asistent. Riaď sa jazykom a požadovaným formátom používateľa.
Ak používateľ nežiada iný jazyk, odpovedaj po slovensky.
<</SYS>>
Your question here [/INST] Model response </s>
Most tools (llama.cpp, Ollama, LM Studio) apply the template automatically.
Limitations
The model was trained on translated instructions — responses may contain translation artifacts or unnatural phrasing.
It has not been safety-aligned or red-teamed — not suitable for production deployment without additional safeguards.
Slovak is the primary language; strict English-only or multilingual requests may not be followed reliably.
Structured outputs (JSON, tables, citations) should be validated outside the model.
Not intended as a sole source for medical, legal, financial, or other high-stakes decisions.