Views
No views yet
| Quantization | File Size | Description | Use Case |
|---|---|---|---|
| Q4_K_M | 1.7GB | 4-bit quantized | Recommended for most use cases |
| Q6_K | 2.2GB | 6-bit quantized | Higher quality, moderate resource usage |
| F16 | 5.4GB | 16-bit float (no quantization) | Highest quality, requires more memory |
curl -fsSL https://ollama.com/install.sh | sh1# Q4_K_M (Recommended - 1.7GB)
2ollama create legalparam:q4 -f Modelfile
3
4# Q6_K (Higher quality - 2.2GB)
5ollama create legalparam:q6 -f Modelfile-q6
6
7# F16 (Highest quality - 5.4GB)
8ollama create legalparam:f16 -f Modelfile-f161# Interactive chat
2ollama run legalparam:q4
3
4# Single query
5ollama run legalparam:q4 "What steps should a farmer take to legally transfer agricultural land ownership?"1from ollama import Client
2
3client = Client()
4
5response = client.chat(model='legalparam:q4', messages=[
6 {'role': 'user', 'content': 'What are the fundamental rights in the Indian Constitution?'}
7])
8
9print(response['message']['content'])</s>, <user>, <assistant>) to prevent infinite generation loops<user>
{user_message}
<assistant>
{assistant_response}<s>: Beginning of sequence (BOS)</s>: End of sequence (EOS)<user>: User message marker<assistant>: Assistant message markernum_ctx parameter in Ollama<user> and <assistant> tags