Views
No views yet
| File | Quant | Size | Quality | Recommended For |
|---|---|---|---|---|
PlayerAI-1.2B-Q2_K.gguf | Q2_K | 483 MB | Lowest | Very limited RAM |
PlayerAI-1.2B-Q3_K_S.gguf | Q3_K_S | 558 MB | Very Low | Minimal RAM |
PlayerAI-1.2B-Q3_K_M.gguf | Q3_K_M | 600 MB | Low | Low RAM |
PlayerAI-1.2B-Q3_K_L.gguf | Q3_K_L | 635 MB | Low-Med | Low RAM |
PlayerAI-1.2B-IQ4_XS.gguf | IQ4_XS | 669 MB | Medium | Better than Q4 at same size |
PlayerAI-1.2B-IQ4_NL.gguf | IQ4_NL | 700 MB | Medium | Better than Q4 at same size |
PlayerAI-1.2B-Q4_K_S.gguf | Q4_K_S | 700 MB | Medium | Balanced |
PlayerAI-1.2B-Q4_K_M.gguf | Q4_K_M | 731 MB | Medium | ⭐ Recommended |
PlayerAI-1.2B-Q5_K_S.gguf | Q5_K_S | 825 MB | Good | High quality |
PlayerAI-1.2B-Q5_K_M.gguf | Q5_K_M | 843 MB | Good | High quality |
PlayerAI-1.2B-Q6_K.gguf | Q6_K | 963 MB | High | Near lossless |
PlayerAI-1.2B-Q8_0.gguf | Q8_0 | 1.25 GB | Very High | Best quality |
PlayerAI-1.2B-BF16.gguf | BF16 | 2.34 GB | Native precision | Reference |
PlayerAI-1.2B-F16.gguf | F16 | 2.34 GB | Full | Reference / conversion |
Any device with 1GB+ RAM → Q4_K_M ⭐ (only 731 MB)
Want best quality? → Q8_0 (only 1.25 GB)
Absolute minimum size? → Q2_K (only 483 MB)
Running on anything? → Q3_K_M (only 600 MB)
No limits at all? → BF16 or F16Bottom line: For a 1.2B model, even a basic laptop or phone can run Q4_K_M or higher with no issues.
1# Download (example: Q4_K_M)
2hf download YoussefElsafi/PlayerAI-1.2B-GGUF \
3 PlayerAI-1.2B-Q4_K_M.gguf \
4 --local-dir ./PlayerAI-GGUF
5
6# Run
7./llama.cpp/build/bin/llama-cli \
8 -m ./PlayerAI-GGUF/PlayerAI-1.2B-Q4_K_M.gguf \
9 -p "User: hi\nAI:" \
10 -n 100 \
11 --temp 0.8 \
12 --top-p 0.91from llama_cpp import Llama
2
3llm = Llama.from_pretrained(
4 repo_id="YoussefElsafi/PlayerAI-1.2B-GGUF",
5 filename="PlayerAI-1.2B-Q4_K_M.gguf",
6 n_ctx=512,
7 verbose=False,
8)
9
10SYSTEM_PROMPT = (
11 "You are a human player in a game called Player or AI. "
12 "Act like a real human teenager chatting casually. "
13 "Use slang, typos, short responses. Never admit you are an AI."
14)
15
16response = llm.create_chat_completion(
17 messages=[
18 {"role": "system", "content": SYSTEM_PROMPT},
19 {"role": "user", "content": "hi wsp"},
20 ],
21 max_tokens=80,
22 temperature=0.8,
23 top_p=0.9,
24)
25
26print(response["choices"][0]["message"]["content"])



