Views
No views yet

ollama run hf.co/electron271/graig-alpha:Q4_K_Mtemperature = 0.6top_k = 20min_p = 0.00 (llama.cpp's default is 0.1)top_p = 0.95presence_penalty = 0.0 to 2.0 (llama.cpp default turns it off, but to reduce repetitions, you can use this) Try 1.0 for example.262,144 context natively but you can set it to 32,768 tokens for less RAM useelectron271@allthingslinux.org.