Views
No views yet
[!NOTE] Read our blog post to learn more about using Gemma 4 withnode-llama-cpp
google/gemma-4-31B-it.| Link | URI | Quant | Size |
|---|---|---|---|
| GGUF | hf:giladgd/gemma-4-31B-it-GGUF:Q2_K | Q2_K | 11.9GB |
| GGUF | hf:giladgd/gemma-4-31B-it-GGUF:Q3_K_S | Q3_K_S | 13.8GB |
| GGUF | hf:giladgd/gemma-4-31B-it-GGUF:Q3_K_M | Q3_K_M | 15.3GB |
| GGUF | hf:giladgd/gemma-4-31B-it-GGUF:Q3_K_L | Q3_K_L | 16.6GB |
| GGUF | hf:giladgd/gemma-4-31B-it-GGUF:Q4_0 | Q4_0 | 17.7GB |
| GGUF | hf:giladgd/gemma-4-31B-it-GGUF:Q4_K_S | Q4_K_S | 17.8GB |
| GGUF | hf:giladgd/gemma-4-31B-it-GGUF:Q4_K_M | Q4_K_M | 18.7GB |
| GGUF | hf:giladgd/gemma-4-31B-it-GGUF:Q5_0 | Q5_0 | 21.3GB |
| GGUF | hf:giladgd/gemma-4-31B-it-GGUF:Q5_K_S | Q5_K_S | 21.3GB |
| GGUF | hf:giladgd/gemma-4-31B-it-GGUF:Q5_K_M | Q5_K_M | 21.8GB |
| GGUF | hf:giladgd/gemma-4-31B-it-GGUF:Q6_K | Q6_K | 25.2GB |
| GGUF | hf:giladgd/gemma-4-31B-it-GGUF:Q8_0 | Q8_0 | 32.6GB |
| GGUF | hf:giladgd/gemma-4-31B-it-GGUF:BF16 | BF16 | 61.4GB |
[!TIP] Download a quant usingnode-llama-cpp(more info):npx -y node-llama-cpp pull <URI>
node-llama-cpp (recommended)brew install nodejsnpx -y node-llama-cpp chat hf:giladgd/gemma-4-31B-it-GGUF:Q4_K_Mnpm install node-llama-cpp1import {getLlama, resolveModelFile, LlamaChatSession} from "node-llama-cpp";
2
3const modelUri = "hf:giladgd/gemma-4-31B-it-GGUF:Q4_K_M";
4
5
6const llama = await getLlama();
7const model = await llama.loadModel({
8 modelPath: await resolveModelFile(modelUri)
9});
10const context = await model.createContext();
11const session = new LlamaChatSession({
12 contextSequence: context.getSequence()
13});
14
15
16const q1 = "Hi there, how are you?";
17console.log("User: " + q1);
18
19const a1 = await session.prompt(q1);
20console.log("AI: " + a1);[!TIP] Read the getting started guide to quickly scaffold a newnode-llama-cppproject
brew install llama.cppllama-cli -hf giladgd/gemma-4-31B-it-GGUF:Q4_K_M -p "The meaning to life and the universe is"llama-server -hf giladgd/gemma-4-31B-it-GGUF:Q4_K_M -c 2048