Views
No views yet
InputManifest CRD. Built by Berops.| File | Purpose |
|---|---|
model-*.safetensors | Merged bf16 weights (for vLLM, Transformers) |
*.Q4_K_M.gguf | 4-bit GGUF (for Ollama, llama.cpp) |
chat_template.jinja | Gemma 4 chat template |
vllm serve samuelstolicny/claudie-expert-gemma4-31b --max-model-len 8192ollama run hf.co/samuelstolicny/claudie-expert-gemma4-31b:Q4_K_M1from transformers import pipeline
2pipe = pipeline("text-generation", model="samuelstolicny/claudie-expert-gemma4-31b")
3print(pipe([{"role": "user", "content": "How do I add a GPU node pool in Hetzner?"}]))unsloth/gemma-4-31B-it