Views
No views yet
1pip install llcuda
2
3import llcuda
4engine = llcuda.InferenceEngine()
5engine.load_model("gemma-3-1b-Q4_K_M")
6result = engine.infer("What is AI?")
7print(result.text)1# Download model
2huggingface-cli download waqasm86/llcuda-models google_gemma-3-1b-it-Q4_K_M.gguf --local-dir ./models
3
4# Run with llama.cpp
5./llama-server -m ./models/google_gemma-3-1b-it-Q4_K_M.gguf -ngl 26