Fine-tuned
google/gemma-4-E4B-it for the SANSARA on-device AI journaling app.
Designed for inference via llama.cpp / llama.rn / Ollama on mobile and desktop.
1from llama_cpp import Llama
2llm = Llama(model_path="sansara-gemma4-e4b-Q4_K_M.gguf", n_ctx=2048)