Views
No views yet
google/gemma-4-E4B-it using
mlx-lm 0.31.3.1from mlx_lm import load, generate
2
3model, tokenizer = load("salohcin714/gemma-4-E4B-it-2bit-mlx")
4messages = [{"role": "user", "content": "Hello"}]
5prompt = tokenizer.apply_chat_template(messages, add_generation_prompt=True)
6text = generate(model, tokenizer, prompt=prompt, verbose=True)LICENSE file for the full text.