Views
No views yet
ibm-granite/granite-4.1-30b using
mlx-lm 0.31.3.1from mlx_lm import load, generate
2
3model, tokenizer = load("salohcin714/granite-4.1-30b-8bit-mlx")
4messages = [{"role": "user", "content": "Hello"}]
5prompt = tokenizer.apply_chat_template(messages, add_generation_prompt=True)
6text = generate(model, tokenizer, prompt=prompt, verbose=True)lm_head.weight dropped where the model ties input/output embeddings. No fine-tuning; no added training data.LICENSE file for the full text.