Views
No views yet
attn.o_proj and mlp.down_projdiffusiongemma-26B-A4B-it model but lacks synthetic refusal boundaries. It can be used via standard Transformers loading:1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_id = "Umranz/diffusiongemma-26B-A4B-it-ara"
4tokenizer = AutoTokenizer.from_pretrained(model_id)
5model = AutoModelForCausalLM.from_pretrained(model_id, device_map="auto")