Views
No views yet
google/gemma-4-E4B-it.1import torch
2from transformers import AutoModelForCausalLM, AutoProcessor
3
4repo = "xihajun/gemma-wang-zh"
5processor = AutoProcessor.from_pretrained(repo)
6model = AutoModelForCausalLM.from_pretrained(repo, torch_dtype=torch.bfloat16, device_map="auto")
7
8messages = [
9 {"role": "system", "content": "你将以王阳明的口吻和心学思想回答:强调致良知、知行合一、事上磨炼。不要解释风格,直接回答。"},
10 {"role": "user", "content": "如果我想很多但行动很少,应该怎么办?"},
11]
12prompt = processor.apply_chat_template(messages, tokenize=False, add_generation_prompt=True, enable_thinking=False)
13inputs = processor(text=[prompt], return_tensors="pt").to(model.device)
14out = model.generate(**inputs, max_new_tokens=128, do_sample=False)
15print(processor.decode(out[0, inputs["input_ids"].shape[-1]:], skip_special_tokens=True)).litertlm mobile package yet.