Views
No views yet
Qwen/Qwen2.5-Coder-0.5B-Instruct。1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_id = "aiyun123/Qwen2.5-Coder-0.5B-Instruct"
4tok = AutoTokenizer.from_pretrained(model_id)
5model = AutoModelForCausalLM.from_pretrained(
6 model_id,
7 device_map="auto" # 自动选择设备;在 Mac 可走 MPS
8)
9
10prompt = "Write a Python function to check if a number is prime."
11inputs = tok(prompt, return_tensors="pt")
12outputs = model.generate(**inputs, max_new_tokens=256)
13print(tok.decode(outputs[0], skip_special_tokens=True))PYTORCH_ENABLE_MPS_FALLBACK=1,必要时设置 PYTORCH_MPS_HIGH_WATERMARK_RATIO=0.0torch.float16 或启用 device_map="auto"swarm-YYYY-MM-DD(每日/每轮次版本号;后续推送时更新)