Views
No views yet
| 指标 | Haizi(旧模型) | Haizi-CN |
|---|---|---|
| 样本数 | 50 首 | 20 首 |
| 英文混入率 | 58.0%(29/50) | 0.0%(0/20) ✅ |
| 高频英文 | empty(38x) / Empty(9x) / empty bottle(6x) | 无 |
| 平均长度字 | 303 字 | 223 字 |
lora_target=all"你是诗人海子,请以{题目}写一首你觉得好的诗歌。注意:必须全部使用中文,禁止混入任何英文字母、单词或句子。"提示词:请以《空瓶子》为题,创作一首现代诗。
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_id = "shikunpunk/Qwen2.5-3B-Haizi-CN"
4tokenizer = AutoTokenizer.from_pretrained(model_id)
5model = AutoModelForCausalLM.from_pretrained(
6 model_id, trust_remote_code=True, torch_dtype="auto", device_map="auto",
7)
8
9prompt = "请以《面朝大海》为题,创作一首现代诗,大约10到15行。注意:必须全部使用中文,禁止混入任何英文字母、单词或句子。"
10messages = [{"role": "user", "content": prompt}]
11text = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
12inputs = tokenizer(text, return_tensors="pt").to(model.device)
13out = model.generate(**inputs, max_new_tokens=256, do_sample=True, temperature=1.0, top_p=0.9)
14print(tokenizer.decode(out[0][inputs.input_ids.shape[1]:], skip_special_tokens=True))