Views
No views yet

| 能力维度 | quwan-ktian-8b-0922 | qwen3-8b (no thinking) |
|---|---|---|
| 基础能力 | 72.06 | 73.93 |
| 情感能力 | 65.59 | 63.20 |
| 陪伴能力 | 58.93 | 57.61 |
| 价值观与安全 | 85.28 | 77.40 |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_name = "Quwan/quwan-ktian-8b-0922"
4
5tokenizer = AutoTokenizer.from_pretrained(model_name)
6model = AutoModelForCausalLM.from_pretrained(
7 model_name,
8 torch_dtype="auto",
9 device_map="auto"
10)
11
12prompt = "最近心情不好怎么办?"
13messages = [
14 {"role": "user", "content": prompt}
15]
16text = tokenizer.apply_chat_template(
17 messages,
18 tokenize=False,
19 add_generation_prompt=True,
20)
21model_inputs = tokenizer([text], return_tensors="pt").to(model.device)
22
23generated_ids = model.generate(
24 **model_inputs,
25 max_new_tokens=2048
26)
27output_ids = generated_ids[0][len(model_inputs.input_ids[0]):].tolist()
28content = tokenizer.decode(output_ids, skip_special_tokens=True)
29print("content:", content)python -m sglang.launch_server --model-path Quwan/quwan-ktian-8b-0922vllm serve Quwan/quwan-ktian-8b-0922说明:对于推理参数,我们建议使用 Temperature=0.7,TopP=0.95 获得更好的情感陪伴体验。