Views
No views yet
1 import torch
2 from transformers import AutoModelForCausalLM, AutoTokenizer
3
4 model_name = "flypg/DeepSeek-R1-Distill-Qwen-14B-Japanese-chat"
5
6 tokenizer = AutoTokenizer.from_pretrained(
7 model_name,
8 )
9
10 model = AutoModelForCausalLM.from_pretrained(
11 model_name,
12 trust_remote_code=True,
13 device_map="auto",
14 torch_dtype=torch.float16
15 )
16 model.eval()
17
18 prompt = "your prompt"
19 inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
20
21 with torch.no_grad():
22 output_ids = model.generate(
23 **inputs,
24 max_new_tokens=100,
25 temperature=0.7,
26 top_p=0.9,
27 do_sample=True,
28 pad_token_id=tokenizer.eos_token_id
29 )
30
31 response = tokenizer.decode(output_ids[0], skip_special_tokens=True)
32 print(response)1@misc{DeepSeek R1-Qwen Model for Chat in Japenese,
2 title={DeepSeek-R1-Distill-Qwen-14B-Japanese-chat: A Fine-Tuned Qwen-based Model for Chat in Japenese},
3 author={flypg},
4 year={2025},
5 howpublished={\url{https://huggingface.co/flypg/DeepSeek-R1-Distill-Qwen-14B-Japanese-chat}},
6 note={Accessed: YYYY-MM-DD}
7}
8
9## Contact
10[kenkun091](https://github.com/kenkun091)
11Please feel free to open an issue.