Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3# 모델 로드
4model = AutoModelForCausalLM.from_pretrained(
5 "chihoonlee10/chihoonlee-27B-SFT-V1.0",
6 torch_dtype="bfloat16",
7 device_map="auto"
8)
9tokenizer = AutoTokenizer.from_pretrained("chihoonlee10/chihoonlee-27B-SFT-V1.0")
10
11# 추론
12messages = [
13 {"role": "system", "content": "당신은 유능한 AI 어시스턴트입니다."},
14 {"role": "user", "content": "한국의 수도는 어디인가요?"}
15]
16
17text = tokenizer.apply_chat_template(
18 messages,
19 tokenize=False,
20 add_generation_prompt=True
21)
22
23inputs = tokenizer([text], return_tensors="pt").to(model.device)
24
25outputs = model.generate(
26 **inputs,
27 max_new_tokens=512,
28 temperature=0.7,
29 top_p=0.9,
30 do_sample=True
31)
32
33print(tokenizer.decode(outputs[0], skip_special_tokens=True))1@misc{chihoonlee-27b-sft-v1,
2 author = {CHI-HOON LEE},
3 title = {chihoonlee-27B-SFT-V1.0: Korean CoT Distilled Model},
4 year = {2026},
5 publisher = {Hugging Face},
6 howpublished = {\url{https://huggingface.co/chihoonlee10/chihoonlee-27B-SFT-V1.0}},
7}
