Views
No views yet
yejin-korean-1b-v8-sft는 한국어 172GB+ 고품질 코퍼스로 100% 바닥부터 사전학습(Pre-trained from Scratch)된yejin-korean-1b-v8베이스 모델에 KMMLU, KoAlpaca, 한국어 교과서 지시문을 결합하여 지도 미세조정(Supervised Fine-Tuning)을 완료한 1B 한국어 소형 파운데이션 모델입니다.
hidden=2048, layers=18, heads=16, kv_heads=4, intermediate=5632, GQA 4:1, RoPE θ=10000)EleutherAI/polyglot-ko-1.3b (어휘 크기: 30,003)safetensors (Float32 / BFloat16)1import torch
2from transformers import AutoModelForCausalLM, AutoTokenizer
3
4model_id = "cooler8/yejin-korean-1b-v8-sft"
5tokenizer = AutoTokenizer.from_pretrained(model_id)
6model = AutoModelForCausalLM.from_pretrained(model_id, torch_dtype=torch.float32, device_map="auto")
7
8prompt = "### 지시사항:\n인공지능이란 무엇인지 초등학생도 알기 쉽게 설명해줘.\n\n### 답변:\n"
9inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
10
11output = model.generate(
12 input_ids=inputs["input_ids"],
13 attention_mask=inputs["attention_mask"],
14 max_new_tokens=200,
15 temperature=0.7,
16 top_p=0.9,
17 repetition_penalty=1.15
18)
19
20print(tokenizer.decode(output[0], skip_special_tokens=True))1### 지시사항:
2{사용자 질문 또는 지시문}
3
4### 답변:
5{모델 생성 답변}