Views
No views yet
| 항목 | 값 |
|---|---|
| Base Model | HybriKo-117M (Griffin-style Hybrid RNN-Attention) |
| Parameters | 117.8M |
| Architecture | 2:1 RNN-to-Attention ratio (Griffin layers) |
| Max Seq Length | 6144 |
| Best Epoch | 20 (Eval Loss: 0.0502, PPL: 1.05) |
ls, cd, mkdir, rm, cp, mv, find, cat, grep,
head, tail, wc, ps, df, du, top, ping, curl,
chmod, tar, Finish1import torch
2import sentencepiece as spm
3from hybridko.model import HybriKoModel, HybriKoConfig
4
5# Load tokenizer
6sp = spm.SentencePieceProcessor()
7sp.Load("HybriKo_tok.model")
8
9# Load model
10config = HybriKoConfig(
11 d_model=768,
12 n_layers=12,
13 vocab_size=32000,
14 n_heads=12,
15 n_kv_heads=3,
16 ff_mult=3,
17 max_seq_len=6144,
18 dropout=0.0
19)
20model = HybriKoModel(config)
21
22checkpoint = torch.load("pytorch_model.pt", map_location="cpu")
23state_dict = checkpoint.get("model_state_dict", checkpoint)
24model.load_state_dict(state_dict, strict=False)
25model.eval()
26
27# Example prompt (ChatML format)
28prompt = """<|im_start|>system
29You are an AI assistant that helps users execute Linux commands.
30<|im_end|>
31<|im_start|>user
32현재 폴더의 파일 목록을 보여줘
33<|im_end|>
34<|im_start|>assistant
35"""
36
37# Generate
38input_ids = torch.tensor([sp.EncodeAsIds(prompt)])
39with torch.no_grad():
40 output = model.generate(input_ids, max_new_tokens=256)
41print(sp.DecodeIds(output[0].tolist()))| Epoch | Train Loss | Eval Loss | PPL |
|---|---|---|---|
| 10 | 0.8649 | 0.2346 | 1.26 |
| 20 | 0.0968 | 0.0502 | 1.05 |
| 30 | 0.0395 | 0.0517 | 1.05 |
| 40 | 0.0249 | 0.0540 | 1.06 |
| 50 | 0.0162 | 0.0549 | 1.06 |
1@misc{hybridko-linuxfc-2026,
2 title={HybriKo-117M-LinuxFC-SFT: Linux Command Function Calling Model},
3 author={Yaongi},
4 year={2026},
5 url={https://huggingface.co/Yaongi/HybriKo-117M-LinuxFC-SFT}
6}