Views
No views yet
inference-optimization/Kimi-K3-0.40B.kz-transformers/multidomain-kazakh-dataset| Metric | Before | After |
|---|---|---|
| Validation loss | 16.7615 | 4.9539 |
| Validation perplexity | 19,030,254 | 141.72 |
1import torch
2from transformers import AutoModel, AutoTokenizer
3
4model_id = "Eraly-ml/Kimi-K3-0.40B-Kazakh-CPT-step200"
5
6tokenizer = AutoTokenizer.from_pretrained(
7 model_id,
8 trust_remote_code=True,
9)
10
11model = AutoModel.from_pretrained(
12 model_id,
13 trust_remote_code=True,
14 dtype=torch.float16,
15 device_map="auto",
16)
17
18inputs = tokenizer(
19 "Қазақстан —",
20 return_tensors="pt",
21).to(model.device)
22
23output = model.language_model.generate(
24 **inputs,
25 max_new_tokens=100,
26 do_sample=True,
27 temperature=0.8,
28 top_p=0.95,
29)
30
31print(tokenizer.decode(output[0], skip_special_tokens=True))