Views
No views yet
| Attribute | Value |
|---|---|
| Architecture | Decoder-only Transformer (GPT-style) |
| Parameters | 52.94M |
| Layers | 8 |
| Hidden size | 384 |
| Attention heads | 8 |
| Context length | 256 tokens |
| Tokenizer | GPT-2 BPE |
| Framework | PyTorch |
| Precision | FP16 (AMP during training) |
1from transformers import AutoConfig, AutoTokenizer, AutoModelForCausalLM
2
3model_id = "shivamsharma120120/TinyWay-1.0.0"
4
5config = AutoConfig.from_pretrained(
6 model_id,
7 trust_remote_code=True
8)
9
10tokenizer = AutoTokenizer.from_pretrained(
11 model_id,
12 trust_remote_code=True
13)
14
15model = AutoModelForCausalLM.from_pretrained(
16 model_id,
17 config=config,
18 trust_remote_code=True
19)
20
21inputs = tokenizer("Once upon a time", return_tensors="pt")
22
23output = model.generate(
24 **inputs,
25 max_new_tokens=100,
26 temperature=0.8,
27 top_p=0.95,
28 do_sample=True
29)
30
31print(tokenizer.decode(output[0], skip_special_tokens=True))