Views
No views yet
| Property | Value |
|---|---|
| Architecture | LLaMA (decoder-only transformer) |
| Parameters | ~50M |
| Vocab size | 32,768 |
| Embedding dim | 256 |
| Hidden dim | 2048 |
| Layers | 20 |
| Attention heads | 128 |
| KV groups | 64 |
| Context length | 256 |
| Tokenizer | turkish_tokenizer (alibayram) |
| Dataset | habanoz/news-tr-1.8M |
| Tokens seen | 372,679,971 |
| Epochs | 2 |
| Batch size | 64 |
| Language | Turkish 🇹🇷 |
llama_50m_tr_tokenizer_news is a 50 million parameter Turkish language model trained from scratch on the habanoz/news-tr-1.8M dataset.