AhiskaAI-65m-Base-v0.2 is a 65 million parameter Small Language Model (SLM) built from scratch. It is the lightweight member of the AhiskaAI v0.2 family, designed to provide efficient Turkish language understanding on resource-constrained hardware.
A major improvement in the v0.2 release is the adoption of a data-centric training pipeline.
Unlike larger language models, the 65M variant focuses on efficiency while preserving core language understanding abilities.
The objective of this model is not to maximize factual knowledge, but to provide:
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model = AutoModelForCausalLM.from_pretrained("AhiskaAI/AhiskaAI-65m-Base-v0.2")
4tokenizer = AutoTokenizer.from_pretrained("AhiskaAI/AhiskaAI-65m-Base-v0.2")
5
6text = "Türkiye Cumhuriyeti"
7inputs = tokenizer(text, return_tensors="pt")
8
9outputs = model.generate(**inputs, max_new_tokens=50)
10
11print(tokenizer.decode(outputs[0], skip_special_tokens=True))
Trained on NVIDIA RTX 4050 6GB Laptop GPU.
AhiskaAI is an independent open-source initiative dedicated to developing efficient Turkish Small Language Models trained completely from scratch.
Follow us on Hugging Face for updates and new releases.