Views
No views yet
1!pip install --no-deps "xformers<0.0.27" "trl<0.9.0"
2!pip install peft accelerate bitsandbytes triton1 from transformers import AutoTokenizer, AutoModelForCausalLM
2
3 model_name = "TilQazyna/llama-kaz-instruct-8B-1"
4 hf_token = "<ENTER YOUR TOKEN>"
5
6 # enable load_in_4bit=True for faster results but slighlty lower accuracy
7 model = AutoModelForCausalLM.from_pretrained(model_name, load_in_8bit=True, use_auth_token=hf_token)
8 tokenizer = AutoTokenizer.from_pretrained(model_name, use_auth_token=hf_token)1 from transformers import TextStreamer
2 inputs = tokenizer("Тапсырма: Келесі мәтіндегі пунктуацияларды және грамматикалық қателерді дұрыста. \n\nМәтін: Жаналыктар леби осиндай \n\nЖауабы:", return_tensors="pt")
3 text_streamer = TextStreamer(tokenizer)
4 _ = model.generate(**inputs, streamer = text_streamer, max_new_tokens = 128)