Views
No views yet
jais-13b-chat by core42. The aim is to run the model in GPU poor machines. For high quality tasks its better to use the 13b model not quantized one.T4 instance.pip install -Uq huggingface_hub transformers bitsandbytes xformers accelerate1from transformers import AutoTokenizer, AutoModelForCausalLM, pipeline, TextStreamer, BitsAndBytesConfig
2
3tokenizer = AutoTokenizer.from_pretrained("erfanvaredi/jais-7b-chat")
4model = AutoModelForCausalLM.from_pretrained(
5 "erfanvaredi/jais-7b-chat",
6 trust_remote_code=True,
7 device_map='auto',
8)
9
10# Create a pipeline
11pipe = pipeline(model=model, tokenizer=tokenizer, task='text-generation')1chat = [
2 {"role": "user", "content": 'Tell me a funny joke about Large Language Models.'},
3]
4prompt = pipe.tokenizer.apply_chat_template(chat, tokenize=False, add_generation_prompt=True)1streamer = TextStreamer(
2 tokenizer,
3 skip_prompt=True,
4 stop_token=[tokenizer.eos_token]
5)1pipe(
2 prompt,
3 streamer=streamer,
4 max_new_tokens=256,
5 temperature=0,
6)