Views
No views yet
1!pip install --quiet bitsandbytes
2!pip install --quiet --upgrade transformers # Install latest version of transformers
3!pip install --quiet --upgrade accelerate
4!pip install --quiet sentencepiece
5pip install flash-attn --no-build-isolation1import torch
2import os
3from torch import bfloat16
4from transformers import AutoTokenizer, AutoModelForCausalLM, pipeline, BitsAndBytesConfig, LlamaForCausalLM1model_id_mistral = "alokabhishek/Mistral-7B-Instruct-v0.2-bnb-8bit"
2
3tokenizer_mistral = AutoTokenizer.from_pretrained(model_id_mistral, use_fast=True)
4
5model_mistral = AutoModelForCausalLM.from_pretrained(
6 model_id_mistral,
7 device_map="auto"
8)
9
10
11pipe_mistral = pipeline(model=model_mistral, tokenizer=tokenizer_mistral, task='text-generation')
12
13prompt_mistral = "Tell me a funny joke about Large Language Models meeting a Blackhole in an intergalactic Bar."
14
15output_mistral = pipe_llama(prompt_mistral, max_new_tokens=512)
16
17print(output_mistral[0]["generated_text"])
18