Views
No views yet
bitsandbytes==0.38.0. Please refer to the original model card for details.pip install -U -q sentencepiece transformers accelerate bitsandbytes1import torch
2from transformers import LlamaTokenizer, LlamaForCausalLM
3
4model_name = "ethzanalytics/open_llama_13b-sharded-8bit"
5tokenizer = LlamaTokenizer.from_pretrained(model_name, use_fast=False)
6model = LlamaForCausalLM.from_pretrained(
7 model_name,
8 load_in_8bit=True,
9 device_map="auto",
10)