Views
No views yet

1pip install accelerate==0.26.1 datasets==2.16.1 dill==0.3.7 gekko==1.0.6 multiprocess==0.70.15 peft==0.7.1 rouge==1.0.1 sentencepiece==0.1.99
2git clone https://github.com/upunaprosk/AutoGPTQ
3cd AutoGPTQ
4pip install -v .1
2from transformers import AutoTokenizer, TextGenerationPipeline,AutoModelForCausalLM
3from auto_gptq import AutoGPTQForCausalLM, BaseQuantizeConfig
4pretrained_model_dir = "iproskurina/opt-13b-gptq-4bit"
5tokenizer = AutoTokenizer.from_pretrained(pretrained_model_dir, use_fast=True)
6model = AutoGPTQForCausalLM.from_quantized(pretrained_model_dir, device="cuda:0", model_basename="model")
7pipeline = TextGenerationPipeline(model=model, tokenizer=tokenizer)
8print(pipeline("auto-gptq is")[0]["generated_text"])pip install -v gptqmodel=="1.8.0" --no-build-isolation
from gptqmodel import GPTQModel
model_id = 'iproskurina/opt-13b-GPTQ-4bit-g128'
model = GPTQModel.load(model_id)
result = model.generate("Uncovering deep insights")[0] # tokens
print(model.tokenizer.decode(result)) # string output