Views
No views yet
1import torch
2from transformers import (
3 AutoModelForCausalLM,
4 AutoTokenizer,
5 BitsAndBytesConfig,
6 pipeline,
7)
8
9model_repo="jhonparra18/PetroQA-OrpoMistral-7B-Instruct"
10
11# QLoRA config
12bnb_config = BitsAndBytesConfig(
13 load_in_4bit=True,
14 bnb_4bit_quant_type="nf4",
15 bnb_4bit_compute_dtype=torch.float16,
16 bnb_4bit_use_double_quant=True,
17)
18
19# Tokenizer & Model
20TOKENIZER = AutoTokenizer.from_pretrained(model_repo)
21
22MODEL = AutoModelForCausalLM.from_pretrained(
23 model_repo,
24 quantization_config=bnb_config,
25 device_map="auto",
26 attn_implementation="eager"
27)
28
29TEXT_GENERATION_PIPELINE = pipeline(
30 model=MODEL,
31 tokenizer=TOKENIZER,
32 task="text-generation",
33 max_new_tokens=512,
34 do_sample=True,
35 temperature=0.1,
36 device_map="auto",
37)
38
39messages = [
40 {"role": "user", "content": "Como jefe de estado, qué opinas de Ivan Duque?"},
41]
42response=TEXT_GENERATION_PIPELINE(messages)
43print(response)