Views
No views yet
1from transformers import AutoModelForCausalLM, BitsAndBytesConfig
2
3quantization_config = BitsAndBytesConfig(load_in_4bit=True)
4
5model = AutoModelForCausalLM.from_pretrained("Majipa/text-to-SQL",
6 device_map="cuda",
7 torch_dtype="auto",
8 quantization_config=quantization_config)
9from transformers import AutoModelForCausalLM, AutoTokenizer, pipeline
10
11tokenizer = AutoTokenizer.from_pretrained("microsoft/Phi-3-mini-4k-instruct")
12
13messages = [
14 {"role": "system", "content": "You are a helpful text-to-SQL assistant."},
15 {"role": "user", "content": "question: How many heads of the departments are older than 56 ? context: CREATE TABLE head (age INTEGER)"},
16]
17
18pipe = pipeline(
19 "text-generation",
20 model=model,
21 tokenizer=tokenizer,
22)
23
24generation_args = {
25 "max_new_tokens": 500,
26 "temperature": 0.7,
27}
28
29output = pipe(messages, **generation_args)
30print(output[0]['generated_text'])