Views
No views yet
1from transformers import AutoTokenizer, AutoModelForCausalLM
2from peft import PeftModel
3import torch
4
5# Cargar modelo base
6base_model = "openai/gpt-oss-20b"
7model = AutoModelForCausalLM.from_pretrained(
8 base_model,
9 torch_dtype=torch.bfloat16,
10 device_map="auto"
11)
12
13# Cargar tokenizer
14tokenizer = AutoTokenizer.from_pretrained(base_model)
15if tokenizer.pad_token is None:
16 tokenizer.pad_token = tokenizer.eos_token
17
18# Cargar adaptador LoRA
19model = PeftModel.from_pretrained(model, "LordDenihol/gpt-oss-20b-multiidioma-lora")
20
21# Generar texto
22prompt = "Explica qué es la inteligencia artificial:"
23inputs = tokenizer(prompt, return_tensors="pt")
24
25with torch.no_grad():
26 outputs = model.generate(
27 **inputs,
28 max_new_tokens=200,
29 temperature=0.7,
30 do_sample=True,
31 pad_token_id=tokenizer.eos_token_id
32 )
33
34response = tokenizer.decode(outputs[0], skip_special_tokens=True)
35print(response)1generation_config = {
2 "max_new_tokens": 200,
3 "temperature": 0.7,
4 "top_p": 0.9,
5 "do_sample": True,
6 "repetition_penalty": 1.1
7}