O
Drummond-1b1-Instruct é um modelo de linguagem focado em seguir instruções e raciocínio em Português (PT-BR). Ele é um
fine-tune do modelo
Tucano-1b1-Instruct, treinado especificamente para gerar cadeias de pensamento ("thinking process") antes de fornecer a resposta final.
Este modelo utiliza a arquitetura herdada do Tucano e foi otimizado para tarefas que exigem raciocínio estruturado com baixo custo computacional.
Para utilizar o modelo, é recomendável usar a formatação de prompt correta para ativar o modo de raciocínio:
1import torch
2from transformers import AutoModelForCausalLM, AutoTokenizer
3
4model_id = "corre-social/Drummond-1b1-Instruct"
5
6tokenizer = AutoTokenizer.from_pretrained(model_id)
7model = AutoModelForCausalLM.from_pretrained(
8 model_id,
9 torch_dtype=torch.bfloat16,
10 device_map="auto"
11)
12
13# Template específico usado no treino
14prompt = """<instruction>Explique como funciona a gravidade de forma simples.</instruction>
15<|im_start|>think"""
16
17inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
18
19outputs = model.generate(
20 **inputs,
21 max_new_tokens=512,
22 do_sample=True,
23 temperature=0.7,
24 top_p=0.9,
25 eos_token_id=tokenizer.eos_token_id
26)
27
28response = tokenizer.decode(outputs[0], skip_special_tokens=True)
29print(response)