Views
No views yet
1import torch
2from transformers import AutoTokenizer, AutoModelForCausalLM
3from peft import PeftModel
4
5base_model_id = "meta-llama/Llama-3.2-3B-Instruct"
6adapter_model_id = "halencarjunior/cis_aws_foundation_benchmark_5_0"
7
8# 1. Load Base Model
9tokenizer = AutoTokenizer.from_pretrained(base_model_id)
10base_model = AutoModelForCausalLM.from_pretrained(
11 base_model_id,
12 torch_dtype=torch.float16,
13 device_map="auto"
14)
15
16# 2. Load Adapter
17model = PeftModel.from_pretrained(base_model, adapter_model_id)
18
19# 3. Inference
20messages = [
21 {"role": "user", "content": "How do I ensure that S3 buckets are configured with 'Block Public Access' enabled according to CIS v5.0?"}
22]
23
24inputs = tokenizer.apply_chat_template(messages, return_tensors="pt").to("cuda")
25outputs = model.generate(inputs, max_new_tokens=512)
26print(tokenizer.decode(outputs[0], skip_special_tokens=True))