Views
No views yet
1pip install torch torchvision torchaudio
2pip install accelerate
3pip install transformers1from transformers import AutoModelForCausalLM, AutoTokenizer, set_seed
2import torch
3
4model_path="ibm-ai-platform/micro-g3.3-8b-instruct-1b"
5device="cuda"
6model = AutoModelForCausalLM.from_pretrained(
7 model_path,
8 device_map=device,
9 torch_dtype=torch.bfloat16,
10 )
11tokenizer = AutoTokenizer.from_pretrained(
12 model_path
13)
14
15conv = [{"role": "user", "content":"What is your favorite color?"}]
16
17input_ids = tokenizer.apply_chat_template(conv, return_tensors="pt", thinking=True, return_dict=True, add_generation_prompt=True).to(device)
18
19set_seed(42)
20output = model.generate(
21 **input_ids,
22 max_new_tokens=8,
23)
24
25prediction = tokenizer.decode(output[0, input_ids["input_ids"].shape[1]:], skip_special_tokens=True)
26print(prediction)