Views
No views yet
1pip install -U transformers
2pip install torch torchvision torchaudio
3pip install 'accelerate>=0.26.0'1training_args = TrainingArguments(
2 per_device_train_batch_size=32,
3 gradient_accumulation_steps=32,
4 warmup_steps=20,
5 max_steps=400,
6 learning_rate=1.5e-5,
7 fp16=not is_bfloat16_supported(),
8 bf16=is_bfloat16_supported(),
9 logging_steps=1,
10 optim="adamw_8bit",
11 weight_decay=0.01,
12 lr_scheduler_type="cosine",
13 seed=3407,
14 output_dir=output_dir,
15 report_to="none",
16 eval_strategy="steps",
17 eval_steps=10,
18 load_best_model_at_end=True,
19 metric_for_best_model="eval_loss",
20 greater_is_better=False,
21 save_total_limit=2,
22)1from transformers import AutoTokenizer, AutoModelForCausalLM
2import transformers
3import torch
4
5model_id = "mlconvexai/gemma-2-2b-it-finetuned-EU-Act-v2"
6dtype = torch.bfloat16
7
8tokenizer = AutoTokenizer.from_pretrained(model_id)
9model = AutoModelForCausalLM.from_pretrained(
10 model_id,
11 device_map="auto",
12 torch_dtype=dtype,)
13
14chat = [
15 { "role": "user", "content": "Mikä on EU:n tekoälyasetus?" },
16]
17prompt = tokenizer.apply_chat_template(chat, tokenize=False, add_generation_prompt=True)
18inputs = tokenizer.encode(prompt, add_special_tokens=False, return_tensors="pt")
19outputs = model.generate(
20 input_ids=inputs.to(model.device),
21 max_new_tokens=1024,
22 repetition_penalty=1.1,
23 no_repeat_ngram_size=4,
24)
25print(tokenizer.decode(outputs[0]))