Views
No views yet

1import transformers
2import torch
3
4model_id = "AI-Sweden-Models/Llama-3-8B"
5
6pipeline = transformers.pipeline(
7 task="text-generation",
8 model=model_id,
9 model_kwargs={"torch_dtype": torch.bfloat16},
10 device_map="auto"
11)
12
13pipeline(
14 text_inputs="Sommar och sol är det bästa jag vet",
15 max_length=128,
16 repetition_penalty=1.03
17)1>>> "Sommar och sol är det bästa jag vet!
2Och nu när jag har fått lite extra semester så ska jag njuta till max av allt som våren och sommaren har att erbjuda.
3Jag har redan börjat med att sitta ute på min altan och ta en kopp kaffe och läsa i tidningen, det är så skönt att bara sitta där och njuta av livet.
4
5Ikväll blir det grillat och det ser jag fram emot!"AI-Sweden-Models/Llama-3-8B is a continuation of the pretraining process from meta-llama/Meta-Llama-3-8B.
It was trained on a subset from The Nordic Pile containing Swedish, Norwegian and Danish. The training is done on all model parameters, it is a full finetune.1learning_rate: 2e-5
2warmup_steps: 100
3lr_scheduler: cosine
4optimizer: adamw_torch_fused
5max_grad_norm: 1.0
6gradient_accumulation_steps: 16
7micro_batch_size: 1
8num_epochs: 1
9sequence_len: 81921{
2 "zero_optimization": {
3 "stage": 2,
4 "offload_optimizer": {
5 "device": "cpu"
6 },
7 "contiguous_gradients": true,
8 "overlap_comm": true
9 },
10 "bf16": {
11 "enabled": "auto"
12 },
13 "fp16": {
14 "enabled": "auto",
15 "auto_cast": false,
16 "loss_scale": 0,
17 "initial_scale_power": 32,
18 "loss_scale_window": 1000,
19 "hysteresis": 2,
20 "min_loss_scale": 1
21 },
22 "gradient_accumulation_steps": "auto",
23 "gradient_clipping": "auto",
24 "train_batch_size": "auto",
25 "train_micro_batch_size_per_gpu": "auto",
26 "wall_clock_breakdown": false
27}