Views
No views yet
1from transformers import pipeline
2
3question = "Are you familiar with Argdown syntax? What's its purpose?"
4generator = pipeline("text-generation", model="DebateLabKIT/Llama-3.1-Argunaut-1-8B-SFT", device="cuda")
5output = generator([{"role": "user", "content": question}], max_new_tokens=128, return_full_text=False)[0]
6print(output["generated_text"])| Dataset | Weight (examples) | Weight (tokens) |
|---|---|---|
| DebateLabKIT/deepa2-conversations | 25% | 49% |
| DebateLabKIT/deep-argmap-conversations | 25% | 18% |
| allenai/tulu-3-sft-mixture | 50% | 33% |
1# Training parameters
2num_train_epochs: 1
3per_device_train_batch_size: 2
4gradient_accumulation_steps: 8
5gradient_checkpointing: true
6gradient_checkpointing_kwargs:
7 use_reentrant: false
8learning_rate: 2.0e-6 # following _Tülu 3_ recipe
9lr_scheduler_type: cosine
10warmup_ratio: 0.1