Views
No views yet
1from transformers import AutoTokenizer, AutoModelForSequenceClassification, pipeline
2
3model = AutoModelForSequenceClassification.from_pretrained("almanach/camembertv2-base-pawsx")
4tokenizer = AutoTokenizer.from_pretrained("almanach/camembertv2-base-pawsx")
5
6classifier = pipeline("text-classification", model=model, tokenizer=tokenizer)
7
8classifier({
9 "text": "Le livre est très intéressant et j'ai appris beaucoup de choses.",
10 "text_pair": "Le livre est très ennuyeux et je n'ai rien appris.",
11})1accelerator_config: '{''split_batches'': False, ''dispatch_batches'': None, ''even_batches'':
2 True, ''use_seedable_sampler'': True, ''non_blocking'': False, ''gradient_accumulation_kwargs'':
3 None}'
4adafactor: false
5adam_beta1: 0.9
6adam_beta2: 0.999
7adam_epsilon: 1.0e-08
8auto_find_batch_size: false
9base_model: camembertv2
10base_model_name: camembertv2-base-bf16-p2-17000
11batch_eval_metrics: false
12bf16: false
13bf16_full_eval: false
14data_seed: 1.0
15dataloader_drop_last: false
16dataloader_num_workers: 0
17dataloader_persistent_workers: false
18dataloader_pin_memory: true
19dataloader_prefetch_factor: .nan
20ddp_backend: .nan
21ddp_broadcast_buffers: .nan
22ddp_bucket_cap_mb: .nan
23ddp_find_unused_parameters: .nan
24ddp_timeout: 1800
25debug: '[]'
26deepspeed: .nan
27disable_tqdm: false
28dispatch_batches: .nan
29do_eval: true
30do_predict: false
31do_train: true
32epoch: 5.999028340080971
33eval_accumulation_steps: 4
34eval_accuracy: 0.9225352112676056
35eval_delay: 0
36eval_do_concat_batches: true
37eval_loss: 0.3642682433128357
38eval_on_start: false
39eval_runtime: 4.0364
40eval_samples: 1988
41eval_samples_per_second: 492.519
42eval_steps: .nan
43eval_steps_per_second: 61.689
44eval_strategy: epoch
45eval_use_gather_object: false
46evaluation_strategy: epoch
47fp16: false
48fp16_backend: auto
49fp16_full_eval: false
50fp16_opt_level: O1
51fsdp: '[]'
52fsdp_config: '{''min_num_params'': 0, ''xla'': False, ''xla_fsdp_v2'': False, ''xla_fsdp_grad_ckpt'':
53 False}'
54fsdp_min_num_params: 0
55fsdp_transformer_layer_cls_to_wrap: .nan
56full_determinism: false
57gradient_accumulation_steps: 2
58gradient_checkpointing: false
59gradient_checkpointing_kwargs: .nan
60greater_is_better: true
61group_by_length: false
62half_precision_backend: auto
63hub_always_push: false
64hub_model_id: .nan
65hub_private_repo: false
66hub_strategy: every_save
67hub_token: <HUB_TOKEN>
68ignore_data_skip: false
69include_inputs_for_metrics: false
70include_num_input_tokens_seen: false
71include_tokens_per_second: false
72jit_mode_eval: false
73label_names: .nan
74label_smoothing_factor: 0.0
75learning_rate: 3.0e-05
76length_column_name: length
77load_best_model_at_end: true
78local_rank: 0
79log_level: debug
80log_level_replica: warning
81log_on_each_node: true
82logging_dir: /scratch/camembertv2/runs/results/flue-PAWS-X/camembertv2-base-bf16-p2-17000/max_seq_length-148-gradient_accumulation_steps-2-precision-fp32-learning_rate-3e-05-epochs-6-lr_scheduler-linear-warmup_steps-0/SEED-1/logs
83logging_first_step: false
84logging_nan_inf_filter: true
85logging_steps: 100
86logging_strategy: steps
87lr_scheduler_kwargs: '{}'
88lr_scheduler_type: linear
89max_grad_norm: 1.0
90max_steps: -1
91metric_for_best_model: accuracy
92mp_parameters: .nan
93name: camembertv2/runs/results/flue-PAWS-X/camembertv2-base-bf16-p2-17000/max_seq_length-148-gradient_accumulation_steps-2-precision-fp32-learning_rate-3e-05-epochs-6-lr_scheduler-linear-warmup_steps-0
94neftune_noise_alpha: .nan
95no_cuda: false
96num_train_epochs: 6.0
97optim: adamw_torch
98optim_args: .nan
99optim_target_modules: .nan
100output_dir: /scratch/camembertv2/runs/results/flue-PAWS-X/camembertv2-base-bf16-p2-17000/max_seq_length-148-gradient_accumulation_steps-2-precision-fp32-learning_rate-3e-05-epochs-6-lr_scheduler-linear-warmup_steps-0/SEED-1
101overwrite_output_dir: false
102past_index: -1
103per_device_eval_batch_size: 8
104per_device_train_batch_size: 8
105per_gpu_eval_batch_size: .nan
106per_gpu_train_batch_size: .nan
107prediction_loss_only: false
108push_to_hub: false
109push_to_hub_model_id: .nan
110push_to_hub_organization: .nan
111push_to_hub_token: <PUSH_TO_HUB_TOKEN>
112ray_scope: last
113remove_unused_columns: true
114report_to: '[''tensorboard'']'
115restore_callback_states_from_checkpoint: false
116resume_from_checkpoint: .nan
117run_name: /scratch/camembertv2/runs/results/flue-PAWS-X/camembertv2-base-bf16-p2-17000/max_seq_length-148-gradient_accumulation_steps-2-precision-fp32-learning_rate-3e-05-epochs-6-lr_scheduler-linear-warmup_steps-0/SEED-1
118save_on_each_node: false
119save_only_model: false
120save_safetensors: true
121save_steps: 500
122save_strategy: epoch
123save_total_limit: .nan
124seed: 1
125skip_memory_metrics: true
126split_batches: .nan
127tf32: .nan
128torch_compile: true
129torch_compile_backend: inductor
130torch_compile_mode: .nan
131torch_empty_cache_steps: .nan
132torchdynamo: .nan
133total_flos: 1.33712370278538e+16
134tpu_metrics_debug: false
135tpu_num_cores: .nan
136train_loss: 0.1708474308300605
137train_runtime: 2225.7449
138train_samples: 49399
139train_samples_per_second: 133.166
140train_steps_per_second: 8.322
141use_cpu: false
142use_ipex: false
143use_legacy_prediction_loop: false
144use_mps_device: false
145warmup_ratio: 0.0
146warmup_steps: 0
147weight_decay: 0.0
1481@misc{antoun2024camembert20smarterfrench,
2 title={CamemBERT 2.0: A Smarter French Language Model Aged to Perfection},
3 author={Wissam Antoun and Francis Kulumba and Rian Touchent and Éric de la Clergerie and Benoît Sagot and Djamé Seddah},
4 year={2024},
5 eprint={2411.08868},
6 archivePrefix={arXiv},
7 primaryClass={cs.CL},
8 url={https://arxiv.org/abs/2411.08868},
9}