Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
m2m100_418M-GEC-spanish-LORA-merged – AI Model by Ro551 | AlphaNeural AI
You can deploy this model and start earning money today!
Ro551
/
m2m100_418M-GEC-spanish-LORA-merged
like
0
peft
safetensors
adapter
lora
transformers
facebook/m2m100_418M
mit
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
m2m100_418M-GEC-spanish-LORA-merged
This model is a fine-tuned version of
facebook/m2m100_418M
on the None dataset. It achieves the following results on the evaluation set:
Loss: 5.1142
Gleu: 0.8229
Model description
More information needed
Intended uses & limitations
More information needed
Training and evaluation data
More information needed
Training procedure
Training hyperparameters
The following hyperparameters were used during training:
learning_rate: 0.00044107500561578277
train_batch_size: 16
eval_batch_size: 16
seed: 42
gradient_accumulation_steps: 2
total_train_batch_size: 32
optimizer: Use OptimizerNames.ADAFACTOR and the args are: No additional optimizer arguments
lr_scheduler_type: linear
lr_scheduler_warmup_steps: 0.08950396527674138
num_epochs: 2
mixed_precision_training: Native AMP
Training results
Training Loss
Epoch
Step
Validation Loss
Gleu
8.0383
1.0
4889
5.1178
0.8054
7.9948
2.0
9778
5.1142
0.8229
Framework versions
PEFT 0.18.1
Transformers 5.0.0
Pytorch 2.7.0+cu126
Datasets 4.8.5
Tokenizers 0.22.2