This model is a fine-tuned version of
microsoft/deberta-v3-xsmall on the FineWebSentences dataset.
It achieves the following results on the evaluation set:
Finetuned on sentences from randomly chosen
HuggingFaceFW/fineweb-edu entries.
To be finetuned on more tasks involving English sentences.
The evaluation and training losses were similar indicating no overfitting.