Views
No views yet
new_dataset, not_new_dataset| Metric | Value |
|---|---|
| accuracy | 0.8816 |
| f1_macro | 0.8316 |
1from transformers import AutoModelForSequenceClassification, AutoTokenizer
2
3model = AutoModelForSequenceClassification.from_pretrained("davanstrien/modernbert-arxiv-new-dataset-v2", trust_remote_code=True)
4tokenizer = AutoTokenizer.from_pretrained("davanstrien/modernbert-arxiv-new-dataset-v2", trust_remote_code=True)
5
6inputs = tokenizer("your text here", return_tensors="pt", truncation=True)
7print(model.config.id2label[model(**inputs).logits.argmax().item()])gpu) with the train-classifier.py recipe from uv-scripts. Run it yourself:1hf jobs uv run --flavor gpu --secrets HF_TOKEN \
2 https://huggingface.co/datasets/uv-scripts/classification/raw/main/train-classifier.py \
3 librarian-bots/arxiv-new-datasets-v2 davanstrien/modernbert-arxiv-new-dataset-v2 --model answerdotai/ModernBERT-base --label-column labels