Views
No views yet
new_dataset, no_new_dataset[!NOTE] This model uses a custom classification head (mean pooling over a backbone without a native sequence-classification class), so loading requirestrust_remote_code=True. vLLM serving requires a standard architecture.
| Metric | Value |
|---|---|
| accuracy | 0.8662 |
| f1_macro | 0.8528 |
1from transformers import AutoModelForSequenceClassification, AutoTokenizer
2
3model = AutoModelForSequenceClassification.from_pretrained("davanstrien/lfm25-arxiv-new-dataset-v3", trust_remote_code=True)
4tokenizer = AutoTokenizer.from_pretrained("davanstrien/lfm25-arxiv-new-dataset-v3", trust_remote_code=True)
5
6inputs = tokenizer("your text here", return_tensors="pt", truncation=True)
7print(model.config.id2label[model(**inputs).logits.argmax().item()])gpu) with the train-classifier.py recipe from uv-scripts. Run it yourself:1hf jobs uv run --flavor gpu --secrets HF_TOKEN \
2 https://huggingface.co/datasets/uv-scripts/classification/raw/main/train-classifier.py \
3 librarian-bots/arxiv-new-datasets-v3 davanstrien/lfm25-arxiv-new-dataset-v3 --label-column labels