Views
No views yet
jhu-clsp/ettin-encoder-32m (ModernBERT encoder, 8192 context) finetuned for arXiv paper topic classification (11 classes), 8192-token context on ccdv/arxiv-classification.| metric | value |
|---|---|
| accuracy | 0.783 |
| macro-F1 | 0.7803 |
| eval max_length | 8192 |
1from transformers import AutoTokenizer, AutoModelForSequenceClassification
2import torch
3
4tok = AutoTokenizer.from_pretrained("vumichien/ettin-encoder-32m-arxiv-classification-8192")
5model = AutoModelForSequenceClassification.from_pretrained("vumichien/ettin-encoder-32m-arxiv-classification-8192")
6
7inputs = tok("your text here", truncation=True, max_length=8192, return_tensors="pt")
8pred = model(**inputs).logits.argmax(-1).item()
9print(model.config.id2label[pred])