Views
No views yet
deberta / deberta_v2 / deberta_v3 to match the generation.microsoft/deberta-v3-large for zeromodels. One implementation runs unmodified on TensorFlow / Torch / JAX.DebertaV3MaskedLM, v3 large). Task heads (sequence/token classify, QA, …) load via hf: fine-tunes.1import os
2os.environ["KERAS_BACKEND"] = "torch" # or "jax" / "tensorflow"
3
4from zeromodels.models.deberta_v3 import (
5 DebertaV3MaskedLM,
6 DebertaV3Tokenizer,
7)
8
9mlm = DebertaV3MaskedLM.from_weights("zeromodels/deberta_v3_large")
10tokenizer = DebertaV3Tokenizer.from_weights("zeromodels/deberta_v3_large")
11
12inputs = tokenizer("The capital of France is [MASK].")
13logits = mlm(inputs) # (1, L, vocab_size)
14mask = int((inputs["input_ids"][0] == tokenizer.mask_token_id).argmax())
15print(tokenizer.decode([int(logits[0, mask].argmax())]))from_weights("zeromodels/<variant>"):| Variant | Hub | Generation |
|---|---|---|
deberta_base | zeromodels/deberta_base | v1 |
deberta_large | zeromodels/deberta_large | v1 |
deberta_v2_xlarge | zeromodels/deberta_v2_xlarge | v2 |
deberta_v2_xxlarge | zeromodels/deberta_v2_xxlarge | v2 |
deberta_v3_xsmall | zeromodels/deberta_v3_xsmall | v3 |
deberta_v3_small | zeromodels/deberta_v3_small | v3 |
deberta_v3_base | zeromodels/deberta_v3_base | v3 |
deberta_v3_large | zeromodels/deberta_v3_large | v3 |
from_weights("zeromodels/deberta_v3_large") (or on the fly via the hf: prefix). The pretrained backbone is shared; task heads not stored in this checkpoint start randomly initialized, ready for fine-tuning (or load a hf: fine-tune).| Class | Task |
|---|---|
DebertaV3Model | Encoder backbone |
DebertaV3MaskedLM | Masked language modeling (fill-mask) |
DebertaV3SequenceClassify | Sequence classification |
DebertaV3TokenClassify | Token classification (NER / POS) |
DebertaV3QnA | Extractive question answering |
DebertaV3MultipleChoice | Multiple choice |
1from zeromodels.models.deberta_v3 import DebertaV3SequenceClassify
2model = DebertaV3SequenceClassify.from_weights("zeromodels/deberta_v3_large")KERAS_BACKEND before importing Keras / zeromodels.Tokenizer.from_weights(...) so vocab and mask token match.hf: prefix, e.g. DebertaV3MaskedLM.from_weights("hf:microsoft/deberta-v3-large").