Views
No views yet
1"""Sample code for initializing BiMamba from the template HF hub model."""
2
3import torch
4from transformers import AutoConfig, AutoModelForMaskedLM, AutoTokenizer
5
6tokenizer = AutoTokenizer.from_pretrained("bert-base-uncased")
7
8model_name_or_path = "yairschiff/bimamba-template"
9config_overrides = {
10 "d_model": 128, # TODO: Change this as desired
11 "n_layer": 2, # TODO: Change this as desired
12 "pad_token_id": tokenizer.pad_token_id,
13 "vocab_size": tokenizer.vocab_size,
14 "pad_vocab_size_multiple": 1,
15 # TODO: See configuration_bimamba for all config options
16}
17config = AutoConfig.from_pretrained(
18 model_name_or_path,
19 **config_overrides,
20 trust_remote_code=True
21)
22model = AutoModelForMaskedLM.from_config(
23 config=config,
24 trust_remote_code=True
25)
26
27# Test the model
28device = "cuda" if torch.cuda.is_available() else "cpu"
29inputs = ["A sample sentence for model testing."]
30tokenized = tokenizer.batch_encode_plus(inputs, return_tensors="pt")
31model = model.to(device)
32model_out = model(tokenized["input_ids"].to(device))