Views
No views yet
mlx-llm from GitHub.1git clone https://github.com/riccardomusmeci/mlx-llm
2cd mlx-llm
3pip install .1from mlx_llm.model import create_model
2from transformers import BertTokenizer
3import mlx.core as mx
4
5model = create_model("bert-base-uncased") # it will download weights from this repository
6tokenizer = BertTokenizer.from_pretrained("bert-base-uncased")
7
8batch = ["This is an example of BERT working on MLX."]
9tokens = tokenizer(batch, return_tensors="np", padding=True)
10tokens = {key: mx.array(v) for key, v in tokens.items()}
11
12output, pooled = model(**tokens)