MLX export of
LFM2.5-2.6B for Apple Silicon inference.
LFM2.5-2.6B is a compact multilingual model built on LiquidAI's hybrid architecture, combining convolutional and attention layers for efficient long-context processing.
1from mlx_lm import load, generate
2from mlx_lm.sample_utils import make_sampler
3
4model, tokenizer = load("LiquidAI/LFM2.5-2.6B-MLX-8bit")
5
6response = generate(
7 model,
8 tokenizer,
9 prompt="The capital of France is",
10 max_tokens=100,
11 sampler=make_sampler(temp=0.7),
12 verbose=True,
13)
This model is released under the
LFM 1.0 License.