Views
No views yet
mlx.nn.quantize() before loading weights.1import json
2import mlx.nn as nn
3from huggingface_hub import hf_hub_download
4from parakeet_mlx.utils import from_config
5
6# Download and load config
7config_path = hf_hub_download("animaslabs/multitalker-parakeet-streaming-0.6b-v1-mlx-8bit", "config.json")
8with open(config_path) as f:
9 config = json.load(f)
10
11# Build model and apply quantization structure
12model = from_config(config)
13nn.quantize(
14 model,
15 bits=config["quantization"]["bits"],
16 group_size=config["quantization"]["group_size"],
17)
18
19# Load quantized weights
20weights_path = hf_hub_download("animaslabs/multitalker-parakeet-streaming-0.6b-v1-mlx-8bit", "model.safetensors")
21model.load_weights(weights_path)
22
23# Transcribe
24result = model.transcribe("audio.wav")
25print(result.text)