Views
No views yet
mixed_3_4) a partir do mlx-community/Qwen3.8-27B-bf16 utilizando MLX.faelfernandes/Qwen3.8-27B-3.5bit ou adicionar pelo Hugging Face Hub.pip install -U mlx-lm1from mlx_lm import load, generate
2
3model, tokenizer = load("faelfernandes/Qwen3.8-27B-3.5bit")
4response = generate(model, tokenizer, prompt="Olá! Como posso ajudar você hoje?", verbose=True)
5print(response)python -m mlx_lm.server --model faelfernandes/Qwen3.8-27B-3.5bit --port 8000