Views
No views yet
ffai convert (mlx-affine format, group_size=64).1ffai convert nvidia/Llama-3.1-Nemotron-Nano-VL-8B-V1 --bits 4 \
2 --upload-repo ekryski/Llama-3.1-Nemotron-Nano-VL-8B-V1-4bitModel.load("ekryski/Llama-3.1-Nemotron-Nano-VL-8B-V1-4bit") runs this checkpoint end-to-end.