Views
No views yet
Qwen3_5MoeForConditionalGeneration, 397B total / MoE)Note — text-only. The original Ornith-1.0-397B is multimodal (vision encoder + language model). mlx-lm converts the language model only; the vision tower is not included. This build is for text generation. The tokenizer, chat template, andgeneration_configare included.
pip install -U mlx-lm1mlx_lm.generate --model pipenetwork/Ornith-1.0-397B-mlx-6bit \
2 --prompt "Write a haiku about Apple Silicon." --max-tokens 2561from mlx_lm import load, generate
2
3model, tokenizer = load("pipenetwork/Ornith-1.0-397B-mlx-6bit")
4messages = [{"role": "user", "content": "Explain mixture-of-experts in one paragraph."}]
5prompt = tokenizer.apply_chat_template(messages, add_generation_prompt=True)
6print(generate(model, tokenizer, prompt=prompt, max_tokens=512, verbose=True))