Views
No views yet
Qwen/Qwen3-Next-80B-A3B-Instruct for zeromodels. One implementation runs unmodified on TensorFlow / Torch / JAX. Qwen3-Next is a Gated-DeltaNet + MoE hybrid; weights are stored in bfloat16.1import os
2os.environ["KERAS_BACKEND"] = "torch" # or "jax" / "tensorflow"
3
4from zeromodels.models.qwen3_next import Qwen3NextTextGenerate, Qwen3NextTokenizer
5
6model = Qwen3NextTextGenerate.from_weights("zeromodels/qwen3-next-80b-a3b-instruct")
7tokenizer = Qwen3NextTokenizer.from_weights("zeromodels/qwen3-next-80b-a3b-instruct")
8
9inputs = tokenizer("Give me a short introduction to large language models.")
10outputs = model.generate(**inputs, max_new_tokens=128)
11print(tokenizer.decode(outputs[0]))