Views
No views yet
Qwen/Qwen3-4B-Thinking-2507 for zeromodels. One implementation runs unmodified on TensorFlow / Torch / JAX. This is a dense Qwen3; weights are stored in bfloat16.1import os
2os.environ["KERAS_BACKEND"] = "torch" # or "jax" / "tensorflow"
3
4from zeromodels.models.qwen3 import Qwen3TextGenerate, Qwen3Tokenizer
5
6model = Qwen3TextGenerate.from_weights("zeromodels/qwen3-4b-thinking-2507")
7tokenizer = Qwen3Tokenizer.from_weights("zeromodels/qwen3-4b-thinking-2507")
8
9inputs = tokenizer("Give me a short introduction to large language models.")
10outputs = model.generate(**inputs, max_new_tokens=128)
11print(tokenizer.decode(outputs[0]))