Views
No views yet
google/gemma-2-2b for
zeromodels. One implementation runs unmodified on
TensorFlow / Torch / JAX. This is a base (pretrained) checkpoint, served here as text -> text via Gemma2TextGenerate; weights are
stored in bfloat16.1import os
2os.environ["KERAS_BACKEND"] = "torch" # or "jax" / "tensorflow"
3
4from zeromodels.models.gemma2 import Gemma2TextGenerate, Gemma2Tokenizer
5
6model = Gemma2TextGenerate.from_weights("zeromodels/gemma-2-2b")
7tokenizer = Gemma2Tokenizer.from_weights("zeromodels/gemma-2-2b")
8
9inputs = tokenizer([{"role": "user", "content": "Hello, who are you?"}])
10outputs = model.generate(**inputs, max_new_tokens=64)
11print(tokenizer.decode(outputs[0]))from_weights("zeromodels/<variant>"):| Variant | Hub |
|---|---|
gemma-2-27b | zeromodels/gemma-2-27b |
gemma-2-27b-it | zeromodels/gemma-2-27b-it |
gemma-2-2b | zeromodels/gemma-2-2b |
gemma-2-2b-it | zeromodels/gemma-2-2b-it |
gemma-2-9b | zeromodels/gemma-2-9b |
gemma-2-9b-it | zeromodels/gemma-2-9b-it |
KERAS_BACKEND before importing Keras / zeromodels.load_dtype="float32" for full precision,
or quantization="int8" to shrink further.hf: prefix:
Gemma2TextGenerate.from_weights("hf:google/gemma-2-2b").