Views
No views yet
| variant | dtype | size | file |
|---|---|---|---|
| bf16 | bfloat16 | 8.4 gb | Gemma3n-E2B-IT-text-only.pte |
| int8 | int8 weights | 7.0 gb | Gemma3n-E2B-text-only-int8.pte |
| property | value |
|---|---|
| source model | google/gemma-3n-E2B-it |
| text parameters | 4.46b |
| transformer layers | 30 |
| format | executorch .pte |
1from executorch.runtime import Runtime
2
3runtime = Runtime.get()
4program = runtime.load_program("Gemma3n-E2B-text-only-int8.pte")
5method = program.load_method("forward")
6
7# input_ids shape: [1, 32] dtype: torch.long
8output = method.execute([input_ids])
9# output shape: [1, 32, 262400] dtype: torch.bfloat16