Views
No views yet
| File | Size | Notes |
|---|---|---|
onnx/model_q4.onnx | ~1.06 GB | 4-bit MatMul (block_size=128, sym) + int8 per-row embeddings; everything inline. |
1import { pipeline } from "@huggingface/transformers";
2
3const generator = await pipeline(
4 "text-generation",
5 "moeadham/TinySwallow-1.5B-Instruct-ONNX",
6 { device: "webgpu", dtype: "q4" }
7);
8const out = await generator(
9 [{ role: "user", content: "知識蒸留について簡単に教えてください。" }],
10 { max_new_tokens: 256 }
11);
12console.log(out[0].generated_text);