Views
No views yet
| File | Kích thước | Ghi chú |
|---|---|---|
onnx/encoder_model_quantized.onnx | ~31 MB | int8 động (QUInt8, per-channel) — mặc định cho WASM |
onnx/decoder_model_merged_quantized.onnx | ~29 MB | int8 động, quantize cả subgraph của node If |
onnx/encoder_model_fp16.onnx / decoder_model_merged_fp16.onnx | ~61 / 57 MB | cho WebGPU |
onnx/encoder_model.onnx / decoder_model_merged.onnx | ~121 / 113 MB | fp32 gốc |
source.spm là SentencePiece BPE (byte_fallback=true) — tokenizer.json được dựng bằng
tokenizers.models.BPE với merges trích từ spm, đã kiểm tra encode/decode khớp 100% với
MarianTokenizer gốc.1import { pipeline } from '@huggingface/transformers';
2
3const translator = await pipeline('translation', 'DanVP/MoxhiMT-30-onnx', { dtype: 'q8' });
4const out = await translator('他抬起头,看见月光下的剑冢。', { max_new_tokens: 128 });
5// → "Hắn ngẩng đầu lên, nhìn thấy Kiếm Trủng dưới ánh trăng."text2text-generation-with-past), quantize bằng ONNX Runtime
(quantize_dynamic, EnableSubgraph=True).