Views
No views yet
1import ctranslate2
2from huggingface_hub import snapshot_download
3from transformers import AutoTokenizer
4
5path = snapshot_download("olob0/nllb-200-distilled-600M-ct2-int8_float16")
6tokenizer = AutoTokenizer.from_pretrained(path)
7translator = ctranslate2.Translator(path, device="cuda", compute_type="int8_float16")
8
9tokenizer.src_lang = "por_Latn"
10tokens = tokenizer.convert_ids_to_tokens(tokenizer("Bom dia.").input_ids)
11result = translator.translate_batch([tokens], target_prefix=[["eng_Latn"]])
12print(tokenizer.decode(tokenizer.convert_tokens_to_ids(result[0].hypotheses[0][1:])))ct2-transformers-converter --model facebook/nllb-200-distilled-600M \
--quantization int8_float16 --output_dir nllb-200-distilled-600M-ct2-int8_float16 \
--copy_files tokenizer.json tokenizer_config.json special_tokens_map.json sentencepiece.bpe.model