Views
No views yet
1import ctranslate2
2import transformers
3from huggingface_hub import snapshot_download
4
5model_dir = snapshot_download(repo_id="Praise2112/Mistral-7B-v0.1-int8-ct2")
6generator = ctranslate2.Generator(model_dir, device="cuda", compute_type="int8") # GPU
7# generator = ctranslate2.Generator(model_dir, device="cpu", compute_type="int8") #CPU
8tokenizer = transformers.AutoTokenizer.from_pretrained("mistralai/Mistral-7B-v0.1")
9
10# Unconditional generation.
11start_tokens = [tokenizer.bos_token]
12results = generator.generate_batch([start_tokens], max_length=30, sampling_topk=10)
13print(tokenizer.decode(results[0].sequences_ids[0]))
14
15# Conditional generation.
16start_tokens = tokenizer.convert_ids_to_tokens(tokenizer.encode("It is"))
17results = generator.generate_batch([start_tokens], max_length=30, sampling_topk=10)
18print(tokenizer.decode(results[0].sequences_ids[0]))