Views
No views yet
1from transformers import Qwen3ForCausalLM, AutoTokenizer
2
3model = Qwen3ForCausalLM.from_pretrained("./workspace/16m-falcon-tokenizer")
4tokenizer = AutoTokenizer.from_pretrained("./workspace/16m-falcon-tokenizer")
5
6# Generate text
7inputs = tokenizer("Hello, world!", return_tensors="pt")
8outputs = model.generate(**inputs, max_new_tokens=50)
9print(tokenizer.decode(outputs[0], skip_special_tokens=True))
10
11# Batch processing (start small)
12texts = ["Hello", "How are you", "Good morning"]
13inputs = tokenizer(texts, return_tensors="pt", padding=True, truncation=True)
14with torch.no_grad():
15 outputs = model.generate(**inputs, max_new_tokens=20)