Views
No views yet
| Chat Model | Resource | Base Model |
|---|---|---|
| Blossom-V6.1-32B | Demo AWQ GGUF Ollama | Qwen2.5-32B |
| Blossom-V6.1-GLM-32B | GGUF Ollama | GLM-4-32B-Base-0414 |
| Blossom-V6.1-14B | Demo AWQ GGUF Ollama | Qwen3-14B-Base |
| Blossom-V6.1-8B | Demo AWQ GGUF Ollama | Qwen3-8B-Base |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3MODEL = "Azure99/Blossom-V6.1-GLM-32B"
4
5model = AutoModelForCausalLM.from_pretrained(MODEL)
6tokenizer = AutoTokenizer.from_pretrained(MODEL)
7
8messages = [
9 {"role": "user", "content": "北京有什么好吃的"}
10]
11
12formatted_input = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
13input_ids = tokenizer([formatted_input], return_tensors="pt").to(model.device).input_ids
14generated_ids = model.generate(input_ids, max_new_tokens=512)
15generated_ids = [
16 output_ids[len(input_ids):] for input_ids, output_ids in zip(input_ids, generated_ids)
17]
18
19print(tokenizer.batch_decode(generated_ids, skip_special_tokens=True)[0])