Views
No views yet
| Parameter | Value |
|---|---|
| Source | Qwen3-32B-FP8 |
| Target Dtype | BFloat16 |
| Method | FP8 → BF16 dequantization |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3
4model = AutoModelForCausalLM.from_pretrained(
5 "hassanshka/Qwen3-32B-FP8-to-BF16",
6 device_map="auto",
7 torch_dtype=torch.bfloat16,
8 trust_remote_code=True
9)
10tokenizer = AutoTokenizer.from_pretrained("hassanshka/Qwen3-32B-FP8-to-BF16")
11
12# Use for inference or fine-tuning