Views
No views yet
mistralai/Mistral-7B-v0.11# Download the loader script
2from loader_tripletap_4bit_int8 import TripleTap4BitInt8Loader
3from transformers import AutoModelForCausalLM
4import torch
5
6# 1. Load base structure (empty)
7model = AutoModelForCausalLM.from_pretrained(
8 "mistralai/Mistral-7B-v0.1",
9 torch_dtype=torch.float16,
10 device_map="cuda"
11)
12
13# 2. Load compressed weights
14loader = TripleTap4BitInt8Loader("mistral_7b_4bit_int8.safetensors")
15loader.load_into_model(model)
16
17# 3. Run inference
18# ... standard transformers generation ...