Views
No views yet
quantized_weights.pt: Quantized model weightsquantization_info.json: Layer-wise quantization configurationlayer_configs.json: Detailed layer configurationscompression_stats.json: Compression statisticslayer_analysis.json: Modality analysis (vision/language/other)1import torch
2from transformers import AutoTokenizer
3
4# Load tokenizer
5tokenizer = AutoTokenizer.from_pretrained("SamMikaelson/deepseek-ocr-int8-quantized", trust_remote_code=True)
6
7# Load quantized weights
8state_dict = torch.load("quantized_weights.pt")
9# Note: You'll need the QuantizedLinear class to properly load and use this model