Views
No views yet
Qwen/Qwen3.5-9B, fine-tuned on
synthetic FormStruct training data for structured form understanding from
document images.1import torch
2from peft import PeftModel
3from transformers import AutoModelForImageTextToText, AutoProcessor
4
5base_id = "Qwen/Qwen3.5-9B"
6adapter_id = "D2I-CUHK-Shenzhen/FormStruct-Bench-SFT-Qwen3.5-9B"
7
8processor = AutoProcessor.from_pretrained(adapter_id, trust_remote_code=True)
9base_model = AutoModelForImageTextToText.from_pretrained(
10 base_id,
11 dtype=torch.bfloat16,
12 device_map="auto",
13 trust_remote_code=True,
14)
15model = PeftModel.from_pretrained(base_model, adapter_id)
16model.eval()LICENSE.