Views
No views yet
1vllm serve tohoku-cijs/qwen3.5-2b-ndl-honkoku-kuzushiji-ocr \
2 --served-model-name ocr --trust-remote-code \
3 --max-model-len 16384 --gpu-memory-utilization 0.71import base64, requests
2
3with open("page.jpg", "rb") as f:
4 b64 = base64.b64encode(f.read()).decode()
5
6r = requests.post(
7 "http://localhost:8000/v1/chat/completions",
8 json={
9 "model": "ocr",
10 "messages": [{
11 "role": "user",
12 "content": [{"type": "image_url",
13 "image_url": {"url": f"data:image/jpeg;base64,{b64}"}}],
14 }],
15 "temperature": 0.0,
16 "max_tokens": 2048,
17 },
18)
19print(r.json()["choices"][0]["message"]["content"])