Views
No views yet
1import torch
2from transformers import AutoProcessor, AutoModelForCausalLM, BitsAndBytesConfig
3
4model_id = "suitch/gemma-4-31B-it-4bit"
5
6processor = AutoProcessor.from_pretrained(model_id, trust_remote_code=True)
7model = AutoModelForCausalLM.from_pretrained(
8 model_id,
9 device_map="auto",
10 trust_remote_code=True,
11)
12
13# Video inference
14messages = [
15 {"role": "user", "content": [
16 {"type": "video", "video": "path/to/video.mp4"},
17 {"type": "text", "text": "Describe what you see in this video."}
18 ]}
19]
20
21text = processor.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
22inputs = processor(text=text, videos=["path/to/video.mp4"], return_tensors="pt").to(model.device)
23outputs = model.generate(**inputs, max_new_tokens=512)
24response = processor.decode(outputs[0][inputs["input_ids"].shape[-1]:], skip_special_tokens=False)
25print(processor.parse_response(response))