Views
No views yet
![]() | ![]() | |
![]() | ![]() |
1
2import pandas as pd
3import os
4from unsloth import FastVisionModel
5import torch
6from datasets import load_dataset
7from transformers import TextStreamer
8from PIL import Image
9
10
11import os
12os.environ["TOKENIZERS_PARALLELISM"] = "false"
13
14
15model_name = "NYUAD-ComNets/Llama3.2_MultiModal_Memes_Hate_Detector"
16
17model, tokenizer = FastVisionModel.from_pretrained(model_name, token='xxxxxxxxxxxxxxxxxxxxxx')
18
19
20
21
22FastVisionModel.for_inference(model)
23
24
25dataset_test = load_dataset("QCRI/Prop2Hate-Meme", split = "test")
26
27
28print(dataset_test)
29
30def add_labels_column(example):
31 example["labels"] = "no_hate" if example["hate_label"] == 0 else "hate"
32 return example
33
34dataset_test = dataset_test.map(add_labels_column)
35
36
37
38
39pred=[]
40
41for k in range(606):
42 image = dataset_test[k]["image"]
43 text = dataset_test[k]["text"]
44 lab = dataset_test[k]["labels"]
45
46
47 messages = [
48
49 {"role": "user", "content": [
50 {"type": "image"},
51 {"type": "text", "text": text}
52 ]}
53 ]
54
55 input_text = tokenizer.apply_chat_template(messages,add_generation_prompt = True)
56 inputs = tokenizer(
57 image,
58 input_text,
59 add_special_tokens = False,
60 return_tensors = "pt",
61 ).to("cuda")
62
63 text_streamer = TextStreamer(tokenizer, skip_prompt = True)
64
65 p = model.generate(**inputs, streamer = text_streamer, max_new_tokens = 128,
66 use_cache = False, temperature = 0.3, min_p = 0.3)
67
68
69 p = tokenizer.decode(p[0], skip_special_tokens=True)
70
71 pred.append(p.split('assistant')[1].strip())
72
73print(pred)
@inproceedings{aldahoul2025nyuad,
title={NYUAD at MAHED Shared Task: Detecting Hope, Hate, and Emotion in Arabic Textual Speech and Multi-modal Memes Using Large Language Models},
author={Aldahoul, Nouar and Zaki, Yasir},
booktitle={Proceedings of The Third Arabic Natural Language Processing Conference: Shared Tasks},
pages={575--584},
year={2025}
}
@misc{aldahoul2025detectinghopehateemotion,
title={Detecting Hope, Hate, and Emotion in Arabic Textual Speech and Multi-modal Memes Using Large Language Models},
author={Nouar AlDahoul and Yasir Zaki},
year={2025},
eprint={2508.15810},
archivePrefix={arXiv},
primaryClass={cs.CL},
url={https://arxiv.org/abs/2508.15810},
}