[!CAUTION]
첫번째 이미지 부터 누가봐도 수건 2개인데, 정답이 1개로 표기되어있는 문제가 있습니다.사용에 유의하세요.
NCSOFT/K-SEED 를 쓰기 좋게 바꾸어놓았습니다.
아래 코드를 이용하였습니다.
from datasets import load_dataset, DatasetDict, Dataset
from huggingface_hub import login; login(token="YOUR TOKEN")
formatted_data = {
'question': [],
'answer': [],
'image': [],
'question_id': []
}
for item in test_dataset:
formatted_question = f"{item['question']}\nA.… See the full description on the dataset page:
https://huggingface.co/datasets/Ryoo72/K-SEED.