로컬 컴퓨터에서, 다음 코드를 통해 작성했어요.
import os
import json
from pydub import AudioSegment
from tqdm import tqdm
import re
from datasets import Audio, Dataset, DatasetDict, load_from_disk, concatenate_datasets
from transformers import WhisperFeatureExtractor… See the full description on the dataset page:
https://huggingface.co/datasets/maxseats/aihub-464-preprocessed-680GB-set-4.