이 데이터셋은 장아함경(長阿含經) 제1-3권 전체를 기반으로 생성된 한국어 불교 질문-답변 데이터셋입니다. GPT-4.1-2025-04-14 모델과 고급 추론 시스템(fill_thinking.py)을 사용하여 생성되었으며, 현대인이 이해하기 쉽도록 해석된 붓다의 가르침을 포함합니다.
총 QA 쌍: 335개
훈련 데이터: 268개 (80%)
검증 데이터: 67개 (20%)
출처: 장아함경 제1-3권 (총 70개 경전)
생성 모델: GPT-4.1-2025-04-14
추론 시스템: fill_thinking.py 기반
각 레코드는 다음과 같은 3-message… See the full description on the dataset page:
https://huggingface.co/datasets/LeBrony/buddha_oss_dataset.