본 데이터셋은 국민연금에 대한 대중의 인식을 파악하기 위해 네이버(Naver)의 뉴스, 블로그, 카페에서 수집한 원본 텍스트 데이터의 모음입니다. 2022년 5월부터 2024년 4월까지 약 2년간의 데이터를 포함하고 있으며, 텍스트 마이닝, 감성 분석, 토픽 모델링 등 다양한 자연어 처리(NLP) 연구의 기초 자료로 활용될 수 있습니다.
이 데이터셋은 GitHub 저장소에서 진행된 '국민연금 텍스트 마이닝 및 감성 분석 프로젝트'의 일부입니다. 전체 프로젝트 내용과 분석 코드는 해당 GitHub 저장소를 참고해 주시기 바랍니다.