딥러닝을 이용한 영화 흥행 예측과 주요 변수의 선택 연구 : 다변량 시계열 데이터 중심으로

Movie Box-office Prediction using Deep Learning and Feature Selection : Focusing on Multivariate Time Series
  • 변준형
  • 김지호
  • 최영진
  • 이홍철

초록

박스 오피스 예측은 영화 이해관계자들에게 중요하다. 따라서 정확한 박스 오피스 예측과 이에 영향을 미치는 주요 변수를 선별하는 것이 필요하다. 본 논문은 영화의 박스 오피스 예측 정확도 향상을위해 다변량 시계열 데이터 분류와 주요 변수 선택 방법을 제안한다. 연구 방법으로 한국 영화 일별데이터를 KOBIS와 NAVER에서 수집하였고, 랜덤 포레스트(Random Forest) 방법으로 주요 변수를 선별하였으며, 딥러닝(Deep Learning)으로 다변량 시계열을 예측하였다. 한국의 스크린 쿼터제(Screen Quota) 기준, 딥러닝을 이용하여 영화 개봉 73일째 흥행 예측 정확도를 주요 변수와 전체 변수로 비교하고통계적으로 유의한지 검정하였다. 딥러닝 모델은 다층 퍼셉트론(Multi-Layer Perceptron), 완전 합성곱신경망(Fully Convolutional Neural Networks), 잔차 네트워크(Residual Network)로 실험하였다. 결과적으로주요 변수를 잔차 네트워크에 사용했을 때 예측 정확도가 약 93%로 가장 높았다.

키워드

박스 오피스 예측영화 흥행 예측주요 변수 선택다변량 시계열 데이터 분류랜덤 포레스트딥러닝다층 퍼셉트론완전 합성곱 신경망잔차 네트워크Box-office PredictionFeature SelectionMultivariate Time Series ClassificationRandom ForestDeep LearningMulti-Layer PerceptronFully Convolutional Neural NetworksResidual Network
제목
딥러닝을 이용한 영화 흥행 예측과 주요 변수의 선택 연구 : 다변량 시계열 데이터 중심으로
제목 (타언어)
Movie Box-office Prediction using Deep Learning and Feature Selection : Focusing on Multivariate Time Series
저자
변준형김지호최영진이홍철
DOI
10.9708/jksci.2020.25.06.035
발행일
2020
저널명
한국컴퓨터정보학회논문지
25
6
페이지
35 ~ 47