International Islamic University Malaysia Engineering Journal (Jul 2022)

SARIMA-LSTM Combination For COVID-19 Case Modeling

  • Imam Tahyudin,
  • Rizki Wahyudi,
  • Hidetaka Nambo

DOI
https://doi.org/10.31436/iiumej.v23i2.2134
Journal volume & issue
Vol. 23, no. 2

Abstract

Read online

The study of SARIMA method in combination with LSTM is interesting to do. This combination method can be convincing and significant because the data collected is numerical and saved based on time. In addition, the proposed method can anticipate datasets, either linear or non-linear. Based on several previous studies, the SARIMA method has the advantage of completing linear datasets while the LSTM method excels in achieving non-linear datasets. Also, both methods have been shown to have an accuracy value compared to some other methods. This study tried to combine the two through several stages of the first stage of applying the SARIMA method using fit datasets (linear data) then residual Dataset (non-linear data) analysed using the LSTM method. The result of the combination methods will be checked for the accuracy value. This research will be compared by using SARIMA and LSTM methods separately. The Dataset used as a trial is COVID-19 patient data in the United States. The results showed that the combination of SARIMA-LSTM method is better than either SARIMA or LSTM alone with RMSE of 0.33905765 and MAE of 0.29077017. ABSTRAK: Gabungan kaedah kajian SARIMA dengan LSTM adalah menarik untuk dikaji. Gabungan kaedah ini meyakinkan dan penting kerana data yang dikumpulkan bersifat numerik dan disimpan berdasarkan waktu. Selain itu, kaedah yang diusulkan ini dapat menerima set data, samada berkadar langsung atau tidak langsung. Berdasarkan beberapa penelitian sebelumnya, kaedah SARIMA mempunyai faedah dalam melengkapi set data linear, sedangkan kaedah LSTM berguna dalam mencapai set data tidak-linear. Tambahan, kedua-dua kaedah ini terbukti memiliki nilai ketepatan lebih baik berbanding beberapa kaedah lain. Kajian ini cuba menggabungkan keduanya melalui beberapa tahap. Tahap pertama mengunakan kaedah SARIMA secara set data (data linear) kemudian baki set data (data tidak-linear) dianalisa menggunakan kaedah LSTM. Dapatan dari gabungan kedua-dua kaedah tersebut akan diperiksa nilai ketepatannya. Kajian ini akan dibandingkan melalui kaedah SARIMA dan LSTM secara berasingan. Set data yang digunakan adalah merupakan data pesakit COVID-19 dari Amerika Syarikat. Dapatan kajian menunjukkan gabungan kaedah SARIMA-LSTM memiliki nilai ketepatan yang lebih baik berbanding kaedah SARIMA secara berasingan, dan LSTM dengan RMSE adalah sebanyak 0.33905765 dan MAE sebanyak 0.29077017.

Keywords