Skip to Content

전통적인 시계열 분석 방법

TimeSeries Analysis 를 시작하며 시계열 분석을 배우기 위해서는 기본적인 통계 지식과 파이썬 또는 R 프로그래밍으로 시작합니다. 정상적인 시계열 상태와 비정상적인 시계열 상태, 이동 평균, 자기회귀 모델 등의 시계열의 기초 개념 이해가 있어야하고, 공개 데이터셋을 통한 다양한 모델링을 실험해 보면서 시계열 분석에 능숙해질 수 있습니다.


시계열 분석 시작하기

  1. 시계열 분석의 기초
  • 기본적인 통계 지식과 프로그래밍 (파이썬 또는 R)
  • 정상적인 상태와 비정상적인 상태의 이해
  • 이동 평균, 자기회귀 모델 등의 기초 개념
  • 공개 데이터셋을 통한 모델링 실험
  1. 시계열의 기본 구성 요소
  • 추세
  • 계절성
  • 순환 패턴
  • 무작위 소음 또는 불규칙성
  1. 시계열 프로젝트의 단계
  • 데이터 수집
  • 탐색적 데이터 분석
  • 데이터 전처리
  • 모델 선택 및 훈련
  • 모델 평가 및 하이퍼파라미터 조정
  • 최종 예측
  1. 시계열 프로젝트의 목적
  • 과거 데이터를 기반으로 변수의 미래 값을 예측
  • 데이터 내 패턴과 추세 포착
  1. 시계열 분석과 예측 프로젝트 구축
  • 실제 실습을 통한 기술 습득
  • 다양한 시계열 분석 및 예측 기술 구현 연습
  1. 시계열 분석 이해하기
  • 이동 평균, 지수 평활
  • 자기회귀 통합 이동 평균 (ARIMA)
  • 시계열 모델 분류
  1. 전통적인 시계열 분석 모델
  • ETS와 지수 평활
  • 홀트의 선형 추세 모델 및 홀트-윈터스 모델
  • ARIMA, SARIMA, SARIMAX, Auto ARIMA
  • ACF와 PACF
  • VAR, VMA, VARMA
  1. 시계열 데이터 예측 분석 방법론
  • 머신 러닝 모델: 로지스틱 회귀, 서포트 벡터 머신, 랜덤 포레스트
  • 딥 러닝 모델: 인공 신경망, 합성곱 신경망, 순환 신경망
  • GRU와 LSTM을 이용한 예측
  1. 시계열 데이터 분석의 최신 트렌드
  • 전통 통계 기반 방법론
  • 머신러닝/인공지능 기반 분석 방법론
  • 인공지능 기반 시계열 데이터 분석 방법론: RNN, LSTM, GRU, Seq2Seq, CNN 및 변형 모델

시계열의 기본 시계열 프로젝트의 단계: 시계열 프로젝트의 단계에는 데이터 수집, 탐색적 데이터 분석, 데이터 전처리, 모델 선택, 모델 훈련, 모델 평가, 하이퍼파라미터 조정, 그리고 최종 예측이 포함됩니다. 구조화된 접근 방식을 따르고 문제 및 데이터 특성에 따라 각 단계에 적절한 모델과 기술을 선택하는 것이 중요합니다. 시계열 프로젝트의 목적: 시계열 프로젝트의 목적은 과거 데이터에 기반하여 시간에 따라 변하는 변수의 미래 값을 정확하고 신뢰할 수 있게 예측하는 것입니다. 데이터에 내재된 패턴과 추세를 포착하여 의사결정과 계획에 사용될 수 있는 예측을 만드는 것이 목표입니다.


시계열 분석과 예측 프로젝트를 구축함으로써 실제로 원하는 것을 하면서 배우게 됩니다. 기계 학습 데이터셋에서 다양한 시계열 분석 및 예측 기술을 실제로 구현하는 연습은 기계 학습을 위한 시계열 분석 개념을 숙달하는 데 필수적입니다. 우리가 제시한 프로젝트 아이디어는 실제 실습을 통한 시계열 분석을 제공할 것입니다. 단순히 시계열을 공부하고 문헌을 읽는 것만으로는 기술적인 기술과 이해를 개발할 수 없습니다. 배경 지식은 시계열, 시계열 모델, 요소들, 그리고 가능한 응용 분야에 대한 아이디어를 제공하는 데 중요하지만, 다양한 모델과 기술에 대한 노출을 제공하는 관련 시계열 프로젝트에 참여함으로써 시계열 분석 및 예측 기술을 개발할 수 있습니다. 시계열 분석이란 무엇인가요? 시계열은 일정 기간에 걸쳐 정렬된 데이터 포인트의 순서로 정의될 수 있습니다. 이 경우 시간은 보통 독립 변수로 사용되며, 다른 변수들은 값을 계속 변경합니다. 시계열 데이터는 일정한 시간 간격으로 일정 기간 동안 모니터링됩니다. 시계열 분석은 지정된 시간 동안 데이터셋에서 공통 패턴을 식별하는 과정입니다. 이러한 패턴은 순환 패턴, 계절 패턴, 무작위 패턴, 추세로 분류할 수 있습니다. 시계열 분석 이해하기 시계열 모델은 다음과 같이 분류될 수 있습니다 - 첫 번째는 이동 평균, MA 모델로 단변량 시계열에 사용되는 기본 모델입니다. MA 모델의 출력 변수는 현재 또는 과거 값에 대한 선형 의존성을 가집니다. 새로운 시리즈는 현재/과거 값의 평균을 기반으로 개발됩니다. 이동 평균 시계열 모델을 사용하여 추세를 쉽게 파악할 수 있습니다. 지수 평활, ES 모델도 단변량 시계열에 사용됩니다. 그러나 이 경우 값은 과거 값의 가중 평균에서 결정됩니다. ES 모델을 사용하여 추세와 계절성을 식별할 수 있습니다. 자기회귀 통합 이동 평균, ARIMA는 분석 및 예측을 위해 널리 사용되는 시계열 모델입니다. 이 모델은 두 모델을 결합하여 다변량 분석을 수행합니다.


전통적인 시계열 분석 모델

인공지능 시계열 강의 커리큘럼 이 과정은 시계열 분석에 대한 완벽한 교육 과정으로, 다음과 같은 내용을 포함하고 있습니다:

  1. ETS와 지수 평활: 시계열 데이터에서 패턴을 예측하고 분석하는 기법입니다.
  2. 홀트의 선형 추세 모델 및 홀트-윈터스 모델: 시계열 데이터에서 추세와 계절성을 포착하는 모델입니다.
  3. ARIMA, SARIMA, SARIMAX, Auto ARIMA: 비정상 시계열 데이터를 분석하고 예측하는 고급 모델들입니다.
  4. ACF와 PACF: 자기상관 함수와 부분 자기상관 함수를 통해 데이터의 상관 관계를 분석합니다.
  5. VAR, VMA, VARMA: 다변수 시계열 모델로 시스템 내 여러 시계열 간의 관계를 분석합니다.

  1. 머신 러닝 모델: 로지스틱 회귀, 서포트 벡터 머신, 랜덤 포레스트 등을 시계열 데이터에 적용합니다.
  2. 딥 러닝 모델: 인공 신경망, 합성곱 신경망, 순환 신경망 등을 활용하여 시계열 예측을 수행합니다.
  3. GRU와 LSTM을 이용한 예측: 시계열 데이터에 대한 더 정교한 딥 러닝 기법을 적용합니다. 시계열 데이터 예측 분석 방법론 트렌드 전통 통계 기반 시계열 데이터 분석
  • 전통 통계 기반 시계열 데이터 분석 방법론
  • 이동평균법 (Moving average)
  • 지수평활법 (Exponential smoothing)
  • ARIMA (Autoregressive integrated moving average) = 5!
  • SARIMA (Seasonal ARIMA) 모델
  • Binary variable model (해당 시점만 1, 나머지는 0으로 변환)
  • Trigonometric model (sine과 cosine 함수의 조합으로 표현)
  • Growth curve model
  • Time series regression with autocorrelation (에러항이 시점별 correlation이 있다는 가정하에 모델링)
  • Autoregressive integrated moving average exogenous (ARIMAX) X변수를 이용하여 시계열 Y 예측)
  • Prophet, …

시계열 데이터 예측 분석 방법론 트렌드

머신러닝/인공지능 기반 시계열 데이터 분석

  • 머신러닝 기반 시계열 데이터 분석 방법론 Support vector machine/regression Random forest Boosting Gaussian process Hidden Markov model (HMM)

인공지능 기반 시계열 데이터 분석 방법론

  • Recurrent neural networks (RNN) (1986)
  • LSTM (1997)
  • GRU (2014)
  • Seq2Seq (NIPS 2014)
  • Seq2Seq with attention (ICLR 2015)
  • CNN and variants (2016)
  • Transformer (NIPS 2017)
  • GPT-1(2018), BERT(2019), GPT-3(2020, 학습비용: 약 55억원)
  • 시계열데이터