왜곡 제거 시계열 서브시퀀스 매칭에서 빠른 인덱스 구성법

Fast Index Construction in Distortion-Free Time-Series Subsequence Matching

초록

본 논문에서는 왜곡 제거 시계열 서브시퀀스 매칭에서 인덱스를 효율적으로 구성하는 방법을 다룬다. 기존의 왜곡 제거 시계열 서브시퀀스 매칭에서는 인덱스 구축에 매우 많은 시간이 걸리는데, 이는 왜곡 제거의 모든 가능한 경우를 고려하기 위해 너무 많은 윈도우가 생성되기 때문이다. 실제로 길이 30만의 시계열인 경우에도 인덱스 구축을 위해 약 100분의 많은 시간이 걸려, 대용량 시계열 데이터에 대해서는 인덱스 구축이 매우 어려운 단점이 있다. 본 논문에서는 기존 인덱스 구축 과정을 단계별로 정형적으로 분석한 후, 각 단계별 성능 극대화 방법을 제안한다. 특히, 동적 프로그래밍 기법을 이용하여 PAA-버킷 및 DF-버킷(distortion-free bucket)의 개념을 제안하는데, 이는 반복되는 계산 결과를 저장-후-재사용(store-and-reuse)하는 기법으로, 이를 사용하여 기존 방법에 비해 효율적인 인덱스 구축이 가능하다. 본 논문에서는 복잡도 분석 및 실험 평가를 통해 제안한 방법의 우수성을 입증한다.

키워드

Time-series databasesdata miningdistortion-free time-seriesindex constructionsimilar sequence matchingTime-series databasesdata miningdistortion-free time-seriesindex constructionsimilar sequence matching시계열 데이터베이스데이터 마이닝왜곡 제거 시계열인덱스 구성법유사 시퀀스 매칭
제목
왜곡 제거 시계열 서브시퀀스 매칭에서 빠른 인덱스 구성법
제목 (타언어)
Fast Index Construction in Distortion-Free Time-Series Subsequence Matching
저자
길명선김범수문양세김진호
발행일
2011-12
유형
Y
저널명
정보과학회논문지 : 데이타베이스
38
6
페이지
367 ~ 380