ETRI-Knowledge Sharing Plaform

ENGLISH

성과물

논문 검색
구분 SCI
연도 ~ 키워드

상세정보

학술대회 커버 곡 검색을 위한 멀티스케일 2D-FTM과 n-gram을 이용한 크로마 특징 축약
Cited - time in scopus Download 0 time Share share facebook twitter linkedin kakaostory
저자
김정현, 박지현, 유원영
발행일
201712
출처
한국소프트웨어 종합 학술 대회 2017, pp.1307-1309
초록
본 논문은 대규모의 커버곡 식별 서비스에 적용할 수 있도록 기존의 방법에 비해 커버곡 식별 속도를 개선할 수 있는 크로마 특징 수열 축약 방법을 제안한다. 음악의 길이에 따라 길이가 비례하는 크로마 특징 수열을 멀티스케일 2D-FTM(Two Dimensional Fourier Transform Magnitude)과 크로마n-gram을 이용해 고정 길이의 특징벡터 형태로 표현함으로써 인덱싱을 용이하게 하고 거리비교를 단순화하여 식별 속도를 개선하였다. 축약된 크로마 벡터는 오디오 프레임 단위의 크로마 특징 수열의 전체적인 특징과 국지적인 특징을 유지하여 커버곡 간의 템포 변화와 조옮김, 리메이크 버전에 강인하도록 하였다.제안된 방법의 성능 검증을 위해서 공개 데이터셋 및 유투브 웹사이트에서 자체 수집한 대규모 데이터에서 실험을 수행하여 커버곡 식별 성능을 유지하면서 검색 속도가 개선됨을 확인하였다.
KSP 제안 키워드
fourier transform, two-dimensional(2D)