본 논문에서는 우리나라 우편영상에서 수취인 주소 영역을 추출하는 방법을 제안한다. 우편영상에 기입된 주소가 프린터나 타자기 등에 의해서 인쇄된 주소일 수도 있고 사람에 의해서 필기된 주소일 수도 있다. 즉, 인쇄체 우편영상과 필기체 우편영상 모두에 적용될 수 있는 수취인 주소 영역 추출 방법을 제안한다. 제안 방법에서는 이진화된 우편영상으로부터 연결요소를 추출하고 연결요소를 결합하여 문자열을 생성한다. 그 후 문자열을 군집화하고 생성된 군집 중 몇 개의 군집을 선택함으로써 수취인 주소 영역을 결정한다. 우리나라 우편봉투에 기입되는 정보의 유형별 기입 위치 패턴에 따라 우편영상을 총 9개의 균등 영역으로 분할한 후 각 영역의 중심을 초기값으로 갖는 9개의 군집을 생성하였고 k-Means 방법을 사용하여 군집화를 수행하였다. 군집화 과정에서 사용되는 거리함수로 우편영상의 폭 대 높이의 비율이 반영된 수정된 맨하탄 거리를 사용하였다. 제안 방법의 성능을 알아보기 위하여 실제 우편물 영상 1,988개를 사용하여 실험한 결과 약 93.56%의 우편영상에서 수취인 주소 영역을 정확하게 추출할 수 있었다.
KSP 제안 키워드
k-Means
저작권정책 안내문
한국전자동신연구원 지식공유플랫폼 저작권정책
한국전자통신연구원 지식공유플랫폼에서 제공하는 모든 저작물(각종 연구과제, 성과물 등)은 저작권법에 의하여 보호받는 저작물로 무단복제 및 배포를 원칙적으로 금하고 있습니다. 저작물을 이용 또는 변경하고자 할 때는 다음 사항을 참고하시기 바랍니다.
저작권법 제24조의2에 따라 한국전자통신연구원에서 저작재산권의 전부를 보유한 저작물의 경우에는 별도의 이용허락 없이 자유이용이 가능합니다. 단, 자유이용이 가능한 자료는 "공공저작물 자유이용허락 표시 기준(공공누리, KOGL) 제4유형"을 부착하여 개방하고 있으므로 공공누리 표시가 부착된 저작물인지를 확인한 이후에 자유이용하시기 바랍니다. 자유이용의 경우에는 반드시 저작물의 출처를 구체적으로 표시하여야 하고 비영리 목적으로만 이용이 가능하며 저작물을 변형하거나 2차 저작물로 사용할 수 없습니다.
<출처표시방법 안내> 작성자, 저작물명, 출처, 권호, 출판년도, 이용조건 [예시1] 김진미 외, "매니코어 기반 고성능 컴퓨팅을 지원하는 경량커널 동향", 전자통신동향분석, 32권 4호, 2017, 공공누리 제4유형 [예시2] 심진보 외, "제4차 산업 혁명과 ICT - 제4차 산업 혁명 선도를 위한 IDX 추진 전략", ETRI Insight, 2017, 공공누리 제 4유형
공공누리가 부착되지 않은 자료들을 사용하고자 할 경우에는 담당자와 사전협의한 이후에 이용하여 주시기 바랍니다.