출원번호 : 10-2016-0036552 (2016년03월28일)
등록번호 : 10-1769035 (2017년08월10일)
특허권자 : 울산과학기술원
요약 :
한국어 텍스트 클러스터링 시스템 및 방법이 개시된다.
본 발명은 텍스트의 명사를 형태소 분석을 통해 추출한 이후 사용자의 의도에 따라 임의의 음절을 다시 추출하여 추출된 음절을 이용하여 텍스트의 유사도 판단 및 클러스터링을 하는 것으로 명사만을 이용한 유사도 판단 및 클러스터링에 비해 정확도는 유지시키되 메모리 소모량은 감소하는 효과가 있다.





