bibo:abstract
  • As WWW grows at an increasing speed, a classifier targeted at hypertext has become in high demand. While document categorization is quite mature, the issue of utilizing hypertext structure and hyperlinks has been relatively unexplored. In this paper, we propose a practical method for enhancing both the speed and the quality of hypertext categorization using hyperlinks. In comparison against a recently proposed technique that appears to be the only one of the kind, we obtained up to 18.59% of improvement in effectiveness while reducing the processing time dramatically. We attempt to explain through experiments what factors contribute to the improvement. (rdf:langString) (en)
  • 본 논문은 하이퍼덱스트가 갖는 중요한 특성인 링크 정보를 활용한 문서 분류 모델을 제안한다. 제안된 모델의 주안점은 대상 문서와 링크로 연결된 이웃한 문서의 내용 및 범주를 분석하여 대상 문서 벡터를 조정하고, 이를 근거로 대상 문서가 어느 범주에 해당하는지를 결정한다. 또한, 이웃 문서에 포함된 용어를 반염함으로써 대상 문서의 내용을 확장 해석하고, 이웃 문서의 가용 분류 정보가 있는 경우 이를 참조함으로써 정확도 향상을 기한다. 이러한 접근 방법은 일반 웹 환경에 적용할 수 있는데, 특히 하이퍼텍스트를 주제별로 분류하여 관리하는 검색 엔진의 경우 매일 쏟아져 나오는 새로운 문서와 기존 문서간의 링크를 활용함으로써 전페 시스템의 점진적인 분류에 매우 유용하다. 제안된 모델을 검증하기 위하여 Reuter-21578과 계몽사(ETRI-Kyemong) 자료를 대상으로 실험한 결과 최고 18.5%의 성능 향상을 얻었다. (rdf:langString) (ko)
nlon:biographicalNote
  • 맹성현, 종신회원, 충남대학교 컴퓨터학과 교수, shmyaeng (rdf:langString) (cs.chungnam.ac.kr)
  • 오효정, 비회원, 한국전자통신연구원 휴먼정보처리부 연구원, ohj (rdf:langString) (etri.re.kr)
nlon:classificationNumberOfNLK
  • 569.905 (xsd:string)
nlon:containedIn
dc:creator
  • 맹성현 (xsd:string)
  • 오효정 (xsd:string)
dcterms:creator
nlon:datePublished
  • 2021-01-30T23:37:12 (xsd:dateTime)
dcterms:description
  • (A)hypertext categorization method using incrementally computable class link information (xsd:string)
bibframe:extent
  • 26 cm (xsd:string)
  • p. 498-509 (xsd:string)
dcterms:isPartOf
nlon:issuedYear
  • 2002 (xsd:string)
nlon:itemNumberOfNLK
  • 한613ㅈㄷ (xsd:string)
rdfs:label
  • 점진적으로 계산되는 분류정보와 링크정보를 이용한 하이퍼텍스트 문서 분류 방법 / 오효정, 맹성현 (xsd:string)
dcterms:language
dc:subject
  • Automatic document categorization (xsd:string)
  • Hyperlink learning (xsd:string)
  • Hypertext categorization (xsd:string)
  • 자동문서분류 (xsd:string)
  • 하이퍼링크 학습 (xsd:string)
  • 하이퍼텍스트 문서 분류 (xsd:string)
dcterms:title
  • 점진적으로 계산되는 분류정보와 링크정보를 이용한 하이퍼텍스트 문서 분류 방법 (xsd:string)
rdf:type
nlon:volumeOfNLK
  • 29(7)-29(12) (xsd:string)