자질 보강과 양방향 LSTM-CNN-CRF 기반의 한국어 개체명 인식 모델

이동엽; 유원희; 임희석

216.73.217.87

개인회원 가입

개인회원
기관회원

개인회원 로그인

개인회원 가입으로 더욱 편리하게 이용하세요. 개인회원 가입

아이디/비밀번호를 잊으셨나요? 아이디/비밀번호 찾기

기관회원 로그인

소속기관에서 검색되지 않는 기관은 무료원문다운이 불가능합니다. 개인회원 가입 후 유료구매를 하시거나 소속기관 도서관에 이용문의해 주세요.

Home

자질 보강과 양방향 LSTM-CNN-CRF 기반의 한국어 개체명 인식 모델
Bi-directional LSTM-CNN-CRF for Korean Named Entity Recognition System with Feature Augmentation

발행기관

한국융합학회 바로가기
간행물

한국융합학회논문지 KCI 등재 바로가기
통권

제8권 제12호 (2017.12)바로가기
페이지

pp.55-62
저자

이동엽, 유원희, 임희석
언어

한국어(KOR)
URL

https://www.earticle.net/Article/A317610

※ 기관로그인 시 무료 이용이 가능합니다.

4,000원

원문정보

초록

영어: The Named Entity Recognition system is a system that recognizes words or phrases with object names such as personal name (PS), place name (LC), and group name (OG) in the document as corresponding object names. Traditional approaches to named entity recognition include statistical-based models that learn models based on hand-crafted features. Recently, it has been proposed to construct the qualities expressing the sentence using models such as deep-learning based Recurrent Neural Networks (RNN) and long-short term memory (LSTM) to solve the problem of sequence labeling. In this research, to improve the performance of the Korean named entity recognition system, we used a hand-crafted feature, part-of-speech tagging information, and pre-built lexicon information to augment features for representing sentence. Experimental results show that the proposed method improves the performance of Korean named entity recognition system. The results of this study are presented through github for future collaborative research with researchers studying Korean Natural Language Processing (NLP) and named entity recognition system.

한국어: 개체명 인식(Named Entity Recognition) 시스템은 문서에서 인명(PS), 지명(LC), 단체명(OG)과 같은 개체명을 가지는 단어나 어구를 해당 개체명으로 인식하는 시스템이다. 개체명 인식을 하기위한 전통적인 연구방법 으로는 hand-craft된 자질(feature)을 기반으로 모델을 학습하는 통계 기반의 모델이 있다. 최근에는 딥러닝 기반의 RNN(Recurrent Neural Networks), LSTM(Long-short Term Memory)과 같은 모델을 이용하여 문장을 표현하 는 자질을 구성하고 이를 개체명 인식과 같이 순서 라벨링(sequence labeling) 문제 해결에 이용한 연구가 제안되었 다. 본 연구에서는 한국어 개체명 인식 시스템의 성능 향상을 위해, end-to-end learning 방식이 가능한 딥러닝 기반의 모델에 미리 구축되어 있는 hand-craft된 자질이나 품사 태깅 정보 및 기구축 사전(lexicon) 정보를 추가로 활용하여 자질을 보강(augmentation)하는 방법을 제안한다. 실험 결과 본 논문에서 제안하는 방법에 따라 자질을 보강한 한국어 개체명 인식 시스템의 성능 향상을 확인하였다. 또한 본 연구의 결과를 한국어 자연어처리(NLP) 및 개체명 인식 시스템을 연구하는 연구자들과의 향후 협업 연구를 위해 github를 통해 공개하였다.

요약
Abstract
1. 서론
2. 한국어 개체명 인식 시스템 모델
  2.1 문장 표현(Sentence Representation)
  2.2 Models
3. 실험
  3.1 Dataset
  3.2 형태소 단위의 자질 표현을 위한 워드 임베딩 모델
  3.3 한국어 음절 단위와 자소 단위의 자질 표현
  3.4 성능
4. 결론
REFERENCES

키워드

개체명 인식 자연어 처리 딥러닝 자질 보강 Named Entity Recognition Natural Language Processing Deep Learning Feature Augmentation

저자

이동엽 [ DongYub Lee | 고려대학교 컴퓨터학과 ]
유원희 [ Wonhee Yu | 고려대학교 컴퓨터학과 ]
임희석 [ HeuiSeok Lim | 고려대학교 컴퓨터학과 ] Corresponding author

참고문헌

자료제공 : 네이버학술정보

간행물 정보

발행기관

발행기관명

한국융합학회 [Korea Convergence Society]
설립연도
2011
분야
복합학>학제간연구
소개
본회는 융합학문 및 융합기술을 교류를 통한 학문기술의 확대․발전․보급 및 기술개발 전략에 과학적으로 접근하여 융합학문 및 기술을 더욱 활성화하고, 회원 상호간의 정보 교류를 도모함으로써 지역과 나라발전에 기여함을 목적으로 한다.

간행물

간행물명

한국융합학회논문지 [Journal of the Korea Convergence Society]
간기
월간
pISSN
2233-4890
수록기간
2010~2022
십진분류
KDC 530 DDC 620

이 권호 내 다른 논문 / 한국융합학회논문지 제8권 제12호

피인용수 : 0건 (자료제공 : 네이버학술정보)

함께 이용한 논문 이 논문을 다운로드한 분들이 이용한 다른 논문입니다.

출처 : 네이버학술정보

0개의 논문이 장바구니에 담겼습니다.

페이지 저장

소속기관 조회

이용자님의 소속기관(단체)이 서비스에 가입되어 있는지 확인해 보십시오.
기관회원에 소속되어 있는 이용자는 원문을 무료로 이용할 수 있습니다.

상호: 주식회사 학술교육원 I 대표: 노방용 I 사업자등록번호: 122-81-88227 I 통신판매업신고번호: 제2008-인천부평-00176호 I 정보보호책임자: 이두영
주소: (21319)인천광역시 부평구 영성중로 50 미래타워 701호 I 전화: 0505-555-0740 I 팩스: 0505-555-0741 I 이메일: earticle@earticle.net

음성지원 및 돋보기 서비스

Earticle

자질 보강과 양방향 LSTM-CNN-CRF 기반의 한국어 개체명 인식 모델
Bi-directional LSTM-CNN-CRF for Korean Named Entity Recognition System with Feature Augmentation

원문정보

초록

목차

키워드

저자

참고문헌

간행물 정보

발행기관

간행물

이 권호 내 다른 논문 / 한국융합학회논문지 제8권 제12호

피인용수 : 0건 (자료제공 : 네이버학술정보)

함께 이용한 논문 이 논문을 다운로드한 분들이 이용한 다른 논문입니다.

Earticle

자질 보강과 양방향 LSTM-CNN-CRF 기반의 한국어 개체명 인식 모델 Bi-directional LSTM-CNN-CRF for Korean Named Entity Recognition System with Feature Augmentation

원문정보

초록

목차

키워드

저자

참고문헌

간행물 정보

발행기관

간행물

이 권호 내 다른 논문 / 한국융합학회논문지 제8권 제12호

피인용수 : 0건 (자료제공 : 네이버학술정보)

함께 이용한 논문 이 논문을 다운로드한 분들이 이용한 다른 논문입니다.

자질 보강과 양방향 LSTM-CNN-CRF 기반의 한국어 개체명 인식 모델
Bi-directional LSTM-CNN-CRF for Korean Named Entity Recognition System with Feature Augmentation