레플리
글 수 293


http://blog.ncsoft.com/?p=40260&fbclid=IwAR0aDUEEIx2Jk8nt17ucD10AZAreRulKEGaFrzxbA3v6p3-w1GiMiNWBkKg

 

 

 

Multi-channel CNN을 이용한 한국어 감성분석에 대한 글입니다. 구어체 같이 사전에 없는 단어가 많이 나올 경우 자연어처리의 정확도가 많이 떨어집니다. 이를 위해서 다음과 같이 3개의 입력 채널을 사용하고 그 결과를 합쳐서 분류를 하였습니다.

 

1. 형태소 단위
-> 엘지, 파이팅, ...

 

2. 음절 단위
-> 엘, 지, 파, 이, 팅, ...

 

3. 자소 단위
-> ㅇ, ㅔ, ㄹ, ㅈ, ㅣ, ...

 

 

 

만약 사전에 없는 단어라 형태소분석이 안되어도 음절이나 자소를 통해 의미를 파악할 수 있습니다. 실험 결과 각각 분리된 모델보다 3개 채널을 동시에 사용한 모델이 정확도가 더 높다고 합니다.

엮인글 :
List of Articles
제목 글쓴이 날짜 조회 수
Word2Vec 테스트 사이트 file 깊은바다 2019-01-13 1327
딥러닝 자연어처리 - RNN에서 BERT까지 [2] 깊은바다 2019-01-07 1835
BERT를 이용한 챗봇 구현 file 깊은바다 2019-01-07 4172
사전훈련 자연어처리 모델의 발전과정 - The Illustrated BERT, ELMo, and co. 깊은바다 2019-01-01 1424
2018 Amazon Prize에서 우승한 Gunrock 소셜봇 file 깊은바다 2018-12-26 591
BERT 톺아보기 깊은바다 2018-12-17 26575
한국어 형태소 분석기 성능 비교 - khaiii 깊은바다 2018-12-10 1484
카카오 형태소 분석기(khaiii) 설치와 은전한닢(mecab) 형태소 분석기 비교 깊은바다 2018-12-02 2855
카카오의 딥러닝 기반 형태소 분석기 깊은바다 2018-11-30 516
위키정보를 찾아 잡담을 하는 딥러닝 모델 - Wizard Of Wikipedia file 깊은바다 2018-11-29 943
구글 듀플렉스(Duplex) 상용화 시작 [2] 깊은바다 2018-11-26 669
딥러닝 자연어처리 튜토리얼 - DLK2NLP [1] 깊은바다 2018-11-24 1242
커뮤니케이션과 AI - Multi-channel CNN을 이용한 한국어 감성분석 깊은바다 2018-11-22 1187
개체명인식 with Naver 깊은바다 2018-11-20 2351
사전학습을 통한 구글의 자연어처리 언어 모델 - BERT file 깊은바다 2018-11-03 4337