레플리
글 수 283


http://blog.ncsoft.com/?p=40260&fbclid=IwAR0aDUEEIx2Jk8nt17ucD10AZAreRulKEGaFrzxbA3v6p3-w1GiMiNWBkKg

 

 

 

Multi-channel CNN을 이용한 한국어 감성분석에 대한 글입니다. 구어체 같이 사전에 없는 단어가 많이 나올 경우 자연어처리의 정확도가 많이 떨어집니다. 이를 위해서 다음과 같이 3개의 입력 채널을 사용하고 그 결과를 합쳐서 분류를 하였습니다.

 

1. 형태소 단위
-> 엘지, 파이팅, ...

 

2. 음절 단위
-> 엘, 지, 파, 이, 팅, ...

 

3. 자소 단위
-> ㅇ, ㅔ, ㄹ, ㅈ, ㅣ, ...

 

 

 

만약 사전에 없는 단어라 형태소분석이 안되어도 음절이나 자소를 통해 의미를 파악할 수 있습니다. 실험 결과 각각 분리된 모델보다 3개 채널을 동시에 사용한 모델이 정확도가 더 높다고 합니다.

엮인글 :
List of Articles
제목 글쓴이 날짜 조회 수sort
End-To-End Memory Networks - 자연어 질문에 대답하는 모델 [2] 깊은바다 2017-08-21 962
질의응답을 위한 딥러닝 모델인 메모리 네트워크 정리 file 깊은바다 2018-09-26 960
페이스북의 일상대화 딥러닝 모델 - BlenderBot file 깊은바다 2020-05-01 949
머신러닝의 자연어처리 기술 깊은바다 2018-05-11 937
LG 사이언스파크에서 만든 한글 MRC(기계독해) 데모 file [2] 깊은바다 2020-03-07 933
문장을 벡터로 변환하는 방법들 깊은바다 2021-09-16 931
GPT3 유료화 기능 소개 영상 깊은바다 2020-06-15 915
딥러닝을 사용하여 심심이의 나쁜말 필터링 기능 구현 깊은바다 2019-08-14 902
위키에서 질문의 답을 찾는 딥러닝 모델, 페이스북의 DrQA file 깊은바다 2019-08-03 902
위키정보를 찾아 잡담을 하는 딥러닝 모델 - Wizard Of Wikipedia file 깊은바다 2018-11-29 900
Word2Vec의 학습 방식 깊은바다 2019-01-17 898
스캐터랩의 핑퐁팀, 새로운 생성 모델 챗봇 데모 공개 깊은바다 2020-11-02 898
잡담봇 삽질기 - 문봇에서 딥러닝 Seq2Seq로 문장 생성 깊은바다 2018-03-25 857
ChatGPT보다 한글을 더 잘 대답하는 모델 - Claude file 깊은바다 2023-01-10 856
인간의 언어를 이해하는 기계, NLU 깊은바다 2019-05-17 850