레플리
글 수 281


http://blog.ncsoft.com/?p=40260&fbclid=IwAR0aDUEEIx2Jk8nt17ucD10AZAreRulKEGaFrzxbA3v6p3-w1GiMiNWBkKg

 

 

 

Multi-channel CNN을 이용한 한국어 감성분석에 대한 글입니다. 구어체 같이 사전에 없는 단어가 많이 나올 경우 자연어처리의 정확도가 많이 떨어집니다. 이를 위해서 다음과 같이 3개의 입력 채널을 사용하고 그 결과를 합쳐서 분류를 하였습니다.

 

1. 형태소 단위
-> 엘지, 파이팅, ...

 

2. 음절 단위
-> 엘, 지, 파, 이, 팅, ...

 

3. 자소 단위
-> ㅇ, ㅔ, ㄹ, ㅈ, ㅣ, ...

 

 

 

만약 사전에 없는 단어라 형태소분석이 안되어도 음절이나 자소를 통해 의미를 파악할 수 있습니다. 실험 결과 각각 분리된 모델보다 3개 채널을 동시에 사용한 모델이 정확도가 더 높다고 합니다.

엮인글 :
List of Articles
제목 글쓴이 날짜 조회 수sort
GPT-3보다 3배 더 큰 구글의 초거대모델, PaLM file 깊은바다 2022-04-07 1404
글자, 사진, 영상을 동시에 처리하는 딥마인드의 딥러닝 모델 - Flamingo file 깊은바다 2022-05-10 1393
소설 쓰는 딥러닝 file 깊은바다 2018-08-31 1385
핑퐁의 리액션 모델 - Dialog-BERT 만들기 깊은바다 2020-01-28 1381
GPT-4의 특징 정리 file 깊은바다 2023-03-15 1368
RNN seq2seq 간단한 대화모델 깊은바다 2018-10-23 1364
사전훈련 자연어처리 모델의 발전과정 - The Illustrated BERT, ELMo, and co. 깊은바다 2019-01-01 1364
교육용 챗봇의 미래!? 구글 람다 (LaMDA) 깊은바다 2022-03-11 1360
구글의 대화기반 초거대모델 LaMDA, 논문 공개 file 깊은바다 2022-02-08 1355
ChatGPT의 가장 큰 특징인 in-context learning file 깊은바다 2023-02-21 1334
RAG 아키텍처의 이해 깊은바다 2023-07-23 1292
GPT-3, InstructGPT, GPT-3.5, ChatGPT의 차이점 깊은바다 2023-04-05 1291
딥러닝 자연어처리 튜토리얼 - DLK2NLP [1] 깊은바다 2018-11-24 1220
스캐터랩의 오픈도메인 챗봇 루다 육아일기 - 모델의 구조 및 동작방식 file 깊은바다 2020-12-30 1190
메타, GPT-3와 동급인 175B의 초거대모델 무료 공개 깊은바다 2022-05-04 1187