레플리
글 수 283


http://blog.ncsoft.com/?p=40260&fbclid=IwAR0aDUEEIx2Jk8nt17ucD10AZAreRulKEGaFrzxbA3v6p3-w1GiMiNWBkKg

 

 

 

Multi-channel CNN을 이용한 한국어 감성분석에 대한 글입니다. 구어체 같이 사전에 없는 단어가 많이 나올 경우 자연어처리의 정확도가 많이 떨어집니다. 이를 위해서 다음과 같이 3개의 입력 채널을 사용하고 그 결과를 합쳐서 분류를 하였습니다.

 

1. 형태소 단위
-> 엘지, 파이팅, ...

 

2. 음절 단위
-> 엘, 지, 파, 이, 팅, ...

 

3. 자소 단위
-> ㅇ, ㅔ, ㄹ, ㅈ, ㅣ, ...

 

 

 

만약 사전에 없는 단어라 형태소분석이 안되어도 음절이나 자소를 통해 의미를 파악할 수 있습니다. 실험 결과 각각 분리된 모델보다 3개 채널을 동시에 사용한 모델이 정확도가 더 높다고 합니다.

엮인글 :
List of Articles
제목 글쓴이 날짜 조회 수
LLM Multi Agent: Customer Service를 기깔나게 자동화하는 방법 file [1] 깊은바다 2023-10-09 647
사진을 인식할 수 있는 ChatGPT 멀티모달 버전 공개 file 깊은바다 2023-09-26 279
Poe에 추가된 업스테이지의 LLM, Solar-70b file 깊은바다 2023-09-18 438
RAG 아키텍처를 위한 임베딩 모델의 선택에 대해 깊은바다 2023-09-14 519
LLM의 미래는 자율행동과 멀티 에이전트 깊은바다 2023-08-30 300
LLM이 서로 협력하여 프로그램을 개발 - ChatDev file 깊은바다 2023-08-16 751
GPT-4에 CoT 프롬프를 적용하여 2023 수능 국어 1등급 달성 file 깊은바다 2023-08-08 623
LLM의 창발적인 현상인 CoT(Chain of Thouht) 소개 file 깊은바다 2023-07-27 708
RAG 아키텍처의 이해 깊은바다 2023-07-23 1330
GPT-4 세부구조에 대한 정보 유출 깊은바다 2023-07-20 458
Llama 2의 RLHF 구현 방법 깊은바다 2023-07-19 727
한국어 LLM 민주화의 시작 KoAlpaca file 깊은바다 2023-07-17 1060
레포트를 써주는 LLM - GPT Researcher file 깊은바다 2023-07-13 411
LLM 챗봇의 특징 2가지 - RAG와 Function 깊은바다 2023-07-06 1200
RAG(Retrieval-Augmented Generation) - LLM의 환각을 줄이는 방법 file 깊은바다 2023-07-04 9686