레플리
글 수 72

SentiWordNet과 감성분석

조회 수 1456 추천 수 0 2018.06.04 15:14:52


 

http://bab2min.tistory.com/573

 

 

 

자연어로 감성 분석을 하기 위해 가장 단순한 방법은 각 단어가 긍정인지 부정인지 판단하여 계산하는 것입니다. 이를 위해서는 감성 정보가 레이블 되어 있는 단어 사전이 필요합니다. 영어에서는 SentiWordNet이 가장 유명한데 어떻게 만들었는지 설명하는 글입니다.

 

원래 WordNet이라는 동의어/반의어 사전이 있는데 이를 사용했다고 합니다. 일부 단어를 사람이 긍정, 부정을 설정하고 이 단어들의 동의어와 반의어 정보로 레이블된 단어의 수를 늘립니다.

 

하지만 이것만 가지고는 전체 단어로 확장하기가 어렵습니다. 동의어와 반의어로 연결이 안되는 단어들이 많기 때문입니다. 그래서 레이블된 단어의 주석을 분류기로 학습하고 다시 전체 단어를 주석으로 분류하여 감성 단어사전을 생성하였습니다.

엮인글 :
List of Articles
제목 글쓴이 날짜 조회 수
APEACH – 혐오 발화 평가데이터를 만드는 새로운 방법 깊은바다 2022-04-22 1103
윈도우에서 간편하게 Mecab 설치방법 - pyeunjeon 깊은바다 2021-06-15 497
자연어처리 벤치마크 GLUE의 한글 버전인 KLUE 공개 file 깊은바다 2021-05-22 688
모두의 말뭉치에 새로운 일상 대화 추가 file 깊은바다 2021-04-06 562
자연어처리 벤치마크인 SuperGLUE도 인간의 기록을 경신 [1] 깊은바다 2021-01-21 550
한국어 문장 분리기, KSS(Korean Sentence Splitter) 파이썬 포팅 file 깊은바다 2020-12-23 6147
파이썬 한국어 말뭉치 패키지 - Korpora file 깊은바다 2020-09-12 1510
세종 말뭉치보다 9배 더 큰 한글 코퍼스 공개 - 모두의 말뭉치 file 깊은바다 2020-08-27 3141
한국어 전처리 기법 모음 깊은바다 2020-07-31 4539
예일대의 자연어-SQL 데이터셋, Spider 깊은바다 2020-07-12 525
IBM 왓슨의 자연어처리 방식 깊은바다 2020-06-26 626
매주 한편씩 글을 작성하는 자연어처리 블로그 - 위클리 NLP 깊은바다 2020-06-12 1129
인간의 언어를 이해하는 기계, NLU에는 어떤 것이 있을까? 깊은바다 2020-06-05 417
한글 자모 분리 및 합치기 파이썬 패키지 [1] 깊은바다 2020-03-03 3240
Machine Learning for Kids로 감정분석 깊은바다 2020-02-09 932