레플리
글 수 72

소셜 미디어 감성분석을 통한 주가 예측

조회 수 1159 추천 수 0 2018.04.28 16:03:25


 

http://blog.naver.com/anthouse28/221082691132

 

 

 

소셜 미디어에 올린 사람들의 글을 분석해서 주가를 예측하는 방법을 설명하였습니다. 구체적인 방법은 다음과 같습니다.

 

1. 주식 사이트에서 각 종목별로 게시판의 글을 크롤링
2. 감성 단어 사전에 따라 긍정/부정 단어의 개수를 검사
3. 감성 단어 개수로 게시판의 글을 긍정/부정으로 분류
4. 긍정의 글이 많으면 주가상승, 부정의 글이 많으면 주가하락

 

 

 

그런데 위와 같이 단어의 개수로만 판단하면 정확한 결과를 얻기가 어렵다는 단점이 있습니다.

 

예를 들어, '멋지게 망했네'와 같은 문장은 멋지게(긍정) / 망했네(부정)의 단어가 섞어있지만 전체적으로는 부정적인 글이라 할 수 있습니다. 단어의 순서에 따라 문맥을 고려하는 방법이 더 효과적일 것 같습니다.

엮인글 :
List of Articles
제목 글쓴이 날짜 조회 수sort
파이썬으로 3줄 요약기 만들기 깊은바다 2018-01-19 10812
마르코프 체인을 사용한 자동 문장 생성 file 깊은바다 2017-04-05 8977
한국어 문장 분리기, KSS(Korean Sentence Splitter) 파이썬 포팅 file 깊은바다 2020-12-23 6165
한국어 채팅 데이터로 머신러닝 하기 깊은바다 2018-04-25 6086
자연어(NLP) 처리 기초 정리 깊은바다 2018-10-22 5769
자바 형태소 분석기 open-korean-txt 깊은바다 2017-04-11 5435
WordPiece와 BPE(Byte Pair Encoding) 깊은바다 2019-06-17 4742
한국어 자연어처리 데이터셋 - KorQuAD 깊은바다 2018-12-21 4725
한국어 전처리 기법 모음 깊은바다 2020-07-31 4539
빠르고 성능 좋은 형태소분석기 MeCab-Ko 깊은바다 2017-05-02 4422
문서에서 핵심 단어를 찾는 TF-IDF 알고리즘 file 깊은바다 2017-09-07 4257
한글 NLP with Python - KoNLPy 사용법 [2] 깊은바다 2017-12-08 4028
노가다 없는 텍스트 분석을 위한 한국어 NLP 깊은바다 2018-04-26 3902
한글 자모 분리 및 합치기 파이썬 패키지 [1] 깊은바다 2020-03-03 3245
TextRank 기법을 이용한 핵심 어구 추출 및 텍스트 요약 file 깊은바다 2018-12-28 3229