레플리
글 수 283

Word2Vec 테스트 사이트

조회 수 1197 추천 수 0 2019.01.13 00:24:51


K-001.png

http://w.elnn.kr/

 

 

 

딥러닝 자연어처리의 기본인 워드 임베딩(word embedding)을 한글로 테스트하는 사이트입니다. 첨부한 그림처럼 x라는 벡터의 차이만큼 새로운 단어를 찾을 수 있습니다. 주의할 점은 '한국-서울+도쿄 = 일본' 처럼 'A-B+C'에서 C는 B와 같은 종류(여기서는 수도)를 가져야 한다는 것입니다.

 

 

 

몇가지 예를 들어보면 다음과 같습니다. 하지만 모든 경우에 대해서 완벽하게 동작하지는 않습니다^^;

 

여자-여왕+왕 = 남자
개그맨-유재석+아이유 = 가수
유재석-개그맨+가수 = 김경호(?)
일본-우동+불고기 = 한국
우동-일본+한국 = 짜장

List of Articles
제목 글쓴이 날짜 조회 수sort
한글전용 초거대AI가 필요한 이유 [2] 깊은바다 2023-03-18 630
딥러닝을 이용한 자연어처리의 연구동향 깊은바다 2018-10-04 631
포자랩스의 작사/작곡 인공지능 file 깊은바다 2018-08-31 641
구글 듀플렉스(Duplex) 상용화 시작 [2] 깊은바다 2018-11-26 644
ChatGPT 플러그인 구현 방법 - manifest와 OpenAPI Spec file 깊은바다 2023-03-28 651
LLM Multi Agent: Customer Service를 기깔나게 자동화하는 방법 file [1] 깊은바다 2023-10-09 651
인터넷 검색을 하고 장기기억을 저장하는 페이스북의 챗봇 - Blenderbot 2 file 깊은바다 2021-07-19 654
사람의 말로 표현하는 페이지(PAIGE) - 자연어생성 깊은바다 2018-08-04 660
GPT3 튜링 테스트 깊은바다 2020-07-23 668
카카오미니의 명령어 분류 방법 - GloVe와 CNN 사용 깊은바다 2018-05-07 674
딥러닝 자연어처리 강의 - Natural Language Processing with PyTorch 깊은바다 2019-07-06 687
워드 임베딩에 대한 아주 쉬운 설명 - The Illustrated Word2vec 깊은바다 2019-04-09 703
새로운 자연어처리 벤치마크 - SuperGLUE 깊은바다 2019-08-15 703
GPT-3를 헬스케어 서비스에 적용했을 때의 문제점들 깊은바다 2020-11-04 707
LLM의 창발적인 현상인 CoT(Chain of Thouht) 소개 file 깊은바다 2023-07-27 708