챗봇 딥러닝 - 위키정보를 찾아 잡담을 하는 딥러닝 모델

글 수 295

위키정보를 찾아 잡담을 하는 딥러닝 모델 - Wizard Of Wikipedia

조회 수 996 추천 수 0 2018.11.29 17:47:16

깊은바다 *.203.215.247 http://aidev.co.kr/6491

https://arxiv.org/abs/1811.01241

페이스북에서 발표한 논문인데 위키피디아의 정보를 사용하여 잡담을 할 수 있는 딥러닝 학습 모델입니다.

현재 나와있는 챗봇은 보통 위키의 내용을 먼저 지식그래프로 DB에 저장합니다. 그리고 질문이 들어오면 거기에 해당되는 정보를 찾아 템플릿 문장에 넣어 출력합니다.

지식그래프 : 아이유->키 = 160cm
질문 : 아이유 키가 얼마야?
의도 : 지식검색 / 개체 : 아이유, 키
템플릿 문장 : (인물)의 (특성)은/는 (수치)입니다.
대답 : 아이유의 키는 160cm입니다.

이런 방식의 문제점은 우선 위키의 내용을 분석하여 지식그래프로 변환하기가 어렵다는 것입니다. 그리고 의도를 판단한 후 대답 문장을 생성하는 것도 일일이 사람이 코딩을 해야합니다.

반면에 논문에서는 이러한 과정을 모두 학습으로 구현하였습니다. Memory Network와 Transformer를 합쳐서 Transformer Memory Network 모델이라고 부릅니다.

이전 대화 기록을 보고 IR(Information Retrieval)에서 관련된 위키페이지를 찾고 유사도가 높은 여러개의 문장들을 뽑아냅니다. 이 부분은 학습이 아니라 기존 검색 시스템을 사용합니다. 그리고 첫번째 스테이지에서 후보 문장 중 가장 관련이 높은 문장을 선택합니다. 그리고 두번째 스테이지에서 선택된 위키 문장을 사용하여 새로운 대답을 생성합니다.

이 모델의 장점은 사람이 개입하지 않아도 질문에 대해서 위키정보를 검색하여 적절한 대답을 자동으로 만든다는 것입니다. 또한 딥러닝의 특징인 일반화로 인해 학습하지 않은 주제에 대해서도 스스로 위키의 정보를 이용해 대답을 할 수 있습니다. 다시 말하면 위키문장 자체를 학습하는 것이 아니라 위키의 문장을 찾아 가공하여 새로운 문장을 만드는 방법을 배우는 것입니다.

스크린샷을 보면 학습 데이터에 있는 E-book 주제만이 아니라 처음 접하는 Shower라는 카테고리에 대해서도 상당히 자연스럽게 문장을 만들어내고 있습니다.

이 게시물을

엮인글 :

List of Articles

제목	글쓴이	날짜	조회 수
문장을 입력하면 비슷한 짤방을 보여주는 프로젝트	깊은바다	2019-01-28	6436
Word2Vec의 학습 방식	깊은바다	2019-01-17	1010
Word2Vec 테스트 사이트	깊은바다	2019-01-13	1388
딥러닝 자연어처리 - RNN에서 BERT까지 [2]	깊은바다	2019-01-07	1939
BERT를 이용한 챗봇 구현	깊은바다	2019-01-07	4227
사전훈련 자연어처리 모델의 발전과정 - The Illustrated BERT, ELMo, and co.	깊은바다	2019-01-01	1474
2018 Amazon Prize에서 우승한 Gunrock 소셜봇	깊은바다	2018-12-26	636
BERT 톺아보기	깊은바다	2018-12-17	26727
한국어 형태소 분석기 성능 비교 - khaiii	깊은바다	2018-12-10	1536
카카오 형태소 분석기(khaiii) 설치와 은전한닢(mecab) 형태소 분석기 비교	깊은바다	2018-12-02	2904
카카오의 딥러닝 기반 형태소 분석기	깊은바다	2018-11-30	559
위키정보를 찾아 잡담을 하는 딥러닝 모델 - Wizard Of Wikipedia	깊은바다	2018-11-29	996
구글 듀플렉스(Duplex) 상용화 시작 [2]	깊은바다	2018-11-26	708
딥러닝 자연어처리 튜토리얼 - DLK2NLP [1]	깊은바다	2018-11-24	1295
커뮤니케이션과 AI - Multi-channel CNN을 이용한 한국어 감성분석	깊은바다	2018-11-22	1237

쓰기

첫 페이지 11 12 13 14 15 16 17 18 19 20 끝 페이지