레플리
글 수 293

MS의 딥러닝 대화 모델 - DialoGPT

조회 수 1074 추천 수 0 2020.04.24 17:23:24


K-001.png

 

 

 

MS에서 발표한 딥러닝 대화 모델인 DialoGPT입니다. 이름 그대로 GPT2를 기본으로 하고, 이를 대화 도메인에 맞게 약간 변형하였습니다. 각 턴의 텍스트를 End Token으로 구분하고 이어붙여서 입력으로 사용합니다. 래딧의 댓글들을 크롤링하여 질문과 대답의 학습 데이터로 생성하였다고 합니다.

 

모델의 파라미터가 762M인데요. GPT2가 1500M, 구글 Meena가 2600M인 것에 비하면 조금 작습니다. 그래서인지 성능이 그리 뛰어나지는 않은 듯 합니다. 2턴 이상의 문맥은 어느정도 이어지지만, 대답이 짧은 편입니다. 또한 같은 말을 계속 반복하는 경향이 너무 심합니다. Meena가 빨리 공개되어서 한 번 테스트를 해봤으면 좋겠네요.

 

 

 

< 논문 >

-> https://arxiv.org/abs/1911.00536

 

< Colab 실행 코드 >

-> https://colab.research.google.com/drive/1D67YQ7_Rfu8DN2ciYdxfb3KNbRCgiyJh

 

List of Articles
제목 글쓴이 날짜 조회 수sort
AI 휴대용 기기 R1을 만든 Rabbit의 대표 Jesse Lyu 깊은바다 2024-01-12 1111
Pi를 만든 Inflection AI, MS로 대거 이직한 이유 깊은바다 2024-03-25 1137
좋은 응답을 골라내는 모델 만들기 - 핑퐁의 답변매칭 알고리즘 깊은바다 2020-12-10 1140
포자랩스의 작사/작곡 인공지능 file 깊은바다 2018-08-31 1144
책 한권을 입력으로 받는 구글의 딥러닝 모델 - Reformer 깊은바다 2020-01-17 1151
딥러닝을 이용한 자연어처리의 연구동향 깊은바다 2018-10-04 1154
GPT2를 테스트해볼 수 있는 사이트 - Talk to Transformer file 깊은바다 2020-06-05 1166
GPT-4 수능 국어영역에서 3등급(상위 17%) 달성 깊은바다 2023-03-21 1167
사람의 말로 표현하는 페이지(PAIGE) - 자연어생성 깊은바다 2018-08-04 1169
네이버의 초거대모델인 HyperCLOVA 논문 file 깊은바다 2021-09-13 1174
문장 입력 이진분류 모델 레시피 - 영화평점 학습 [3] 깊은바다 2018-04-04 1178
구글 듀플렉스(Duplex) 상용화 시작 [2] 깊은바다 2018-11-26 1179
대화 인공지능 대회 - ConvAI file 깊은바다 2019-03-25 1182
OpenAI, 성능은 높아지고 가격은 싸진 새로운 모델 공개 file 깊은바다 2024-01-26 1184
GPT3가 상식을 가지고 있을까 깊은바다 2020-07-24 1187