챗봇 딥러닝 - 페이스북이 발표한 사전훈련 언어모델 RoBERTa

글 수 282

페이스북이 발표한 사전훈련 언어모델 RoBERTa

조회 수 1429 추천 수 0 2019.07.30 15:48:50

깊은바다 *.68.247.186 http://aidev.co.kr/8016

https://arxiv.org/pdf/1907.11692.pdf

며칠 전 페이스북에서 새로운 사전훈련 언어모델을 발표했습니다. 아직 그룹에 공유가 되지 않은 것 같아 간단하게 정리하였습니다. RoBERTa(Robustly Optimized BERT Pretraining Approach)는 BERT를 기반으로 하지만 다음과 같이 몇 가지 개선 사항이 있습니다.

1. NSP(Next Sentence Prediction) 제거

-> 기존 BERT는 특정 단어를 마스킹하여 맞히는 것과, 두 문장이 이어지는지 판단하는 두 가지 방법으로 학습을 합니다. 여기서 NSP를 빼고 마스킹만 사용하였습니다.

2. Dynamic Masking

-> 전처리에서 마스킹을 미리 하지 않고, 모델에 입력할 때 매번 마스킹을 변경합니다.

3. 학습 데이터 증가

-> 16GB에서 160GB로 10배 커졌습니다.

사진의 결과를 보면 RoBERTa가 BERT보다 월등한 성능을 보입니다. 또한 최근 공개된 XLNet을 근소한 차이로 앞서고 있습니다. 앞으로 사전훈련 방법을 개선한 다양한 모델이 나오지 않을까 생각됩니다.

이 게시물을

엮인글 :

List of Articles

제목	글쓴이	날짜	조회 수
이성에게 말을 거는 작업멘트를 GPT-3로 생성	깊은바다	2021-03-24	587
GPT-3로 NPC와 대화를 할 수 있는 게임 시뮬레이터	깊은바다	2021-02-22	1462
GPT-2를 사용한 텍스트 압축 기법	깊은바다	2021-02-19	473
딥러닝 자연어처리 라이브러리 - Pororo	깊은바다	2021-02-03	1529
스캐터랩의 오픈도메인 챗봇 루다 육아일기 - 모델의 구조 및 동작방식	깊은바다	2020-12-30	1191
일상대화 챗봇 레플리카(Replika)의 구현 방식	깊은바다	2020-12-22	1505
좋은 응답을 골라내는 모델 만들기 - 핑퐁의 답변매칭 알고리즘	깊은바다	2020-12-10	553
GPT-3를 헬스케어 서비스에 적용했을 때의 문제점들	깊은바다	2020-11-04	707
스캐터랩의 핑퐁팀, 새로운 생성 모델 챗봇 데모 공개	깊은바다	2020-11-02	898
카카오미니의 명령어 분류 방법	깊은바다	2020-10-23	260
딥러닝으로 동네생활 게시글 필터링하기	깊은바다	2020-10-06	398
KoNLPy를 이용하여 Huggingface Transformers 학습하기	깊은바다	2020-09-20	1571
GPT-3 패러다임을 바꿀 미친 성능의 인공지능 등장 및 활용 사례 10가지	깊은바다	2020-09-14	799
GPT3 유료화 가격 공개	깊은바다	2020-09-04	1747
GPT-3의 다섯 가지 한계	깊은바다	2020-08-23	1050

쓰기

첫 페이지 5 6 7 8 9 10 11 12 13 14 끝 페이지