챗봇 딥러닝 - 페이스북이 발표한 사전훈련 언어모델 RoBERTa

글 수 284

페이스북이 발표한 사전훈련 언어모델 RoBERTa

조회 수 1429 추천 수 0 2019.07.30 15:48:50

깊은바다 *.68.247.186 http://aidev.co.kr/8016

https://arxiv.org/pdf/1907.11692.pdf

며칠 전 페이스북에서 새로운 사전훈련 언어모델을 발표했습니다. 아직 그룹에 공유가 되지 않은 것 같아 간단하게 정리하였습니다. RoBERTa(Robustly Optimized BERT Pretraining Approach)는 BERT를 기반으로 하지만 다음과 같이 몇 가지 개선 사항이 있습니다.

1. NSP(Next Sentence Prediction) 제거

-> 기존 BERT는 특정 단어를 마스킹하여 맞히는 것과, 두 문장이 이어지는지 판단하는 두 가지 방법으로 학습을 합니다. 여기서 NSP를 빼고 마스킹만 사용하였습니다.

2. Dynamic Masking

-> 전처리에서 마스킹을 미리 하지 않고, 모델에 입력할 때 매번 마스킹을 변경합니다.

3. 학습 데이터 증가

-> 16GB에서 160GB로 10배 커졌습니다.

사진의 결과를 보면 RoBERTa가 BERT보다 월등한 성능을 보입니다. 또한 최근 공개된 XLNet을 근소한 차이로 앞서고 있습니다. 앞으로 사전훈련 방법을 개선한 다양한 모델이 나오지 않을까 생각됩니다.

이 게시물을

엮인글 :

List of Articles

제목	글쓴이	날짜	조회 수
LLM 챗봇의 특징 2가지 - RAG와 Function	깊은바다	2023-07-06	1215
딥러닝 자연어처리 튜토리얼 - DLK2NLP [1]	깊은바다	2018-11-24	1221
RAG 아키텍처의 이해	깊은바다	2023-07-23	1338
구글의 대화기반 초거대모델 LaMDA, 논문 공개	깊은바다	2022-02-08	1361
ChatGPT의 가장 큰 특징인 in-context learning	깊은바다	2023-02-21	1361
교육용 챗봇의 미래!? 구글 람다 (LaMDA)	깊은바다	2022-03-11	1362
RNN seq2seq 간단한 대화모델	깊은바다	2018-10-23	1366
사전훈련 자연어처리 모델의 발전과정 - The Illustrated BERT, ELMo, and co.	깊은바다	2019-01-01	1379
핑퐁의 리액션 모델 - Dialog-BERT 만들기	깊은바다	2020-01-28	1381
GPT-3, InstructGPT, GPT-3.5, ChatGPT의 차이점	깊은바다	2023-04-05	1381
소설 쓰는 딥러닝	깊은바다	2018-08-31	1388
GPT-3보다 3배 더 큰 구글의 초거대모델, PaLM	깊은바다	2022-04-07	1408
GPT-4의 특징 정리	깊은바다	2023-03-15	1413
페이스북이 발표한 사전훈련 언어모델 RoBERTa	깊은바다	2019-07-30	1429
글자, 사진, 영상을 동시에 처리하는 딥마인드의 딥러닝 모델 - Flamingo	깊은바다	2022-05-10	1434

쓰기

첫 페이지 9 10 11 12 13 14 15 16 17 18 끝 페이지