챗봇 딥러닝 - 꼼꼼하고 이해하기 쉬운 ELECTRA 논문 리뷰

글 수 282

꼼꼼하고 이해하기 쉬운 ELECTRA 논문 리뷰

조회 수 512 추천 수 0 2020.05.15 01:24:15

깊은바다 *.68.248.128 http://aidev.co.kr/9196

https://blog.pingpong.us/electra-review

요즘 페이스북의 얀 르쿤이 항상 강조하는게 자기지도학습(self-supervised learning)입니다. 지도학습처럼 라벨이 필요한 것은 마찬가지입니다. 하지만 사람이 아니라 기계가 스스로 만든다는 차이가 있습니다. 이렇게 라벨이 없는 대량의 데이터로 사전훈련을 하고, 라벨을 단 소수의 데이터로 다시 전이학습을 합니다. 그만큼 사람의 노력이 줄어든다는 장점이 있습니다.

이미지와 자연어처리에서 자기지도 방법이 약간 비슷하게 흘러가는 것 같습니다. 처음에는 이미지를 격자로 조각내고 빈 칸의 영역을 맞추었습니다. BERT의 마스킹과 유사합니다. 요즘에는 SimCLR 같은 contrastive learning을 이미지 자기지도학습에 사용합니다. 원본 사진과 변형된 사진을 비교하는 방식입니다. ELECTRA 역시 이와 유사합니다. 문장에서 특정 단어들을 마스킹하여 새로 생성한 후에, 원본 단어인지 바뀐 단어인지 판단합니다.

새로운 기법들이 빠르게 나오고 있어 따라잡기가 벅차네요^^; 그래도 변화의 시대 한복판에 있다는 사실이 즐겁습니다.

이 게시물을

엮인글 :

List of Articles

제목	글쓴이	날짜	조회 수
구글의 초거대모델 PaLM의 추론과 상식 능력	깊은바다	2022-05-20	838
글자, 사진, 영상을 동시에 처리하는 딥마인드의 딥러닝 모델 - Flamingo	깊은바다	2022-05-10	1417
메타, GPT-3와 동급인 175B의 초거대모델 무료 공개	깊은바다	2022-05-04	1188
GPT-3보다 3배 더 큰 구글의 초거대모델, PaLM	깊은바다	2022-04-07	1405
초거대모델의 파인튜닝 방법 - P-tuning과 LoRA	깊은바다	2022-04-05	12006
교육용 챗봇의 미래!? 구글 람다 (LaMDA)	깊은바다	2022-03-11	1361
하이퍼클로바 활용예 및 사용가이드	깊은바다	2022-03-05	3568
네이버의 초거대모델인 하이퍼클로바 사용 후기	깊은바다	2022-02-14	3169
구글의 대화기반 초거대모델 LaMDA, 논문 공개	깊은바다	2022-02-08	1358
프로그램을 작성하는 딥마인드의 알파코드	깊은바다	2022-02-04	1005
GPT-3를 강화학습으로 업그레이드한 InstructGPT	깊은바다	2022-01-30	2561
DALL-E를 능가하는 OpenAI의 GLIDE	깊은바다	2021-12-27	836
검색기반 거대모델인 딥마인드의 RETRO	깊은바다	2021-12-20	511
HyperCLOVA로 만드는 캐릭터 챗봇	깊은바다	2021-11-26	761
여러 한국어 GPT 모델들 [1]	봄눈	2021-11-21	3328

쓰기

첫 페이지 3 4 5 6 7 8 9 10 11 12 끝 페이지