레플리
글 수 203

메타AI의 멀티모달 자기지도학습 모델인 Data2vec

조회 수 1032 추천 수 0 2022.01.26 12:31:26


https://ai.facebook.com/blog/the-first-high-performance-self-supervised-algorithm-that-works-for-speech-vision-and-text

 

 

 

메타AI의 얀 르쿤은 특히 자기지도학습(Self-supervised learning)을 강조해왔습니다. 지금처럼 정답 라벨을 사람이 작성하는 지도학습은 한계가 있으니까요. 사람과 마찬가지로 인공지능 역시 누가 가르쳐주지 않아도 스스로 배워야 합니다.

 

현재도 자기지도학습이 많이 쓰이고 있습니다. 자연어처리에서는 Word2vec이 대표적이었고, 지금은 BERT 같은 사전훈련모델들에서 널리 사용되고 있습니다. 이미지 역시 마찬가지입니다. BERT처럼 사진을 masking하여 예측하거나, 이미지를 변형하여 원본과 같은 것인지 맞추는 contrastive 방식이 있습니다.

 

지금까지는 이렇게 각 모달마다 각각 다른 모델로 구현했습니다. 최근 메타에서 이를 하나의 모델로 학습하는 Data2vec을 공개했습니다. 가장 핵심은 텍스트, 이미지, 사운드의 자기지도 방식을 동일하게 적용하는 것입니다.

 

Data2vec은 teacher-student라는 방법을 사용했습니다. teacher와 student는 동일한 구조의 transformer 모델입니다. 다만 teacher는 원본 데이터를 그대로 받아서 예측하고, student는 원본을 마스킹하여 예측합니다. 그리고 student가 teacher의 representation과 동일하게 예측하도록 학습합니다. teacher는 다시 student의 가중치를 복사하여 최신상태를 유지합니다.

 

확실히 이제 transformer가 딥러닝 표준이 되었네요. 멀티모달에 강하다는 것이 큰 장점이라 생각합니다. 앞으로도 계속 새로운 자기지도 학습방법이 나올거라 기대합니다.

 

엮인글 :
List of Articles
제목 글쓴이 날짜sort 조회 수
OpenAI의 Sora로 만든 단편영화 file 깊은바다 2024-03-26 177
만약 ChatGPT가 영상으로 세상을 이해하게 된다면? file 깊은바다 2024-02-16 257
인도의 생성AI 영화 - Maharaja in Denims 깊은바다 2024-01-16 197
누구나 쉽게 AI 인플루언서를 만드는 시대 - Aitana Lopez file 깊은바다 2024-01-04 172
95생 천재 소녀가 만든 Pika가 빅테크들을 이길 수 있었던 이유 file [2] 깊은바다 2023-12-24 976
Text-to-Video 생성 서비스인 Pika, 5500만달러 투자 유치 file 깊은바다 2023-11-29 149
AI의 미래 - Coatue가 주목한 AI 산업 트렌드 깊은바다 2023-11-28 203
가구 카탈로그를 만들어주는 생성AI - 뚝딱 AI 스튜디오 file 깊은바다 2023-09-22 363
내가 원하는 사진을 만드는 생성AI SNS - 트윅(Tweak) file 깊은바다 2023-09-04 467
마우스로 끌어서 사진을 수정하는 딥러닝 - DragGAN 깊은바다 2023-05-21 446
생성 AI의 시대, 진짜 메타버스가 온다 깊은바다 2023-04-04 374
ChatGPT와 Stable Diffusion에 대한 정지훈 교수님 강의 깊은바다 2023-04-03 423
미드저니로 생성한 90년대 중국 사진들 - 콘텐츠 산업의 혁신 file 깊은바다 2023-03-30 767
어도비의 생성AI 프로그램 - Firefly 깊은바다 2023-03-23 348
초거대AI를 API로 썼을 때 경쟁업체와 차별화를 하려면 깊은바다 2023-03-20 300