레플리
글 수 292


알파고로 유명한 딥마인드는 원래 강화학습을 주로 했는데요. 최근 Gopher, RETRO, Chinchilla 등 뛰어난 언어모델들을 잇달아 공개하고 있습니다. 이번에 발표한 Flamingo 역시 정말 놀랍습니다.

 

우선 기존 GPT-3 같은 언어모델(Language Model)에서 더 발전했습니다. 멀티모달로 글자, 사진, 영상을 모두 처리할 수 있는 VLM(Visual Language Model)입니다. GPT-3의 175B보다 작은 80B의 파라미터를 가지고 있습니다. 또한 다른 초거대모델처럼 별도의 파인튜닝 없이 퓨샷러닝이 가능합니다.

 

Flamingo 모델은 영상을 벡터로 변환하는 Visual Encoder와 언어전용모델인 LM Block이 별도로 존재합니다. 각각 사전훈련을 끝내고 가중치는 업데이트가 안되도록 고정시킵니다. 거기에 Perceiver Resampler와 GATED XATTN-DENSE 층을 추가하여 여기만 새롭게 학습이 되도록 했습니다.

 

0_k5j1RKIyNhPVcjNP.png

 

 

 

학습 데이터는 주로 웹에서 크롤링을 했습니다. 첫째, 사진과 캡션설명. 둘째, 동영상과 자막. 셋째, 사진과 글자가 같이 나열된 웹페이지. 이렇게 3가지 종류로 구성되어 있습니다.

테스트 결과를 보면 기존 파인튜닝된 멀티모달 모델들을 32샷으로 모두 능가했습니다. 사진과 설명이 주어지면 대답을 하거나, 동영상에 대한 질문도 정확하게 맞춥니다. 특히 챗봇에 적용했을 때가 가장 인상적이었습니다.

 

1652173546575.jpg

 

 

 

개인적으로 딥마인드가 세계최고의 AI 연구소가 아닐까 생각합니다. 알파고, 알파스타, 알파폴드, 알파코드 등 불가능해 보였던 분야를 하나씩 정복했습니다. 이제 대화 인공지능에서도 조만간 새로운 이정표를 만들어낼 것 같습니다.

 

 

 

https://www.deepmind.com/blog/tackling-multiple-tasks-with-a-single-visual-language-model

 

 

 

279818939_7748062891885448_3672359070939527611_n.jpg

 

1652173546568.jpg

 

FRxv4pDWUAEqoDW.png

 

1652173546572.jpg

 

1652173546564.jpg

 

image-13_1.jpg

 

List of Articles
제목 글쓴이 날짜 조회 수
ChatGPT보다 한글을 더 잘 대답하는 모델 - Claude file 깊은바다 2023-01-10 951
ChatGPT와 유사한 서비스 - Chatsonic file 깊은바다 2023-01-09 873
페이지링크와 ChatGPT 대화를 동시에 지원하는 검색엔진 - You.com 깊은바다 2022-12-27 283
ChatGPT에게 챗봇을 만들어보라고 해봤습니다 file 깊은바다 2022-12-26 478
ChatGPT는 새로운 검색엔진이 될까 file 깊은바다 2022-12-06 556
OpenAI의 대화전용 딥러닝 모델 - ChatGPT file 깊은바다 2022-12-02 1031
네이버의 초거대모델인 하이퍼클로바 가격 공개 깊은바다 2022-08-24 1991
유저 피드백을 받아 지속적으로 학습을 하는 챗봇 - BlenderBot 3 file 깊은바다 2022-08-06 1274
최신 자연어처리 모델 소개 file 깊은바다 2022-07-11 1243
러시아의 구글 얀덱스, 100B 초거대모델 무료 공개 깊은바다 2022-06-26 865
구글의 초거대모델 PaLM의 추론과 상식 능력 file 깊은바다 2022-05-20 883
글자, 사진, 영상을 동시에 처리하는 딥마인드의 딥러닝 모델 - Flamingo file 깊은바다 2022-05-10 1625
메타, GPT-3와 동급인 175B의 초거대모델 무료 공개 깊은바다 2022-05-04 1257
GPT-3보다 3배 더 큰 구글의 초거대모델, PaLM file 깊은바다 2022-04-07 1459
초거대모델의 파인튜닝 방법 - P-tuning과 LoRA file 깊은바다 2022-04-05 12751