레플리
글 수 284

GPT-3보다 3배 더 큰 구글의 초거대모델, PaLM

조회 수 1408 추천 수 0 2022.04.07 01:24:12


Screenshot 2022-04-01 5.25.47 PM.png

 

https://ai.googleblog.com/2022/04/pathways-language-model-palm-scaling-to.html

 

 

 

구글에서 새로운 초거대모델인 PaLM(Pathways Language Model)을 공개했습니다. GPT-3는 1750억 파라미터입니다. PaLM은 그 3배인 5400억 파라미터를 가지고 있습니다. 5300억 파라미터인 MS의 Megatron-Turing NLG보다 약간 더 큰 편입니다. 하지만 현존하는 모든 초거대모델보다 뛰어난 성능을 보인다고 합니다.

 

BIG-bench(Beyond the Imitation Game Benchmark)는 최근에 나온 자연어처리 벤치마크입니다. Imitation Game은 튜링테스트의 원래 제목인데요. 말 그대로 진짜 사람인지 분간할 만큼 난이도가 있는 문제들로 구성되어 있습니다. 그런데 PaLM이 여기서 평균적인 사람보다 더 높은 점수를 달성했습니다.

 

흥미로운 사실은 PaLM의 성능이 아직 한계에 도달하지 않았다는 점입니다. 지금과 같은 transformer 구조로도 파라미터 크기를 더 키울 여지가 남았다는 뜻입니다.

 

List of Articles
제목 글쓴이 날짜 조회 수sort
GPT2의 1.5B 모델 공개 깊은바다 2019-11-08 554
네이버의 초거대모델인 HyperCLOVA 논문 file 깊은바다 2021-09-13 556
2018 Amazon Prize에서 우승한 Gunrock 소셜봇 file 깊은바다 2018-12-26 557
딥러닝을 이용한 자연어처리 깊은바다 2018-05-17 561
죽은 약혼자를 챗봇으로 살려낸 남자 - Project December 깊은바다 2021-07-27 563
인플루언서의 목소리 클론과 GPT-4로 만든 아바타 서비스 - Caryn.ai 깊은바다 2023-05-11 566
일상대화 딥러닝 모델들을 쉽게 실행할 수 있는 Openchat 깊은바다 2021-06-01 570
인공지능과 함께 글쓰기! 창의 AI x Bookathon 대회 - GPT2 깊은바다 2019-11-30 581
이성에게 말을 거는 작업멘트를 GPT-3로 생성 file 깊은바다 2021-03-24 587
구글의 딥러닝 대화 모델 - LaMDA 깊은바다 2021-06-13 587
문장 입력 이진분류 모델 레시피 - 영화평점 학습 [3] 깊은바다 2018-04-04 614
페르소나를 가진 대화 학습 - Personalizing Dialogue Agents file 깊은바다 2018-09-19 618
책 한권을 입력으로 받는 구글의 딥러닝 모델 - Reformer 깊은바다 2020-01-17 622
GPT2를 테스트해볼 수 있는 사이트 - Talk to Transformer file 깊은바다 2020-06-05 627
딥러닝을 이용한 자연어처리의 연구동향 깊은바다 2018-10-04 631