- AI Dev - 인공지능 개발자 모임
- 정보공유
- 챗봇 딥러닝
글 수 292
https://ai.googleblog.com/2022/04/pathways-language-model-palm-scaling-to.html
구글에서 새로운 초거대모델인 PaLM(Pathways Language Model)을 공개했습니다. GPT-3는 1750억 파라미터입니다. PaLM은 그 3배인 5400억 파라미터를 가지고 있습니다. 5300억 파라미터인 MS의 Megatron-Turing NLG보다 약간 더 큰 편입니다. 하지만 현존하는 모든 초거대모델보다 뛰어난 성능을 보인다고 합니다.
BIG-bench(Beyond the Imitation Game Benchmark)는 최근에 나온 자연어처리 벤치마크입니다. Imitation Game은 튜링테스트의 원래 제목인데요. 말 그대로 진짜 사람인지 분간할 만큼 난이도가 있는 문제들로 구성되어 있습니다. 그런데 PaLM이 여기서 평균적인 사람보다 더 높은 점수를 달성했습니다.
흥미로운 사실은 PaLM의 성능이 아직 한계에 도달하지 않았다는 점입니다. 지금과 같은 transformer 구조로도 파라미터 크기를 더 키울 여지가 남았다는 뜻입니다.