챗봇 딥러닝 - 6B 파라미터의 GPT-J

글 수 284

조회 수 3146 추천 수 0 2021.07.01 12:18:15

깊은바다 *.134.227.161 http://aidev.co.kr/10603

EleutherAI는 오픈소스 GPT-3인 GPT-Neo를 공개했습니다. GPT-2의 파라미터가 1.5B, GPT-3는 175B입니다. GPT-Neo는 현재까지 2.7B까지 나왔습니다.

이번에는 6B 사이즈인 GPT-J-6B를 내놓았습니다. 800GB 텍스트에서 400B개의 토큰으로 학습했습니다. TPU v3-256으로 5주가 걸렸다고 합니다. 시간당 192$이니 192x5x7x24=161,280$입니다. 대충 2억정도 들었네요.

GPT-Neo와의 가장 큰 차이점은 제로샷이 된다는 것입니다. 별도의 파인튜닝 없이도 질문만 넣으면 다양한 태스크가 가능합니다. 샘플 아웃풋을 보면 수학계산, 기계독해(MRC), 코딩 등의 예를 보여주고 있습니다.

< 테스트 페이지 >

< GitHub >

List of Articles

제목	글쓴이	날짜	조회 수
KoGPT2 v2.0 공개	깊은바다	2021-05-03	1589
이루다 같은 챗봇은 어떤 원리로 작동하는 걸까?	깊은바다	2021-04-03	1694
이성에게 말을 거는 작업멘트를 GPT-3로 생성	깊은바다	2021-03-24	587
GPT-3로 NPC와 대화를 할 수 있는 게임 시뮬레이터	깊은바다	2021-02-22	1464
GPT-2를 사용한 텍스트 압축 기법	깊은바다	2021-02-19	473
딥러닝 자연어처리 라이브러리 - Pororo	깊은바다	2021-02-03	1529
스캐터랩의 오픈도메인 챗봇 루다 육아일기 - 모델의 구조 및 동작방식	깊은바다	2020-12-30	1191
일상대화 챗봇 레플리카(Replika)의 구현 방식	깊은바다	2020-12-22	1510
좋은 응답을 골라내는 모델 만들기 - 핑퐁의 답변매칭 알고리즘	깊은바다	2020-12-10	553
GPT-3를 헬스케어 서비스에 적용했을 때의 문제점들	깊은바다	2020-11-04	707
스캐터랩의 핑퐁팀, 새로운 생성 모델 챗봇 데모 공개	깊은바다	2020-11-02	898
카카오미니의 명령어 분류 방법	깊은바다	2020-10-23	260
딥러닝으로 동네생활 게시글 필터링하기	깊은바다	2020-10-06	398
KoNLPy를 이용하여 Huggingface Transformers 학습하기	깊은바다	2020-09-20	1573
GPT-3 패러다임을 바꿀 미친 성능의 인공지능 등장 및 활용 사례 10가지	깊은바다	2020-09-14	799

쓰기

첫 페이지 5 6 7 8 9 10 11 12 13 14 끝 페이지