챗봇 딥러닝 - 퓨샷(few-shot) 러닝에 최적화된 GPT3 모델

글 수 282

퓨샷(few-shot) 러닝에 최적화된 GPT3 모델

조회 수 1155 추천 수 0 2020.05.30 13:34:00

깊은바다 *.68.248.15 http://aidev.co.kr/9233

https://www.facebook.com/groups/TensorFlowKR/permalink/1210069189334137/

요즘 자고 일어나면 새로운 딥러닝 기술이 계속 나오고 있는데요. 얼마 전 OpenAI가 GPT3라는 혁신적인 모델을 공개했습니다. 우선 파라미터가 GPT2의 1.5B에서 100배(!) 증가한 175B입니다. 기존 최고였던 T5의 11B보다도 10배나 높습니다. 이 정도 모델을 학습할 수 있는 회사는 전세계에서 손에 꼽을 듯 합니다. 정확히는 모르겠지만 아마 한 번 사전훈련시키는데 최소 몇억에서 수십억이 들거라 봅니다.

GPT2와 또 다른 차이점은 퓨삿러닝(few-shot)에 최적화 되어있다는 것입니다. 과거의 딥러닝은 사전훈련된 모델을 비교적 적은 데이터로 다시 학습시키는 파인튜닝을 사용했습니다. 제로샷, 원샷, 퓨샷러닝은 보통 따로 그래디언트 학습을 하지 않습니다. 제로샷은 사전훈련된 모델을 바로, 원샷은 하나의 예제만, 퓨샷은 몇 개의 예제만으로 새로운 도메인의 문제에 적용할 수 있습니다. 이렇게 해도 GPT3가 기존 파인튜닝한 모델들과 동급, 또는 더 높은 성능을 보였다고 합니다.

좀 더 자세한 내용은 링크의 글을 참조하시기 바랍니다.

이 게시물을

K-001.png [File Size:174.5KB/Download:67]

엮인글 :

List of Articles

제목	글쓴이	날짜	조회 수
클로바X의 사용량 제한 - QPM과 TPM	깊은바다	2024-04-01	84
Pi를 만든 Inflection AI, MS로 대거 이직한 이유	깊은바다	2024-03-25	104
LLaMA나 Mistral이 계속 무료로 유지될 수 있을까	깊은바다	2024-03-05	227
GPT-3.5와 클로바X 가격 비교	깊은바다	2024-02-25	263
OpenAI, 성능은 높아지고 가격은 싸진 새로운 모델 공개	깊은바다	2024-01-26	319
AI 휴대용 기기 R1을 만든 Rabbit의 대표 Jesse Lyu	깊은바다	2024-01-12	246
화면을 보고 스마트폰 앱 사용방법을 배우는 모델 - AppAgent	깊은바다	2024-01-08	298
LLM의 새로운 기법 - Merge와 DPO	깊은바다	2024-01-02	1121
업스테이지 SOLAR 10.7B에서 사용한 DUS 모델 확장 방법	깊은바다	2023-12-27	444
죽은 아들의 AI 아바타를 만든 중국의 부모	깊은바다	2023-12-21	178
Private sLLM - 어떻게 만들고 어떻게 배포할까?	깊은바다	2023-12-18	349
GPT-4가 내 여자친구보다 나를 더 잘 알까?	깊은바다	2023-12-12	166
FSM과 생성 에이전트의 차이점	깊은바다	2023-11-22	179
RAG를 사용한 페르소나 챗봇 - ChatHaruhi	깊은바다	2023-10-17	688
LLM Multi Agent: Customer Service를 기깔나게 자동화하는 방법 [1]	깊은바다	2023-10-09	630

쓰기

첫 페이지 1 2 3 4 5 6 7 8 9 10 끝 페이지