챗봇 딥러닝 - GPT2를 Colab에서 테스트할 수 있는 코드

글 수 283

GPT2를 Colab에서 테스트할 수 있는 코드

조회 수 1783 추천 수 0 2019.05.21 15:05:30

깊은바다 *.68.247.186 http://aidev.co.kr/7650

https://colab.research.google.com/github/ilopezfr/gpt-2/blob/master/gpt-2-playground_.ipynb?fbclid=IwAR21GZFZ2gWHFwZmWss5osQpxDRuZOQsx_RXdvSbBWbyTYBogYru9bRB6qY

GPT2는 최근 OpenAI에서 발표한 딥러닝 모델입니다. 기본적으로 언어 모델인데, 입력한 문장에서 바로 다음 글자 또는 단어를 예측합니다. 그래서 계속 연속된 글을 작성할 수 있습니다.

예상보다 너무 성능이 좋아서 페이크 뉴스 같은 곳에 잘못 사용될 우려가 있을 정도입니다. 그래서 정확한 동작 방식은 공개하지 않았습니다. 현재도 117M와 345M만 사용할 수 있고, 762M와 1542M 버전은 릴리즈하지 않았습니다.

이런 GPT2를 코랩에서 간단하게 설치해서 돌려볼 수 있는 코드입니다. Unconditional sample generation은 랜덤하게 문장을 생성합니다. 반대로 Conditional sample generation은 인터랙티브하게 동작합니다. 파일을 실행하면 'Model prompt'라고 뜨는데, 여기서 원하는 문장을 입력합니다. 그러면 그 문장에 이어지는 샘플을 출력해서 보여줍니다.

117M 버전뿐만 아니라 얼마 전에 공개된 345M 버전도 테스트해볼 수 있습니다. 저도 해봤는데 345M 모델도 상당히 높은 품질의 텍스트를 만들어냅니다. 1542M 모델은 이거보다 5배 성능이 더 좋을지 궁금하네요.

이 게시물을

엮인글 :

List of Articles

제목	글쓴이	날짜	조회 수
Gluon으로구현해보는 한영기계번역 모형	깊은바다	2018-04-13	275
ChatGPT 원티드 플러그인 사용 화면	깊은바다	2023-04-07	278
사진을 인식할 수 있는 ChatGPT 멀티모달 버전 공개	깊은바다	2023-09-26	281
GPT-3.5와 클로바X 가격 비교	깊은바다	2024-02-25	289
오픈소스 LLM이 ChatGPT를 대체할 수 있을	깊은바다	2023-05-05	296
LLM의 미래는 자율행동과 멀티 에이전트	깊은바다	2023-08-30	301
Generative AI — 시장 구조, 기회, moat에 대한 몇 가지 생각	깊은바다	2023-06-27	303
화면을 보고 스마트폰 앱 사용방법을 배우는 모델 - AppAgent	깊은바다	2024-01-08	303
Koko 심리상담 서비스에서 GPT-3 대답 추천 기능을 도입	깊은바다	2023-01-11	309
네이버 케어콜의 장기기억 기능 - 맞춤 케어를 위한 기억하기 챗봇	깊은바다	2023-03-01	310
LLM의 시대에도 자연어처리를 배워야할까	깊은바다	2023-05-29	317
ChatGPT 톺아보기 - 인공지능의 역사부터 신경망, 초거대AI, ChatGPT까지	깊은바다	2023-02-01	318
GenAI 컨퍼런스 대담 요약 - 어떻게 AI가 비즈니스를 재편할 것인가	깊은바다	2023-03-08	319
GPT-3.5와 하이퍼클로바의 한국어 대결	깊은바다	2023-05-12	319
노암 촘스키의 ChatGPT 기고문	깊은바다	2023-03-09	322

쓰기

첫 페이지 1 2 3 4 5 6 7 8 9 10 끝 페이지