레플리
글 수 283


하이퍼클로바를 사용해봤습니다. 정말 놀라움 그 자체네요. GPT-3는 영어라서 잘 와닿지 않았는데, 한글로 하니 느낌이 완전히 다릅니다.

 

챗봇을 만들어봤는데 대답 정말 잘합니다. 비밀유지 때문에 자세히 밝힐 수는 없지만 멀티턴은 기본이고요. BTS 멤버나 영화제목 같은 사실도 자연스럽게 문장 내용에 사용합니다.

다만 프롬프트를 잘 설정해야 합니다. 처음에 바로 제로샷으로 했는데 너무 단답이어서 재미가 없었었습니다. 그래서 길고 구체적으로 재미있게 대답한다고 프롬프트를 넣으니 훨씬 품질이 좋아졌습니다.

 

당장 하이퍼클로바를 쓰기에는 가격 때문에 많이 부담이 될텐데요. 일상대화 챗봇 레플리카도 GPT-3로 테스트를 했는데 사용자 반응이 압도적이었습니다. 그래도 결국 자신들이 파인튜닝한 GPT-2를 쓰고 있습니다. 다만 문장 증강이나 개인정보 및 욕설 제거 같은 전처리에는 바로 적용할 수 있을 것 같습니다. 한번만 하면 되니 상대적으로 비용이 적게 드니까요.

 

마음이 좀 착잡하네요. 앞으로 몇년 지나면 가격도 충분히 떨어질 텐데요. 대부분의 자연어처리 모델은 이런 초거대모델을 쓰는게 더 가성비가 높을 것입니다. 지금 모두 클라우드 서버를 쓰는 것처럼요. 과연 모델러는 이제 무얼 해야할지 걱정이네요. 인공지능 API 잘 적용하는 프로그래머가 더 각광 받을지도 모르겠습니다.

 

엮인글 :
List of Articles
제목 글쓴이 날짜sort 조회 수
워드 임베딩에 대한 아주 쉬운 설명 - The Illustrated Word2vec 깊은바다 2019-04-09 704
BERT로 토익 문제를 푸는 프로젝트 file 깊은바다 2019-04-30 2282
Jay Alammar의 트랜스포머 한글 번역글 깊은바다 2019-05-09 1065
인간의 언어를 이해하는 기계, NLU 깊은바다 2019-05-17 850
GPT2를 Colab에서 테스트할 수 있는 코드 깊은바다 2019-05-21 1783
가짜뉴스를 생성 또는 판별하는 딥러닝 모델 - Grover 깊은바다 2019-06-01 969
딥러닝을 사용하여 의도 및 엔티티를 파악하는 챗봇 소스코드 file 깊은바다 2019-06-25 2329
딥러닝 자연어처리 강의 - Natural Language Processing with PyTorch 깊은바다 2019-07-06 687
케라스로 만든 한글 Seq2Seq 챗봇 소스코드 깊은바다 2019-07-13 3091
페이스북이 발표한 사전훈련 언어모델 RoBERTa file 깊은바다 2019-07-30 1429
위키에서 질문의 답을 찾는 딥러닝 모델, 페이스북의 DrQA file 깊은바다 2019-08-03 902
딥러닝을 사용하여 심심이의 나쁜말 필터링 기능 구현 깊은바다 2019-08-14 902
새로운 자연어처리 벤치마크 - SuperGLUE 깊은바다 2019-08-15 703
100억건의 카카오톡 데이터로 
똑똑한 일상대화 인공지능 만들기 - 핑퐁 멀티턴 file 깊은바다 2019-08-20 1732
딥러닝을 활용한 뉴스 메타 태깅 깊은바다 2019-08-26 379