챗봇 딥러닝 - 딥러닝을 사용하여 심심이의 나쁜말 필터링 기능 구현

글 수 283

딥러닝을 사용하여 심심이의 나쁜말 필터링 기능 구현

조회 수 902 추천 수 0 2019.08.14 16:16:17

깊은바다 *.68.247.186 http://aidev.co.kr/8141

íì¤í¸

https://github.com/simsimi/DeepBadSentence

심심이는 2002년 처음 출시한 챗봇으로 전세계 챗봇 역사에 큰 획을 그었던 제품입니다. 그전까지 Alice나 Cleverbot은 AIML 같은 형식으로 질문과 대답을 작성하였습니다. 이런 방식은 보다 정교하게 대화를 컨트롤할 수 있다는 장점이 있습니다. 대신 개발자가 일일이 추가를 해야 하기 때문에 데이터셋을 늘리는데 한계가 있었습니다.

이 틀을 깨버린 것이 심심이입니다. 사용자가 직접 가르치는 기능을 넣어서 방대한 대화 목록을 구축하였습니다. 말이 이어지지 않거나 부적절한 문장을 걸러내기 어렵다는 문제가 발생했지만, 재미 그 자체에서는 확실한 강점을 보여주었습니다.

보통 일상대화 챗봇은 CPS(Conversation-turns Per Session), 즉 접속 이후 발생한 대화의 개수로 측정합니다. 많이 말을 주고받을수록 더 재미있다는 것을 뜻합니다. MS의 샤오이스가 23, 스캐터랩의 핑퐁이 17입니다. 그런데 제가 직접 들은바에 의하면 심심이는 무려 43입니다. 서비스 기간이 오래되었고 골수팬이 많다는 것을 고려해도 엄청난 수치입니다.

핑퐁의 리액션 모델은 입력 문장을 2000개의 카테고리로 분류합니다. 그래서 어떤 말에도 그럴듯한 대답이 가능합니다. 문제는 바로 2000개의 종류 밖에 대답이 없다는 것입니다. 이를 보완하기 위해 Reply Retrieval 모델을 추가하였습니다. 대답 문장만 따로 만들어놓고 질문과 가장 잘 어울리는 문장을 선택합니다. 그러나 결국 이것도 개발자가 작성해야 하므로 무작정 늘리기엔 한계가 있습니다. 심심이 같이 노래 한곡을 서로 이어서 부르는 등 재미있고 다양한 대화를 나누기 어렵습니다.

그동안 심심이의 아킬레스건이었던 나쁜말 필터링 기술이 딥러닝 덕분에 큰 발전을 했다고 합니다. 링크된 글을 보면 실제 글로벌 서비스 경험에서 얻은 인사이트를 느끼실 수 있습니다. 개인적으로는 대화를 좀 더 부드럽게 이어주는 다이얼로그 매니지먼트가 추가되었으면 좋겠습니다. 다만 80개가 넘는 언어에 대응을 해야 하기 때문에 그리 쉽지 않은 도전입니다. 그래도 앞으로 심심이가 일상대화 인공지능 분야에서 훨씬 더 발전할 것이라 생각합니다.

이 게시물을

엮인글 :

List of Articles

제목	글쓴이	날짜	조회 수
이루다 같은 챗봇은 어떤 원리로 작동하는 걸까?	깊은바다	2021-04-03	1691
이성에게 말을 거는 작업멘트를 GPT-3로 생성	깊은바다	2021-03-24	587
GPT-3로 NPC와 대화를 할 수 있는 게임 시뮬레이터	깊은바다	2021-02-22	1463
GPT-2를 사용한 텍스트 압축 기법	깊은바다	2021-02-19	473
딥러닝 자연어처리 라이브러리 - Pororo	깊은바다	2021-02-03	1529
스캐터랩의 오픈도메인 챗봇 루다 육아일기 - 모델의 구조 및 동작방식	깊은바다	2020-12-30	1191
일상대화 챗봇 레플리카(Replika)의 구현 방식	깊은바다	2020-12-22	1508
좋은 응답을 골라내는 모델 만들기 - 핑퐁의 답변매칭 알고리즘	깊은바다	2020-12-10	553
GPT-3를 헬스케어 서비스에 적용했을 때의 문제점들	깊은바다	2020-11-04	707
스캐터랩의 핑퐁팀, 새로운 생성 모델 챗봇 데모 공개	깊은바다	2020-11-02	898
카카오미니의 명령어 분류 방법	깊은바다	2020-10-23	260
딥러닝으로 동네생활 게시글 필터링하기	깊은바다	2020-10-06	398
KoNLPy를 이용하여 Huggingface Transformers 학습하기	깊은바다	2020-09-20	1571
GPT-3 패러다임을 바꿀 미친 성능의 인공지능 등장 및 활용 사례 10가지	깊은바다	2020-09-14	799
GPT3 유료화 가격 공개	깊은바다	2020-09-04	1747

쓰기

첫 페이지 5 6 7 8 9 10 11 12 13 14 끝 페이지