레플리
글 수 72

음성인식 방법과 카카오i의 음성형엔진

조회 수 661 추천 수 0 2018.04.09 00:23:07


 

https://brunch.co.kr/@kakao-it/105

 

 

 

인공지능 스피커에서 가장 중요한 것중 하나는 음성인식입니다. 이런 음성인식이 어떤 방법으로 이루어지는지 설명하는 글입니다. 간단히 정리하면 다음과 같습니다.

 

< 특징 추출 >
- 음성 파형을 숫자로 된 벡터로 압축

 

< 음향 모델 >
- 특징 벡터값이 각각 어떤 음소에 해당하는지 확률 검사
- 의미는 고려하지 않고 음성의 연속적인 패턴만 검사
- '쀅혙횰 렿앟'보다는 '백할의 혁혼'이 더 그럴듯함

 

< 언어 모델 >
- 텍스트 코퍼스(corpus)를 사용해 의미에 맞는지 확률 검사
- '점심으로 방(x)을 먹었다' -> '점심으로 밥(o)을 먹었다'

엮인글 :
List of Articles
제목 글쓴이 날짜 조회 수
파이썬과 커뮤니티와 한국어 오픈데이터 - KoNLPy의 탄생배경 깊은바다 2019-11-11 942
검색을 통해 지식그래프를 바로 생성하는 알고리즘 file 깊은바다 2019-08-02 3042
NLTK 개발자들이 직접 쓴 자연어처리 책의 공개 버전 깊은바다 2019-07-02 1259
WordPiece와 BPE(Byte Pair Encoding) 깊은바다 2019-06-17 4717
스마트 스피커에서의 음악 재생 발화 오류 교정 file 깊은바다 2019-03-28 407
한국어 MRC 연구를 위한 표준 데이터셋(KorQuAD) 소개 및 B2B를 위한 MRC 연구 사례 깊은바다 2019-03-10 967
메이템 가상비서 앱 자연어처리 모듈 개발 file [1] 깊은바다 2019-01-31 823
토론하는 인공지능 - IBM Project Debater file 깊은바다 2019-01-16 579
인공지능이 법률 문서를 검토한다면? 깊은바다 2019-01-09 794
TextRank 기법을 이용한 핵심 어구 추출 및 텍스트 요약 file 깊은바다 2018-12-28 3220
한국어 자연어처리 데이터셋 - KorQuAD 깊은바다 2018-12-21 4722
자연어 관련 데이터셋 사이트 - AI 오픈 이노베이션 허브 file 깊은바다 2018-12-03 1450
네이버 검색과 개인화 깊은바다 2018-11-20 619
NUGU Knowledge Base - 지식베이스 깊은바다 2018-11-10 1030
텍스트 분석을 자동으로 해주는 서비스 - KoALA 깊은바다 2018-10-31 2083