챗봇 딥러닝 - 문장을 사진으로 변환하는 StackGAN

글 수 293

문장을 사진으로 변환하는 StackGAN

조회 수 1535 추천 수 0 2018.09.17 18:10:48

깊은바다 *.239.16.253 http://aidev.co.kr/5894

https://arxiv.org/pdf/1612.03242.pdf

이미지를 문장으로 변환하는 것은 이미 상당한 수준에 올라있습니다. CNN으로 사진을 벡터로 변환하고 이를 다시 RNN으로 넣어 텍스트를 생성합니다. 예를 들어, 어떤 사진을 보고 "고양이가 의자위에 앉아있다"라고 문장을 만들 수 있습니다.

< Image to Text 데모 >
- http://www.cs.toronto.edu/~nitish/nips2014demo/index.html

하지만 반대로 문장을 입력하면 사진을 생성하는 것도 가능합니다. 여기서 사용되는 기법이 최근 페이크 영상 합성으로 유명한 GAN입니다. 생성자와 구분자 두 가지 모델이 서로 경쟁하면서 조금씩 학습을 수행합니다. 생성자는 특정 벡터값이 주어졌을때 이를 확률분포로 하는 이미지로 변환하고, 구분자는 생성자가 만든 사진과 실제 사진을 번갈아서 진짜인지 판단합니다.

이때 문장을 벡터로 임베딩하여 생성자의 입력으로 사용하면 텍스트를 이미지로 생성할 수 있습니다. 하지만 학습이 잘 되지 않아 품질이 많이 떨어지는 단점이 있었는데 StackGAN은 256x256 사이즈의 고해상도 사진이 가능합니다.

가장 큰 특징은 여러 단계로 학습을 했다는 것입니다. 1단계에서는 기존과 같이 저해상도의 사진을 만들고 2단계에서는 1단계의 사진과 문장 벡터를 다시 입력으로 하여 고해상도 사진을 생성합니다. 이처럼 GAN을 쌓아서 만들었다고 해서 StackGAN이라고 부릅니다.

이 게시물을

엮인글 :

2019.01.02 22:39:44
*.199.245.164

안녕하세요~!잘읽었습니당:)
본문에 "생성자는 특정 벡터값이 주어졌을때 이를 확률분포로 하는 이미지로 변환하고, -"에서 생성자의 input인 특정 벡터값이 무엇인가요??
다른글에서는 noise라고도 하고 random latent vector라고도 하더라구요....
특정벡터값이 뭔지 자세히 알려주세요...
감사합니다!

List of Articles

제목	글쓴이	날짜	조회 수
RNN seq2seq 간단한 대화모델	깊은바다	2018-10-23	1415
구글의 Transformer 신경망 모델 [2]	깊은바다	2018-10-13	3103
Seq2Seq와 어텐션 기법을 애니메이션으로 쉽게 설명한 글	깊은바다	2018-10-12	1104
썰로 푸는 NLP	깊은바다	2018-10-11	533
딥러닝을 이용한 자연어처리의 연구동향	깊은바다	2018-10-04	676
다이나믹 메모리 네트워크 정리	깊은바다	2018-09-29	1216
질의응답을 위한 딥러닝 모델인 메모리 네트워크 정리	깊은바다	2018-09-26	1064
딥러닝을 이용한 자연어 처리 입문 - 위키독스	깊은바다	2018-09-21	1188
페르소나를 가진 대화 학습 - Personalizing Dialogue Agents	깊은바다	2018-09-19	674
문장을 사진으로 변환하는 StackGAN [1]	깊은바다	2018-09-17	1535
딥러닝으로 상식 구축 - Event2Mind	깊은바다	2018-09-14	429
딥러닝과 자연어처리의 집중 메커니즘	깊은바다	2018-09-08	1086
네이버 영화 리뷰 감정 분석	깊은바다	2018-09-07	3365
포자랩스의 작사/작곡 인공지능	깊은바다	2018-08-31	691
소설 쓰는 딥러닝	깊은바다	2018-08-31	1449

쓰기

첫 페이지 11 12 13 14 15 16 17 18 19 20 끝 페이지

문장을 사진으로 변환하는 StackGAN

ddd