NLP201

글

9월, 2022의 게시물 표시

Wasserstein Auto-encoders (vs VAE)

- 9월 24, 2022

비전쪽을 잘 모르다보니 Wasserstein GAN이 나왔을 때도 어렵다는 얘기 정도만 듣고 따로 찾아보지는 않았는데 이번에 스토리 생성 관련 연구를 하면서 이 Wasserstein Distance를 활용한 Auto-encoder가 나와서 소개하고자 합니다. Backgrounds 1. Wasserstein Distance(편의상 W-dist) W-dist는 두 확률 분포간의 거리를 나타내는 방식으로 Optimal Transport 문제에서 유래했다. 확률 분포를 흙더미라고 생각하고 $P(X)$를 $Q(X)$로 옮길 때 필요한 일의 양을 두 확률 분포의 거리라고 정의할 수 있다. 고전역학에서 일의 양은 힘 곱하기 거리로 표현되는데, 확률 분포의 무게는 합이 1로 제한되고, 거리는 단순히 euclidean distance로 표현할 수 있을 것이다. 이때 $P$의 $x$위치에서 $Q$의 $y$위치로 옮기는 확률 분포의 양을 $\gamma(x,y)$로 표현하고, 거리 함수(cost)를 $c(x,y)$로 표현해보자. 그러면 W-dist는 아래와 같이 정의할 수 있다. $$ W(P,Q) = \inf_{\gamma \sim \Gamma[P,Q]} \mathbb{E}_{X,Y \sim \gamma} [c(X,Y)] ,\\ \textrm{where } \int_x \gamma(x,y) dx = Q(Y), \int_y \gamma(x,y) dy = P(X), \gamma(x,y) \geq 0 $$ 2. Variational Autoencoder 데이터셋의 Low dimension Latent Variable을 학습하기 위한 모델 중 하나인 VAE는 그 수학적 배경과 단순한 구현으로 인해 여전히 많이 사용되는 기법이다. 단순히 point estimate을 하는 auto encoder와 달리 VAE는 latent variable에 대한 gaussian prior 및 posterior를 가정하여 얻어진 tractable한 E...

자세한 내용 보기

이 블로그 검색

NLP201

글

From In-context learning to RLHF (Feat. ChatGPT)

Wasserstein Auto-encoders (vs VAE)