DDPM 공부중인데 Loss 수식 전개 중 막혀서 질문 글 올려봄..
https:1//developers-shack.tistory.com/m/8 여기 DDPM Loss function 전개 과정 중 KL-Divergence의 Non-Negativity를 활용하여 ELBO를 구하는 부분이 있는데 정작 KL-Divergence Term을 못만들겠다.. (첨부된 이미지의 2 -> 3번 수식 넘어가는 과정)
내가 전개를 잘못한거냐 블로그가 틀린거냐
- dc official App
뭔가 제목이랑 내용이 안맞는데 gpt만들려면 트랜스포머를 공부해야 하는거 아닌가 - dc App
제목 어그로임 - dc App
옌센 부등식으로 전개하면 나옴
블로그 notation 이 이상한 거 아닌가 애초에 x_0 에 대한 marginal 을 x_T 의 분포에 대하여 기댓값을 취한게 되잖아 ELBO 에 대한 유도는 log p(x) = E_z[log p(x,z)] 에서 시작하잖아 DDPM 에서는 latent z 가 x_1,...,x_T 가 되는거고