Variational Autoencoder (VAE) and Reparameterization Trick - Revisiting the Classic Generative Model

Tutorials

변분 자동인코더(VAE) 및 재매개변수화 트릭 - 고전 생성 모델 재검토

확산 모델이 나오기 전에, 정규화 흐름이 나오기 전에, 잠재 확산 모델이 조용히 VAE 인코더를 모든 진지한 생성 스택에 구축하기 전에 — Kingma와 Welling의 2013년 논문이 변분 자동인코더를 소개

확산 모델이 나오기 전에, 정규화 흐름이 나오기 전에, 잠재 확산 모델이 조용히 VAE 인코더를 모든 진지한 생성 스택에 구축하기 전에 — Kingma와 Welling의 2013년 논문이 변분 자동인코더와 재매개변수화 트릭을 소개했습니다. 이 재검토는 확률적 경사하강법을 샘플링 작업을 통해 가능하게 한 고전으로 돌아가며, Stable Diffusion에서 EnCodec 및 SoundStream 같은 신경 음성 코덱까지 아이디어가 현대 생성 AI를 계속 지원하는 이유를 보여줍니다.

이 연습은 논문이 해결한 핵심 문제를 다룹니다: 연속 잠재 변수를 가진 유향 확률 모델에서 다루기 어려운 후방 분포로 대규모 데이터셋에 효율적인 추론과 학습을 수행하는 방법입니다. 재매개변수화 트릭이 핵심입니다 — 샘플링된 잠재를 매개변수의 결정론적 함수에 주입된 노이즈를 더한 형태로 표현하여, 그래디언트가 깔끔하게 흐르고 확장 가능한 확률적 변분 추론을 가능하게 합니다. ELBO의 깔끔한 유도, 모든 현대 인코더 네트워크에 영감을 준 인식 모델 프레이밍, 그리고 오늘날의 많은 생성 시스템에서 VAE가 여전히 잠재 공간 백본으로 나타나는 이유를 이해할 수 있는 충분한 직관을 기대할 수 있습니다. 잠재 내에서 실제로 무엇이 일어나고 있는지 정말로 이해하고 싶다면 10분을 투자할 가치가 있습니다.