本文へスキップ

変分オートエンコーダとは?

へんぶんおーとえんこーだ

変分オートエンコーダ(VAE)とは、データの潜在的な特徴を確率分布として学習し、新しいデータを生成する能力を持つ深層生成モデルのことです。

変分オートエンコーダ(Variational Autoencoder、VAE)は、2013年にKingmaとWellingが提案した深層生成モデルです。通常のオートエンコーダデータを固定ベクトル圧縮するのに対し、VAEはデータを確率分布(平均と分散で表されるガウス分布)にエンコードします。

VAEの構造は大きく二つの部分からなります。

  • エンコーダ:入力データを潜在空間上の確率分布パラメータ(平均μと標準偏差σ)に変換します。
  • デコーダ:潜在空間からサンプリングされたベクトルを入力に戻す(または新しいデータを生成する)ネットワークです。

学習の目標関数は再構成誤差KLダイバージェンス(潜在分布を標準正規分布に近づける正則化項)の和であり、この二項のバランスをとることで、潜在空間が連続かつ滑らかになります。これにより潜在空間の任意の点からサンプリングするだけで、現実的な新データを生成できます。

VAEは画像生成・異常検知・データ補完・薬分子設計など多岐にわたる応用があります。GANと比べて学習が安定しやすい一方、生成画像が若干ぼやける傾向があることも知られています。

使い方・例文

顔画像のVAEを学習させると、潜在空間上で「若い顔」と「老いた顔」のベクトルを補間することで、年齢変化を連続的に表現した合成画像を生成できます。

この用語をシェア

𝕏 でポスト LINE

最終更新:

関連用語