연구진이 Next-Scale Transformer를 활용해 고해상도 인간 얼굴 신규 뷰 합성 기술을 개발했어요. 기존 방식과 달리 2D 사전 훈련 없이도 고품질 결과물을 얻을 수 있어요.
이 기술은 다양한 인물과 의상을 가진 합성 데이터셋으로 훈련되었으며, 여러 신규 뷰를 동시에 합성하여 일관성을 높였어요.
실험 결과, 인간 대상에 대한 시각적 충실도와 뷰 간 일관성이 향상되었으며, 기존 방식 대비 적은 양의 데이터로도 효과적인 훈련이 가능했어요.