사용자가 1.2B 파라미터 DiT 모델 'Localsong'을 자체 훈련했어요. 8일 동안 클라우드 H100 1대에서 Stable Audio 3의 VAE를 활용해 학습했어요. Ace-Step, Minimax M3, Stable Audio 3보다 다양한 악기 스타일을 목표로 하며, 가사 없는 연주곡 생성에 특화됐어요. Hugging Face에 WebUI와 MP3 샘플을 공개했으며, 사용자는 직접 클론하여 실행해 볼 수 있어요.