Forsaken_Goal3692가 Qwen3-TTS 1.7B 오픈소스 구현체를 공개했어요. H100에서 10건/초 처리 속도와 50ms p95 TTFA를 달성하며, 4090에서도 실시간 성능을 낼 수 있어요. 기존 vLLM-Omni, SGLang-Omni 대비 속도가 훨씬 빠릅니다.
블로그에서 방법론을 확인할 수 있으며, 사용자 피드백을 환영해요. 네트워크 지연까지 고려하면 클라우드 서비스보다도 빠른 속도를 제공합니다.
이 구현체와 벤치마크는 오픈소스로 공개됐으며