알리바바가 차세대 AI 모델 '큐원4' 핵심 설계를 담은 '큐원3.8-플래시-넥스트' 모델을 공개했어요. 이 모델은 기존 모델 대비 훈련 비용을 9분의 1로 줄이면서 코딩·사무 업무 성능을 향상시켰어요.
큐원3.8-플래시-넥스트는 125B 파라미터를 사용하지만, 문장 처리 시 60B만 활용하여 효율성을 높였으며, 입력 100만 토큰당 0.16달러, 출력 100만 토큰당 0.47달러의 사용료를 적용했어요.
새로운 기술인 '큐원 스파스 어텐션(QSA)'은 긴 문맥 처리 속도를 최대 7.6배 향상시켰고, 'N-그램 임베딩'은 모델 용량을 51B 파라미터만큼 늘려 성능을 개선했어요.