Parason은 LLM 추론 과정에서 서브태스크 병렬성과 트라이 병렬성을 분석하고 학습하는 새로운 모델입니다.
연구 결과, 어려운 문제에서 LLM 추론 과정의 65.5%가 트라이 병렬성에 해당하며, 이는 기존의 서브태스크 병렬성을 넘어선 중요한 요소입니다.
Parason은 PA-GRPO를 통해 정확도, 지연 시간, 병렬성 비율을 균형 있게 고려하여 학습하고, AIME24 및 AIME25 수학 문제 벤치마크에서 평균 1.7배의 속도 향상을 달성했습니다.