GLM-5.3-Flash 모델이 공개됐어요. 기존 GLM-5.3 대비 추론 속도가 최대 30배 빠른 게 특징이에요. 8bit 양자화로 메모리 사용량을 줄여 저렴한 하드웨어에서도 실행 가능해요. 다양한 멀티모달 태스크에서 뛰어난 성능을 보여줘요. Zhipu AI는 GLM-5.3-Flash 모델을 오픈소스로 공개하며, 연구 및 상업적 용도로 자유롭게 사용할 수 있도록 했어요.