Google이 배경 소음, 전문 용어, 말더듬, 자기 수정까지 처리하는 고정밀 음성-텍스트 모델 'Gemini 3.5 Transcribe'를 공개했어요. gemini-3.5-transcribe-live는 1초 미만 지연 시간의 양방향 스트리밍을 지원하며, gemini-3.5-transcribe는 녹음된 음성을 텍스트로 변환합니다. Live API를 통해 실시간으로 사용할 수 있으며, 개발자는 Gemini API를 통해 통합할 수 있습니다.