Amazon Bedrock에서 RAG 비용을 줄이는 새로운 패턴이 공개됐어요. 쿼리와 관련된 모델이 검색된 텍스트를 필터링해 입력 토큰을 줄여 비용을 절감해요. 주요 모델은 필터링된 텍스트만 기반으로 답변을 생성해요. 검색된 텍스트를 필터링하는 과정에서 답변 품질은 유지된다고 Amazon Bedrock 측은 밝혔어요. 이 패턴은 대규모 RAG 시스템에 적합해요.