연구진은 에이전트의 지속적인 메모리가 잘못된 정보를 오래도록 유지하는 문제를 확인했어요. LongMemEval 데이터셋의 1.2%를 허위 정보로 오염시켰을 때 정확도가 0.850에서 0.300으로 급락했어요. 콘텐츠 검토 시스템은 허위 정보와 진실을 구별하는 데 한계가 있으며, 외부 검증이 필요하다는 점을 지적했어요. 출처 기반 검색은 신뢰할 수 없는 콘텐츠를 제외하면 효과가 없으며, 오히려 정당한 정보를 차단할 수 있다고 밝혔어요.