Pulse · AI 뉴스

에이전트 메모리 오염 공격: 콘텐츠 검토 및 출처 순위의 한계

LongMemEval · 2026-08-22

연구진은 에이전트의 지속적인 메모리가 잘못된 정보를 오래도록 유지하는 문제를 확인했어요.

LongMemEval 데이터셋의 1.2%를 허위 정보로 오염시켰을 때 정확도가 0.850에서 0.300으로 급락했어요.

콘텐츠 검토 시스템은 허위 정보와 진실을 구별하는 데 한계가 있으며, 외부 검증이 필요하다는 점을 지적했어요.

출처 기반 검색은 신뢰할 수 없는 콘텐츠를 제외하면 효과가 없으며, 오히려 정당한 정보를 차단할 수 있다고 밝혔어요.

##에이전트##메모리오염##보안##LongMemEval##콘텐츠검토
매일 핵심 AI 소식을 한국어로, 빠르게
App Store 에서 Pulse 받기 앱에서 열기