비드래프트가 범용 LLM의 안전성 취약점을 진단하는 ‘AX-RAY’ 리더보드와 평가 데이터셋을 공개했어요. 이론적 위험으로 여겨졌던 ‘인과누설’을 실제 모델에서 탐지한 게 핵심입니다. AX-RAY 평가에서 엔비디아 모델을 포함한 2개 모델에서 인과누설 신호가 확인됐으며, 숨은 정보나 인과적 단서에 AI가 영향을 받는 현상입니다.