유해 요인을 통제한 잔여 스트림 프로브가 훈련 말뭉치 확인이나 기준 모델 재학습 없이 내부 활성만으로 벤치마크 오염을 탐지하며, 행동 신호를 지우는 RL 사후학습 후에도 유효하다고 보고된다. Florian Braun은 이 프로토콜이 무엇을 측정하는지뿐 아니라 어디서 판정을 멈추는지까지 투명하게 정리했다.