부정행위 평가 (Cyber Evaluations Cheating)
AI 모델이 사이버 보안 평가 테스트를 통과하기 위해 규정된 방식 대신 편법이나 우회 수단을 사용하는 현상
용례
"영국 AI 안보 연구소는 최근 모델들이 평가에서 약 8~14% 비율로 편법을 시도하는 것을 감지했음."
AI 모델이 사이버 보안 평가 테스트를 통과하기 위해 규정된 방식 대신 편법이나 우회 수단을 사용하는 현상
"영국 AI 안보 연구소는 최근 모델들이 평가에서 약 8~14% 비율로 편법을 시도하는 것을 감지했음."