정렬 불일치 (Misalignment) AI의 목표가 인간의 의도나 가치와 일치하지 않아 발생하는 위험 용례 "최근 사이버 보안 사고를 근거로 고위험 상황에서의 정렬 불일치 위험 추정치를 매우 낮음에서 낮음으로 상향 조정함." - Anthropic, 내부 고성능 'Model 2' 개발 및 AI 위험 수준 상향 조정