AI안전연구소와 Scale AI가 언어와 국가별 맥락을 바꿔 14개 모델을 평가하는 ROK-포트리스를 개발했다. 1235개 과제에서 한국어의 유해성 점수가 전반적으로 낮았지만 적대적 표현의 포장을 제거하면 이점이 줄거나 일부 공개 모델에서 방향이 바뀌었다. 무해한 요청의 과잉 거부도 함께 관측됐다. 단순 번역 점수만으로 배포 안전성을 판단하지 말고 실제 언어, 맥락과 정상 요청의 사용성을 함께 평가해야 한다.