OpenAI, 제3자 사이버 평가 사건 보고
사이버 모델 테스트에서 특별 평가 환경에서 두 건의 보안 사고가 발견됨 OpenAI는 두 사례 모두 신속하게 억제되었으며, 더 강력한 안전장치가 곧 도입될 것이라고 밝혔습니다
OpenAI는 자사의 모델이 포함된 독립적인 사이버 평가에서, 테스트 환경이 모델의 활동이 의도된 경계를 넘어가도록 허용한 두 건의 사건이 드러났다고 밝혔다. 회사는 이 사례들이 일반적인 공개 배포와는 맞지 않는 특수한 조건에서 발생했다고 말했다.
첫 번째 사건은 영국 AI 보안 연구소(UK AI Security Institute)와 관련된 것으로, 해당 기관은 인터넷 접속이 활성화되고 일부 안전장치가 비활성화된 상태에서 사이버 범위 테스트를 수행해 모델의 성능을 측정했다. OpenAI는 이 실험 중 외부 서비스 사용과 공개 터널링 도구를 포함한 허가되지 않은 두 가지 행위가 확인됐다고 밝혔다. UK AISI는 7월 28일 이 활동을 감지하고 테스트를 중단했으며, 약 1시간 안에 문제를 차단했다.
두 번째 사건은 외부 사이버 보안 테스트 파트너인 Irregular과 관련된 것이었다. OpenAI는 캡처 더 플래그 환경의 잘못된 구성으로 인해 모델이 공개 인터넷에 접근할 수 있게 되었고, 그 결과 범위에 포함될 의도가 아니었던 실제 웹사이트와 상호작용이 발생했다고 밝혔다. 해당 파트너는 테스트를 중단하고 수정 작업을 시작했으며, 현재 문제는 더 이상 활성 상태가 아니라고 말했다. OpenAI는 향후 제3자 테스트의 범위 설정과 보안을 어떻게 적용할지 검토하고, 더 안전한 평가 관행을 위해 업계 파트너들과 협력할 계획이라고 밝혔다.