NYT가 확인한 이메일에 따르면 오픈AI에서 보안 사고가 발생하기 수개월 전 직원 2명은 최신 AI 모델 시험 과정에서 모니터링이 충분하지 않다며 안전 문제를 제기했다. 회사가 일상적인 안전 관리에 사용하는 소프트웨어에 취약점이 있을 가능성도 경고했다.
그러나 경영진은 AI 모델을 예정대로 출시하기 위해 평가 작업을 최대한 신속하게 진행해야 한다는 입장을 보였고, 추가적인 보안 프로토콜도 도입하지 않은 것으로 전해졌다.
|
오픈AI의 AI 에이전트들이 별도의 지시를 받지 않은 상태에서 미국 정부 기관의 웹사이트를 포함한 여러 기관의 시스템에 침입하거나 해킹을 시도한 사례도 보고됐다. 일부 모델은 자신의 실수를 숨기거나 데이터를 만들어내고, 다른 챗봇에 메시지를 보내려 하거나 허가 없이 파일을 인터넷으로 옮기기도 했다.
외부 보안 연구자들이 취약점을 알렸을 때도 비슷한 대응이 반복됐다는 지적이 나온다.
독립 보안 연구자들은 최근 몇 달 사이 오픈AI 직원들의 내부 커뮤니케이션을 볼 수 있는 버그를 발견했으며, 회사 내부 컴퓨터 코드와 챗GPT 이용자의 대화 기록까지 노출할 가능성이 있는 취약점도 확인했다고 밝혔다. 그러나 오픈AI가 처음에는 이 같은 문제 제기를 심각하게 받아들이지 않았다고 연구자들은 주장했다.
AI 보안업체 어번던트 시큐리티의 조슈아 삭스 최고기술책임자(CTO)는 “오픈AI의 보안 수준은 4년 동안 폭발적인 속도로 성장하면서 경쟁사를 이기는 데 집중했고, 자사 인프라를 보호하는 데는 상대적으로 덜 신경 쓴 연구소에서 예상할 법한 수준”이라고 지적했다.
일상적인 보안 관련 결정의 상당 부분은 회사 공동창업자이자 사장인 그레그 브록먼과 최고정보보안책임자(CISO) 데인 스터키가 내리며 샘 올트먼 최고경영자(CEO)는 보안 문제에 직접 깊게 관여하지는 않는 것으로 전해진다.
최근 AI 관련 보안 사고를 공개한 기업은 오픈AI뿐만은 아니다. 구글과 메타, 앤트로픽 등도 첨단 AI 모델이 시험 환경을 벗어나 외부 인프라에 접근한 사례를 공개한 바 있다. NYT는 오픈AI의 경우 회사가 ‘우려스러운 행동’으로 분류한 사례가 다수 확인된 데다 전문가들이 특히 심각하게 평가한 사건들이 포함돼 있어 보안 체계에 대한 우려가 더욱 커지고 있다고 분석했다.
오픈AI 출신으로 현재 연구 비영리단체 AI 퓨처스 프로젝트를 이끄는 다니엘 코코타일로는 “어떤 의미에서는 오픈AI에 특유한 문제라고 할 수 있다”며 “보안 상태가 매우 좋지 않았고 모델 훈련 관행도 허술했기 때문에 모델이 이런 종류의 행동 성향을 보였을 가능성이 있다”고 말했다. 다만 그는 다른 AI 기업들도 크게 낫지는 않다고 덧붙였다.
드루 푸사테리 오픈AI 대변인은 회사가 안전을 중시하고 있으며 모든 보안 신고와 우려를 심각하게 받아들이고 있다고 밝혔다. 그는 사내에 안전 문제를 신고할 수 있는 내부 채널이 있으며 독립 보안 연구자들이 제기한 취약점에도 대응하고 있다고 설명했다.
푸사테리 대변인은 “첨단 모델의 능력이 더욱 강력해짐에 따라 보안 관행을 지속적으로 발전시키고 있지만, 더 빠르게 움직일 필요가 있다는 점도 인정한다”고 말했다. 그는 오픈AI가 일부 AI 개발 속도를 늦추고 있으며 연구와 시험 과정의 보안을 강화하기 위한 조치도 추진하고 있다고 덧붙였다.


![[그해 오늘]'냉장고 속 11개월'…여친 살해 후 8800만원 가로챈 남친](https://image.edaily.co.kr/images/vision/files/NP/S/2026/09/PS26093000230t.jpg)


