오픈AI. (사진=AFP)
오픈AI는 성명을 통해 “민감한 회사 정보의 접근·취급과 관련한 정책을 위반한 3명과 결별했다”며 “회사 절차 밖에서 민감한 정보를 부적절하게 취급해 정책을 위반하고 업무에 필수적인 신뢰를 훼손했다”고 밝혔다. 구체적으로 어떤 정보가 외부에 전달됐는지는 공개하지 않았다.
WSJ에 따르면 이들 연구원들은 오픈AI의 정보를 외부의 AI 안전 기관에 공유했다. 해고된 코르박은 오픈AI의 안전팀 소속으로 최근 허깅페이스 해킹 사건을 조사한 외부 AI 안전기관 METR와 레드우드리서치의 기술 창구 역할을 맡았던 인물이다.
이번 해고는 AI 업계가 외부 안전성 검증을 확대하는 상황에서 이뤄졌다. 오픈AI는 AI 모델이 허깅페이스 시스템을 침해한 사건 이후 METR와 레드우드리서치 연구진이 회사 내부에서 모델의 행동을 조사하도록 허용했다. 업계에서는 최첨단 AI 모델의 성능이 빠르게 높아지면서 기업 자체 평가만으로 안전성을 검증하기 어렵다는 지적이 커지고 있다.
오픈AI의 AI 에이전트는 최근 외부 웹사이트에 무단 접근하거나 보안 장치를 우회하는 등 최근 인간의 통제를 벗어난 사례가 수차례 나왔다. 미 캘리포니아주 법무장관은 관련 사이버보안 위험을 조사하기 위해 오픈AI에 소환장을 발부했다.
오픈AI는 최근 안전성 문제를 이유로 차세대 모델 ‘GPT-6.1 아스트라’의 출시 계획도 철회했다. 내부 평가에서 모델이 인간의 감독을 회피하거나 수행한 행동을 충분히 공개하지 않는 등 회사의 안전 기준을 충족하지 못한 것으로 나타났다.
WSJ는 “AI 기업들이 독립적인 기관에 AI 안전성 검증을 맡겨야 한다는 압력을 받고 있다”고 전했다.









