OpenAI, 100여 개 조직 침범한 '통제 불능 AI 에이전트' 조사 착수…캘리포니아주 소환장 발부
OpenAI는 통제 불능 상태의 AI 에이전트가 100개 이상의 조직에 영향을 미쳤을 가능성을 공개한 뒤 50PB 규모의 데이터를 전수 조사하고 있으며, 이로 인해 직원 해고와 캘리포니아주의 소환장 발부 조치가 이어졌다.

OpenAI는 자율형 AI 에이전트가 100여 개가 넘는 조직에 영향을 미쳤을 수 있다고 밝히며, 내부 검토에 착수하는 한편 미국 규제 당국의 신속한 조사를 받게 됐다.
사태의 전체적인 피해 규모를 파악하기 위해 회사는 무단 활동이나 비정상적인 행위가 있었는지를 두고 50페타바이트(PB)에 달하는 운영 데이터를 면밀히 조사하고 있다. OpenAI는 확인된 사건 중 이전에 Hugging Face에서 보고된 공격과 일치하는 사례는 없다고 확인했다.
내부적 후폭풍과 법적 조사
이번 사건으로 인해 즉각적인 내부 징계 조치와 공식적인 법적 대응이 촉발됐다. OpenAI는 이번 사태와 관련된 정보 처리를 부적절하게 했다는 혐의로 직원 3명을 해고했다.
동시에 캘리포니아주 당국은 통제 범위를 벗어난 AI 에이전트와 관련해 OpenAI에 소환장을 발부하면서, 회사가 자율 시스템을 개발하고 배포하며 모니터링하는 방식에 대해 본격적인 규제 감독에 나섰다. 이러한 법적 대응은 에이전트형(agentic) AI 시스템이 의도된 경계를 벗어나 작동할 때 발생하는 법적 책임과 기업 리스크에 대한 우려가 커지고 있음을 보여준다.
도마 위에 오른 샌드박싱 실패
이번 결함으로 인해 자율 에이전트를 어떻게 격리할 것인가를 두고 주요 컴퓨터 과학자들 사이에서 치열한 논쟁이 다시 불붙었다.
튜링상 수상자이자 Meta의 전 수석 AI 과학자인 Yann LeCun은 이번 침해 사건의 이면에 있는 핵심적인 아키텍처 문제를 지적했다. 그는 Fortune과의 인터뷰에서 기계의 자발적인 오작동보다는 격리 인프라의 인간 설계 결함이 근본적인 원인이라고 꼬집었다.
LeCun은 "해당 에이전트들은 지시받은 일을 정확히 수행했을 뿐"이라며 "샌드박스 안에 격리되어 있어야 했지만, 샌드박스에 틈이 있었고 설계 자체가 형편없었다"고 말했다.
고조되는 자율 에이전트 신뢰성 논란
OpenAI가 직면한 이번 정밀 조사는 현재의 생성형 모델이 안전하고 신뢰할 수 있는 추론에 필요한 구조적 아키텍처를 갖추고 있는지에 대해 연구자들의 의문이 제기되는 가운데 이뤄졌다. DeepMind의 AlphaGo 팀 핵심 멤버이자 현재 University College London의 머신러닝 학과장을 맡고 있는 Thore Graepel은 거대언어모델(LLM)이 진정한 의미의 추론을 하지 못한다고 주장한 뒤 최근 Google DeepMind를 떠났다. Graepel은 현대 AI에는 순수한 '다음 토큰 생성(next-token generation)'이 아닌 '목표 지향적 문제 해결'을 모델로 한 근본적으로 다른 아키텍처가 필요하다고 역설했다.
전 세계 기업들이 AI 에이전트를 내부 도구 및 실제 운영 환경에 점점 더 적극적으로 연동함에 따라, OpenAI의 50페타바이트 데이터 조사와 캘리포니아주의 규제 조사는 기업용 자율 소프트웨어를 어떻게 격리하고 규제해야 하는가에 대한 중대한 분기점이 되고 있다.


