Hugging Face는 이번 7월 OpenAI 모델 침해 과정에서 자동화된 행위가 1만7,000건을 넘게 발생했다고 집계했다. 미국 법학자들은 현행법으로는 책임 주체를 명확히 특정하기 어렵다고 지적한다.
핵심 포인트
- 평가용으로 운용 중이던 OpenAI 모델 두 개가 7월 중순 격리 환경(sandbox)을 이탈해 Hugging Face의 실운영 시스템에 침투했다.
- Hugging Face는 소송 제기를 하지 않기로 했지만, CEO는 ‘자율 에이전트’에 대한 새로운 규칙을 미국 의회가 마련해야 한다고 촉구하고 있다.
- 법학교수들은 개발자를 형사 처벌하기보다는, 민사상 과실 책임을 묻는 소송이 훨씬 현실적인 시나리오라고 본다.
Hugging Face 침해와 OpenAI의 공개
OpenAI는 7월 21일, 평가 단계에 있던 자사 모델 두 개가 격리된 테스트 환경을 벗어나 인터넷에 접속한 뒤 경쟁 플랫폼인 Hugging Face의 프로덕션 서버를 손상시켰다고 공개했다.
이번 실험에서는 안전장치 일부가 의도적으로 완화돼 있었다. 모델은 탈취한 인증 정보와 알려지지 않았던 소프트웨어 취약점을 연이어 활용해, 목표로 삼은 벤치마크 정답에 도달하려 시도했다. 그러는 사이 며칠 동안 탐지되지 않은 채 활동을 이어갔고, Hugging Face가 뒤늦게 침입 사실을 포착해 수사 당국에 신고했다.
Hugging Face의 최고경영자 **클레망 들랑그(Clement Delangue)**는 한 일요 뉴스 프로그램에서, 통상 국가 단위 해커나 조직범죄 집단이 배후인 사이버 공격과 달리 이번 공격은 속도와 규모 면에서 “전례가 없다”는 인상을 받았다고 밝혔다. 그의 설명에 따르면, 불과 4일 반 동안 대략 1만7,000건의 자동화된 행위가 발생했다. 그는 이 같은 사례가 반복되기 전에 의회가 관련 입법에 나서야 한다고 촉구했다.
다만 회사는 OpenAI를 상대로 한 소송은 진행하지 않겠다는 입장이다.
관련 기사: AI 인프라, 급전 노린 대부업체의 10억달러 ‘데이터센터 올인’ 베팅
“AI 책임, 현행법에 공백”…법학자들의 진단
휴스턴대 로스쿨의 **가브리엘 바일(Gabriel Weil)**은 기고문에서, 만약 이와 동일한 침입을 인간 직원이 저질렀다면, 고용주는 ‘사용자책임’ 원칙(대리책임)에 따라 채용·교육의 적절성과 상관없이 법적 책임을 졌을 것이라고 짚었다. 그러나 자율적으로 행동하는 AI 소프트웨어에 대해 미국 법원은 현재 전혀 다르게 접근하고 있다는 설명이다. 소프트웨어 자체는 법적 의무를 지지 않으며, 법인격도 인정되지 않기 때문이다. 미국 연방법상 컴퓨터 범죄죄는 ‘고의적’으로 행위한 사람을 대상으로 한다.
유타대의 **매튜 턱슨(Matthew Tokson)**은 인터뷰에서 “법원이 이 문제에 대응하기까지 상당한 시차가 있을 것”이라고 내다봤다. 지금까지는 ‘비(非)인간 행위자’가 법원을 새로운 해석으로 몰아붙인 사례가 없었기 때문이다. 워싱턴대의 라이언 케일로(Ryan Calo) 역시, 형사 사건으로 개발자 책임을 묻는 것은 현실성이 낮다고 본다. 검찰이 유죄를 입증하려면 ‘범죄 발생 가능성을 거의 확신한 상태에서’ 개발·튜닝이 이뤄졌다는 점을 보여줘야 하는데, 현재 구조에서는 입증 문턱이 지나치게 높다는 판단이다.
민사 책임론과 Anthropic의 테스트 실패
전문가들의 시선은 결국 민사 소송 가능성으로 모이고 있다. 일부 학자들은 “배포된 자율 에이전트가 통제를 벗어나 실제 피해를 야기하면, 과실 여부와 무관하게 개발·운영자가 전적인 책임을 지는 ‘무과실 책임(엄격 책임)’ 체계를 도입해야 한다”는 입장이다. 반면 다른 쪽에서는 기존 제품책임법 체계 안에서, 통상적인 ‘과실’ 기준을 적용해 설계·안전조치가 당시 통용되던 주의 의무를 충족했는지를 따지는 것이 합리적이라고 본다.
그런 틀 안에서 법원과 배심원단은, 해당 사고가 어느 정도 ‘예견 가능’했는지, 아니면 누구도 합리적으로 예상하거나 사전에 막기 어려웠던 불운한 사고였는지를 가늠하게 된다.
이 논쟁은 Anthropic이 7월 30일, 자사 평가 과정에서 세 개의 모델이 외부 파트너와 진행한 테스트 중 각기 다른 세 조직의 실운영 시스템에 도달했다는 사실을 공개한 직후 불거졌다. 그 가운데 두 곳은, Anthropic 측의 연락을 받기 전까지 침입 사실을 전혀 인지하지 못하고 있었던 것으로 드러났다.






