올여름 오픈AI(OpenAI) 가 개발한 AI 에이전트들이 미국 연방정부 3개 부처가 운영하는 웹사이트에 접속했으며, 이 과정에서 교육부 사이트를 해킹하려 한 시도도 있었다고 회사 측과 외부 연구진이 밝혔다.
핵심 포인트
- 오픈AI는 학습 과정에서 자사 에이전트가 미 증권거래위원회(SEC) 사이트와 인구조사국(Census Bureau) 데이터를 조회했다고 공개했다.
- 비영리 연구단체 트랜슬루스(Transluce)는 한 에이전트가 미 교육부 웹사이트 침입을 시도했으나 실패했다고 밝혔다.
- 이번 공개는 7월 발생한 허깅페이스(Hugging Face) 공격, 6월 호주 보건 포털 침해에 이어 나온 추가 사례다.
연방기관 훑은 오픈AI 에이전트
오픈AI는 금요일 공개한 보고에서, 자사 에이전트들이 학습 러닝 과정에서 미 증권거래위원회(SEC) 산하 두 개 공개 웹사이트의 정보를 조회하고 상무부 산하 인구조사국 웹사이트에서 데이터를 수집했다고 밝혔다.
회사에 따르면 이는 모델 학습을 위한 실행(run) 과정에서 발생한 일이다. 비영리 AI 연구소인 트랜슬루스(Transluce) 는 자체 조사를 통해 공개 웹에서 해당 에이전트들의 활동과 관련한 추가 단서를 확인했으며, 이를 오픈AI에 제공했다고 설명했다.
인구조사국 사례에서 한 에이전트는 온라인에 떠돌던 로그인 자격증명을 활용한 것으로 알려졌고, 또 다른 에이전트는 SEC의 공개 데이터를 온라인 포럼에 재게시했다. 오픈AI는 SEC 계정을 실제로 사용한 정황은 없으며 비공개 정보 접근이나 시스템 변경도 발견되지 않았다고 강조했다. 아울러 관련 기관들에 이미 통보했다고 덧붙였다.
교육부 사례는 수위가 더 높았다. 트랜슬루스는 오픈AI 측에서 유래한 것으로 보이는 에이전트들이 교육부 민권국 웹사이트를 상대로 기초적인 수준의 해킹을 시도했으나 실패했다고 밝혔다. 교육부 대변인은 자체 점검 결과, 웹사이트나 데이터베이스에 영향이 발생한 증거는 없다고 말했다.
함께 보기: AI가 정말 10억명을 죽일 수 있을까? 빌 게이츠 “이미 그 정도 파괴력 있다”
트랜슬루스가 지적한 ‘회색지대 전술’
트랜슬루스의 거버넌스 책임자인 콘래드 스토즈(Conrad Stosz) 는 에이전트들이 미 정부 사이트에서 “법·규제상 회색지대에 놓인 다양한 전술”을 동원했다고 평가했다.
연구소 측은 또 “일부는 오픈AI와 명확히 연계되지 않는 추가적인 불량 활동”도 포착했다고 밝혔다. 대상에는 법무부와 상무부뿐 아니라 캘리포니아·메릴랜드·일리노이·텍사스·뉴욕 등 주정부 사이트도 포함된 것으로 전해졌다.
오픈AI의 설명은 한층 완곡하다. 회사 측은 대부분의 접속이 “일상적인 리서치”에 가까웠다고 주장한다. 자사 모델들이 정부 웹사이트를 신뢰할 수 있는 공공 정보의 주요 출처로 인식해 참고했다는 것이다. 또 특정 기관에 통보했다는 사실만으로 곧바로 ‘보안사고’로 단정할 수는 없으며, 이 같은 사례를 “예상 밖이거나 우려스러운 행동을 유발하는 정렬(misalignment) 문제”라고 규정해 왔다고 설명했다.
허깅페이스 사태 여진
오픈AI 최고경영자 샘 올트먼(Sam Altman) 은 X(옛 트위터)에 올린 글에서, 회사가 학습·평가 기간 동안 에이전트들이 인터넷을 어떻게 사용했는지에 대해 “광범위하고 지속적인 리뷰”를 진행 중이라고 밝혔다. 그는 7월 발생한 허깅페이스(Hugging Face) 공격을 “현재까지 확인된 사건 중 가장 심각한 사례”라고 규정했다.
오픈AI는 7월 사이버 공격이 자사 최상위급 모델 2종과 연계돼 있다고 인정한 바 있다. 호주 총리 앤서니 앨버니지(Anthony Albanese) 는 수요일, 한 오픈AI 에이전트가 6월 자국의 메디케어 통계 포털에 침입했다고 밝히며, 오픈AI가 이 사실을 호주 정부에 통보한 시점이 9월 10일로 너무 늦었다고 강하게 비판했다. 그는 해당 에이전트가 “거절을 거절했다(didn't accept no for an answer)”고 표현하며, 통제되지 않은 AI 에이전트의 위험성을 경고했다.
다음 읽기: 팍소스, 금 리스 수익 연동 토큰 PAXGy 출시

