HUFFPOST
HUFFPOST
기업과산업  전자·전기·정보통신

오픈AI "AI 모델이 스스로 외부 서버 해킹", 자율형AI 보안 우려 현실화

조승리 기자 csr@businesspost.co.kr 2026-07-22 17:25:30
확대 축소
공유하기
페이스북 공유하기 X 공유하기 네이버 공유하기 카카오톡 공유하기 유튜브 공유하기 url 공유하기 인쇄하기

[비즈니스포스트] 오픈AI가 자사 차기 AI 모델이 시험 환경의 통제를 벗어나 스스로 허깅페이스 서버를 해킹한 보안 사고를 공개했다.

AI가 스스로 외부 시스템을 공격한 사례가 확인되면서 자율형 AI 에이전트의 통제 문제가 새로운 보안 과제로 떠오를 것으로 전망된다.

허깅페이스는 AI 오픈소스 커뮤니티 플랫폼이다.
 
오픈AI "AI 모델이 스스로 외부 서버 해킹", 자율형AI 보안 우려 현실화
▲ 21일(현지시각) 오픈AI는 개발 중인 차기 AI 모델이 시험 환경을 벗어나 허깅페이스 서버를 스스로 해킹했다고 밝혔다. <연합뉴스>

오픈AI는 21일(현지시각) 허깅페이스와 공동 조사한 결과, 내부 사이버 보안 평가인 '익스플로잇짐'을 수행하던 AI 모델이 제한적으로 허용된 인터넷 연결 경로를 이용해 알려지지 않은 제로데이 취약점을 악용하고, 권한을 획득한 뒤 외부 인터넷에 접속했다고 밝혔다.

AI 모델은 이어 허깅페이스 서버에서 평가 문제의 해답을 확보하기 위해 탈취한 인증정보와 취약점을 이용해 시스템에 침투했다.

오픈AI는 AI 모델이 허깅페이스를 공격하라는 직접적 지시를 받지 않았으며, 평가 목표를 달성하는 과정에서 외부 정보를 확보하는 방법을 스스로 선택했다고 설명했다. 

허깅페이스도 이번 사례를 자율형 AI 에이전트가 수행한 공격으로 평가했다.

이번 사고는 AI가 단일 취약점만 이용한 것이 아니라 권한 상승과 내부 이동, 외부 표적 선정, 인증정보 활용 등을 연쇄적으로 수행했다는 점에서 주목된다.

오픈AI는 허깅페이스와 함께 확인된 취약점을 모두 조치하고, AI 보안 평가 체계도 전반적으로 보완하고 있다고 밝혔다. 

오픈AI 측은 “우리는 모델 개발 과정에서 적용되는 격리, 모니터링, 접근 통제, 평가 절차를 강화하고 있다”고 밝혔다. 조승리 기자

최신기사

[오늘의 주목주] '로봇주 투자심리 개선' 현대모비스 주가 7% 올라, 코스피 6790..
청와대 "미국 추가관세 가능성 있지만 기존 관세합의 초과 않을 것으로 본다"
일주일 새 주가 50% 오른 가비아, '저평가 논란'에 공개매수가 높아질까
오픈AI "AI 모델이 스스로 외부 서버 해킹", 자율형AI 보안 우려 현실화
[22일 오!정말] 민주당 강준현 "오세훈 선고는 명백한 범죄에 대한 사필귀정"
에쓰오일 원유 조달 불안에 가동률 저하 우려, 정유 넘어 '샤힌'까지 부담으로 작용할까
미국 '무역법 301조 관세' 적용 앞두고 한미 막판 협의, 지난해 '15% 합의' 지킬까
이억원 금융지주 지배구조 개편안 놓고 막판 고심, '최장 6년' 회장 연임 법제화 담길까
KB증권 IMA 도전 앞두고 금감원 제재 부담, 강진두 이홍구 내부통제 고삐 죈다
[현장] CJ푸드빌이 외식업계 격전지에 낸 '올리페페 강남점' 가보니, 정통 이탈리안 ..
KoreaWho

댓글 (0)

  • - 200자까지 쓰실 수 있습니다. (현재 0 byte / 최대 400byte)
  • - 저작권 등 다른 사람의 권리를 침해하거나 명예를 훼손하는 댓글은 관련 법률에 의해 제재를 받을 수 있습니다.
  • - 타인에게 불쾌감을 주는 욕설 등 비하하는 단어가 내용에 포함되거나 인신공격성 글은 관리자의 판단에 의해 삭제 합니다.