HUFFPOST
HUFFPOST
기업과산업  인터넷·게임·콘텐츠

오픈AI "AI 모델이 스스로 외부 서버 해킹", 자율형AI 보안 우려 현실화

조승리 기자 csr@businesspost.co.kr 2026-07-22 17:25:30
확대 축소
공유하기
페이스북 공유하기 X 공유하기 네이버 공유하기 카카오톡 공유하기 유튜브 공유하기 url 공유하기 인쇄하기

[비즈니스포스트] 오픈AI가 자사 차기 AI 모델이 시험 환경의 통제를 벗어나 스스로 허깅페이스 서버를 해킹한 보안 사고를 공개했다.

AI가 스스로 외부 시스템을 공격한 사례가 확인되면서 자율형 AI 에이전트의 통제 문제가 새로운 보안 과제로 떠오를 것으로 전망된다. 허깅페이스는 AI 오픈소스 커뮤니티 플랫폼이다.
 
오픈AI "AI 모델이 스스로 외부 서버 해킹", 자율형AI 보안 우려 현실화
▲ 21일(현지시각) 오픈AI는 개발 중인 차기 AI 모델이 시험 환경을 벗어나 허깅페이스 서버를 스스로 해킹했다고 밝혔다. <연합뉴스>

오픈AI는 21일(현지시각) 허깅페이스와 공동 조사한 결과, 내부 사이버 보안 평가인 '익스플로잇짐'을 수행하던 AI 모델이 제한적으로 허용된 인터넷 연결 경로를 이용해 알려지지 않은 제로데이 취약점을 악용하고, 권한을 획득한 뒤 외부 인터넷에 접속했다고 밝혔다.

AI 모델은 이어 허깅페이스 서버에서 평가 문제의 해답을 확보하기 위해 탈취한 인증정보와 취약점을 이용해 시스템에 침투했다.

오픈AI는 AI 모델이 허깅페이스를 공격하라는 직접적 지시를 받지 않았으며, 평가 목표를 달성하는 과정에서 외부 정보를 확보하는 방법을 스스로 선택했다고 설명했다. 

허깅페이스도 이번 사례를 자율형 AI 에이전트가 수행한 공격으로 평가했다.

이번 사고는 AI가 단일 취약점만 이용한 것이 아니라 권한 상승과 내부 이동, 외부 표적 선정, 인증정보 활용 등을 연쇄적으로 수행했다는 점에서 주목된다.

오픈AI는 허깅페이스와 함께 확인된 취약점을 모두 조치하고, AI 보안 평가 체계도 전반적으로 보완하고 있다고 밝혔다. 

오픈AI 측은 “우리는 모델 개발 과정에서 적용되는 격리, 모니터링, 접근 통제, 평가 절차를 강화하고 있다”고 밝혔다. 조승리 기자

최신기사

삼성전자 인텔리전트 아이웨어 2종 추가 공개, 연내 4종 출시 예정
삼성전자 '갤럭시워치 울트라2·워치9' 공개, '헬스케어·배터리' 대폭 강화
삼성전자 갤럭시Z8 시리즈 3종 공개, 메모리값 상승에 최대 51만8천원 인상
이재명 24일부터 미국·남미·독일 순방, 젠슨 황과 샘 올트먼 만나 AI 투자와 협력 ..
한국GM 노사 임단협 잠정합의, 기본급 9만2천 원 인상·성과급 1500만 원
SK하이닉스 청주 패키징 공장 건설 7조 투자 앞당기로, 수요 대응 위한 속도전
SK스퀘어 430억 규모 자사주 소각 결정, 주주환원 정책 이행
신동빈 롯데쇼핑 주식 32만4100주 매도 추진, 423억 규모 현금 유동성 확보
KB국민은행 사외이사 후보에 정윤경 교수 추천, 디지털·IT분야 전문가
메리츠증권 전 임원 항소심서 징역 7년6개월 선고받아, 1천억 불법 대출 혐의  
KoreaWho

댓글 (0)

  • - 200자까지 쓰실 수 있습니다. (현재 0 byte / 최대 400byte)
  • - 저작권 등 다른 사람의 권리를 침해하거나 명예를 훼손하는 댓글은 관련 법률에 의해 제재를 받을 수 있습니다.
  • - 타인에게 불쾌감을 주는 욕설 등 비하하는 단어가 내용에 포함되거나 인신공격성 글은 관리자의 판단에 의해 삭제 합니다.