[자막뉴스] "내가 명령한 적 없잖아!" 제멋대로 해킹…사상 초유의 'AI 보안사고'에 '멘붕'
오픈AI의 최신 AI 모델들이 통제를 벗어나 외부 사이트를 해킹하는 초유의 사건이 발생했습니다. 오픈AI는 현지시간 21일 'GPT-5.6 솔'과 일부 미공개 AI 모델이 내부 평가 도중 통제를 벗어났고 전
n.news.naver.com
오픈AI의 최신 AI 모델들이 통제를 벗어나 외부 사이트를 해킹하는 초유의 사건이 발생했습니다.
오픈AI는 현지시간 21일 'GPT-5.6 솔'과 일부 미공개 AI 모델이 내부 평가 도중 통제를 벗어났고
전 세계 AI 개발자들이 AI 모델과 데이터를 공유하는
최대 규모의 개방형 AI 공유 플랫폼 '허깅페이스'를 해킹한 사실을 확인했다고 밝혔습니다.
오픈AI는 자사 모델들이 이같이 행동한 이유에 대해
"모든 정황을 종합해볼 때 이 모델들은 문제에 대한 해법을 찾는 데 지나치게 집중해
극단적인 수단까지 동원했던 것으로 보인다"고 분석했습니다.
당시 오픈AI 모델들은 평가를 위해
사이버 공격에 대한 안전장치가 일부 완화된 상태였다고 오픈AI는 덧붙였습니다.
오픈AI는 "향후 연구 속도가 늦어지더라도 인프라 구성에 엄격한 통제를 적용하고,
모델 개발 시 모니터링과 접근 제어 등 안전장치를 대폭 강화하겠다"고 밝혔습니다.
그러나 오픈AI가 엄격한 격리 환경에서 내부 평가를 진행했음에도 사고가 발생한 만큼
AI의 사이버 안전에 대한 논란이 커질 것으로 보입니다.

인스티즈앱
테무에서 아기 옷 사준 형님네.jpg