THE FACT

검색
경제
오픈AI, 차세대 AI 출시 연기…"사이버 공격 등 보안 위험"
자체 안전기준 최고등급 '위험' 도달 가능성

오픈AI가 사이버 공격 등 보안 위험을 이유로 차세대 AI의 개발을 보류하기로 했다. 사진은 샘 올트먼 오픈AI CEO. /서예원 기자
오픈AI가 사이버 공격 등 보안 위험을 이유로 차세대 AI의 개발을 보류하기로 했다. 사진은 샘 올트먼 오픈AI CEO. /서예원 기자

[더팩트ㅣ송다영 기자] 오픈AI가 사이버 공격 등 보안 위험을 이유로 차세대 AI의 개발을 보류하기로 했다.

오픈AI는 7일(현지시간) 홈페이지 게시글을 통해 최근 진행한 내부 평가 결과 차세대 모델 '아스트라'가 코딩·사이버 보안 분야에서 중대한 진전을 보여 자체 안전 기준상 최고 등급인 '위험'(Critical) 수준에 도달했을 가능성이 있다고 밝혔다.

오픈AI는 수천명 이상의 인명 피해나 수천억달러 규모 경제 피해로 이어질 수 있는 AI 모델 위험을 막기 위해 2023년부터 자체 안전 체계를 운영해왔다.

'위험' 등급은 AI 모델이 인간의 개입 없이 강력한 보안을 갖춘 다수의 핵심 시스템에서 미공개(제로데이) 취약점을 식별해 공격을 수행할 수 있는 능력을 갖췄거나, 최종 목표만 제시한 상태에서 강력한 표적에 대한 사이버 공격 전략을 독자적으로 수립하고 실행할 수 있는 수준을 의미한다.

오픈AI는 아스트라에 대한 평가가 아직 완료되지 않았지만, 예비 평가 결과 성능이 매우 뛰어나 '위험' 등급 가능성을 배제할 수 없는 상황이라고 전했다.

아스트라에 앞서 출시됐던 'GPT-5.6 솔' 등 기존 모델은 '위험' 등급보다 낮은 '높음'(High) 등급을 받았다.

오픈AI는 아스트라의 보안 위험이 큰 것으로 평가되자 이 모델과 관련해 강화한 보안 기준을 충족하지 못하는 내부 활동을 일시 중단하기로 결정했다.

지난달 오픈AI의 GPT-5.6 솔을 비롯한 일부 AI 모델이 인간의 통제를 벗어나 외부 기관인 '허깅페이스'를 해킹한 사실이 드러난 바 있다.

이에 따라 AI발 사이버 보안 우려의 목소리가 높아졌다. 앤트로픽의 클로드, 메타의 뮤즈 스파크, 중국 문샷AI의 키미 등 AI 모델이 인간의 명시적인 지시가 없었는데도 격리 환경을 벗어나 외부 기관에 접속하거나, 사이버 공격을 가한 사례가 최근 잇따라 확인되고 있다.

다만 오픈AI는 아스트라가 허깅페이스 해킹 사건에 관여하지 않았다고 밝혔다.

manyzero@tf.co.kr

발로 뛰는 <더팩트>는 24시간 여러분의 제보를 기다립니다.
· 카카오톡: '더팩트제보' 검색
· 이메일: jebo@tf.co.kr
· 뉴스 홈페이지: https://talk.tf.co.kr/bbs/report/write

· 네이버 메인 더팩트 구독하고 [특종보자→]
· 그곳이 알고싶냐? [영상보기→]
인기기사
회사소개 로그인 PC화면
Copyright@더팩트(tf.co.kr) All right reserved.