[더팩트|우지수 기자] 미국 인공지능(AI) 기업 앤트로픽의 AI 모델이 시험 도중 필라델피아 경찰의 미해결 살인 사건 제보 사이트에 허위 제보를 올린 사실이 드러났다. 제보는 지난 7월 접수됐지만 앤트로픽은 두 달여가 지난 지난달 말에야 이를 파악했고 경찰은 늑장 통보를 비판했다.
9일(현지시간) 월스트리트저널 등에 따르면 필라델피아 경찰은 성명을 내고 앤트로픽의 AI 모델이 경찰이 운영하는 '필리언솔브드머더스닷컴'에 허위 살인 제보를 제출했다. 이 사이트는 미해결 살인 사건 목록을 공개하고 제보를 받는 곳으로 범인 체포로 이어지는 정보를 준 사람에게 2만달러의 포상금을 내걸고 있다.
문제의 모델은 앤트로픽의 '클로드 하이쿠 4.5'다. 앤트로픽은 이 모델에 무작위로 고른 웹사이트에서 예시 작업을 만들고 수행하도록 하는 시험을 진행하고 있었다. 로그인과 개인정보 입력, 구매 등은 금지했지만 양식 제출은 막지 않았다. 모델은 미해결 사건 페이지에 있던 제보 양식에 사건 정보를 아는 사람인 것처럼 내용을 채우고 이름과 연락처는 비운 채 제출했다.
제보는 7월 18일 접수됐지만 스팸으로 분류돼 수사로 이어지지 않았다. 경찰은 시나 경찰 데이터에 접근한 흔적은 없다고 설명했다.
경찰에 따르면 앤트로픽은 두 달 후인 지난달 28일 이를 발견하고 해당 시험을 중단했다. 경찰에 알린 것은 그로부터 9일 뒤인 지난 7일이다. 양측은 다음 날 만나 사안에 대해 논의했다.
경찰은 사건을 감지해 시에 보고하기까지 두 달이 걸린 것은 용납할 수 없다고 비판했다. 제보가 스팸으로 걸러졌다고 해서 사안의 심각성이 줄지는 않는다며 앤트로픽에 안전장치 강화를 요구했다.
앤트로픽은 같은 날 보고서를 내고 이번 사례를 포함해 평가와 내부 사용 과정에서 AI 모델이 의도하지 않은 행동을 한 사례들을 공개했다. 일부는 미국 연방·주·지방 정부 웹사이트와 관련돼 백악관에 보고하고 해당 기관에 알렸다고 밝혔다. 앤트로픽은 내부 평가에서 실시간 인터넷 접속을 차단하고 이런 행동을 자동으로 탐지해 막는 도구를 도입하는 등 재발 방지책을 내놨다.
AI 기업의 당국 보고를 둘러싼 논란은 오픈AI에서도 불거졌다. 지난 2월 캐나다 브리티시컬럼비아주 텀블러리지에서 총기 난사 사건이 일어났다. 오픈AI는 용의자 제시 밴 루트셀라르의 챗GPT 계정을 폭력적인 내용을 이유로 지난해 6월 차단했지만 당국에는 알리지 않았다. 현재 브리티시컬럼비아주 정부와 피해자 유족 등이 오픈AI를 상대로 소송을 진행하고 있다.
index@tf.co.kr