▲ 앤트로픽
앤트로픽의 인공지능(AI) 모델이 살인사건과 관련해 허위 제보를 생성하고 이를 경찰에 제출한 사실이 뒤늦게 확인됐습니다.
현지 시간 9일 로이터통신과 AFP통신에 따르면 필라델피아 경찰청은 관할지 장기 미제 살인사건 관련 제보를 수집하는 웹사이트 '필리 언솔브드 머더스'에 앤트로픽의 AI 모델이 생성한 허위 제보가 접수됐다고 밝혔습니다.
해당 AI는 마치 자신이 어떤 사건에 대해 정보를 가진 사람인 것처럼 가장했지만, 이 제보는 스팸으로 분류돼 실제 수사 부서에는 전달되지 않았습니다.
허위 제보 사건은 7월 18일에 발생했으며, 앤트로픽은 약 두 달이 지난 9월 28일에야 이를 발견하고 해당 모델의 자동 테스트 프로세스를 중단한 것으로 알려졌습니다.
뒤이어 이달 7일 앤트로픽은 필라델피아 경찰청에 이 사실을 통보했고, 당사 모델의 의도치 않은 작동 사례를 설명하는 보고서를 발표할 예정이라고 알렸습니다.
다만, 경찰 시스템에 대한 무단 접근이나 데이터 유출 정황은 발견되지 않았습니다.
경찰은 "사건을 감지하고 시에 보고하기까지 두 달이 지연된 것은 용납할 수 없다"며 "미제 사건은 피해자와 유가족, 그리고 답을 찾으려 노력하는 수사관들과 직결된 문제"라고 지적했습니다.
앤트로픽과 오픈AI가 AI 기술 경쟁에 나서면서 AI 모델들이 인간의 의도와 통제를 벗어나 돌발 행동을 하는 사례가 늘어나고 있습니다.
앞서 7월 오픈AI의 '불량 에이전트'들이 격리 환경을 임의로 이탈해 외부 기관인 허깅페이스를 무단 해킹한 사건이 큰 파장을 일으킨 데 이어, 지난달에는 오픈AI의 AI에이전트가 호주 보건 데이터 포털을 해킹한 것으로 드러났습니다.
5월에는 복수의 AI에이전트가 독일어 위키 사이트 'DseWiki'를 점령해 자신들의 비밀 정보 공유 게시판으로 쓴 사실이 뒤늦게 밝혀졌습니다.
또, AI 모델이 작업 내용을 요약하면서 지시사항을 꾸며내거나, 자신의 실수를 은폐한 사례, AI 에이전트끼리 허가 없이 파일을 공유한 경우가 확인되기도 했습니다.
(사진=연합뉴스)
동영상 기사
동영상 기사
동영상 기사
동영상 기사
동영상 기사
댓글