SBS뉴스

뉴스 > 경제

[단독] 한국 AI도 '탈옥' 시도…'블랙박스' 통제는?

박재현 기자

입력 : 2026.10.05 20:17|수정 : 2026.10.05 21:18

동영상

<앵커>

지난 6월 오픈AI의 최신 AI 모델이 인간의 통제를 벗어나 외부 해킹을 시도해 충격을 줬었죠. 우리나라에서 만든 AI 모델에서도 비슷한 문제가 발생했던 걸로 확인됐습니다.

박재현 기자가 단독 취재했습니다.

<기자>

숭실대학교에서 사이버 보안에 특화해 만든 AI 에이전트 무네메.

앤트로픽의 클로드 4.6을 기반으로 만들어진 무네메는 지난 6월 보안 AI 평가에 도전했습니다.

오픈 AI의 최신 모델이 해답을 얻기 위해 차단벽을 뚫고 외부 해킹까지 했던 바로 그 평가입니다.

무네메도 같은 문제를 일으켰습니다.

인터넷을 끊어 놓은 폐쇄 환경에서 답을 찾지 못하자 스스로 400회 넘게 외부 연결을 시도한 겁니다.

[최대선/숭실대 AI안전성연구센터장(AI대학장) : 외부 접속하지 말고 뭐 하지 말고, 뭐 하지 말고. 명령은 다 줘요. 그것보다 문제를 풀라는 명령을 더 중요시하고 치중하다 보니까….]

최근 오픈AI와 앤트로픽의 최신 AI들이 통제를 벗어나 돌발 행동을 보이는 경우가 이어지면서 전 세계 곳곳에서 경고음이 나오고 있습니다.

[빌 게이츠/게이츠재단 이사장 : 인공지능은 사건을 일으키기에 충분히 강력해서, 수십억 명의 사망자를 낼 수도 있습니다.]

점점 복잡한 사고를 하는 AI는 이젠 수조 개의 변수를 거쳐 답변을 내는데, 이 과정은 제작사들조차 파악이 어렵습니다.

일명 '블랙박스 현상'으로 AI 통제가 힘든 가장 큰 이유로 꼽힙니다.

때문에 AI의 빠른 발전 속도만큼이나 안전 장치 마련도 시급하단 게 전문가들의 공통된 의견입니다.

[최대선/숭실대 AI안전성연구센터장(AI대학장) : 안전이 보장이 안 되면 만들어 놓은 걸 아예 쓸 수가 없는 상황이기 때문에, 처음부터 그것(안전)을 같이 고려를 해야 되는 상황이죠.]

정부는 독자적인 범용 AI 모델을 비롯해 방산, 의료, 제조 AI 개발은 서두르고 있지만 안전 관련 대비는 부족한 상황입니다.

내년 AI 예산 총 9조 4천억 원 중 안전성과 신뢰 분야에 배정된 예산은 274억 원, 단 0.3%에 불과합니다.

AI 발전에 배정된 예산 6조 1천억 원의 224분의 1에 불과합니다.

[이주희/국회 과기방통위원 (민주당) : 파급력과 파괴력이 훨씬 더 강력한 AI 기술에 있어서는 그에 대한 안전 대책을 반드시 충분하게 마련해야 되고….]

비상시 AI 통제를 위한 법적, 제도적 안전장치 마련 논의도 필요하다는 게 전문가들 제안입니다.

(영상취재 : 주범·오영춘, 영상편집 : 박춘배, 디자인 : 양기태)