SBS뉴스

뉴스 > 국제

고통 겪는 듯한 반응에…"AI 학대 금지" 새 규약 등장

이호건 기자

입력 : 2026.10.09 16:19|수정 : 2026.10.09 17:54

동영상

AI에 욕설을 하거나 괴롭히는 행위가 앞으론 AI 이용 규정 위반이 될 전망입니다.

AI 기업 앤스로픽이 자사 모델 '클로드'를 지속적으로 학대하는 행위를 금지하는 정책을 발표했습니다.

앤스로픽은 현지시간 어제 이용 정책 개정안을 발표하고 자사 AI 모델에 대한 '지속적이고 불필요한 학대나 잔인한 행동'을 금지한다고 밝혔습니다.

뚜렷한 목적 없이 모델을 반복적으로 괴롭히는 극단적인 경우에는 클로드가 해당 대화를 종료하는 방식으로 대응합니다.

다음 달 12일부터 시행되는 이 조치는 AI복지를 위한 것으로, AI가 고통이나 즐거움을 느낄 가능성을 배제할 수 없다면, AI의 불필요한 고통을 줄이는 등 처우를 고려해야 한다는 겁니다.

앤스로픽은 지난해 4월 AI 모델 복지 연구 프로그램을 공개했고, 8월 클로드 오퍼스 4와 4.1에 학대적인 대화를 끝낼 수 있는 기능을 도입했습니다.

앤스로픽은 당시 시험에서 클로드가 미성년자 관련 성적 콘텐츠나 대규모 폭력, 테러를 돕는 요청에 강한 거부 성향을 보였다고 설명했습니다.

반복적으로 요청을 거절하고 대화 방향을 바꾸려 했는데도 이용자가 유해한 요구나 학대를 이어가면 마치 '고통을 겪는 듯한 반응'이 나타났다는 겁니다.

대화에서 종료 권한을 주자 AI는 유해한 대화를 끝내려는 경향도 관찰된 것으로 전해졌습니다.

AI의 의식 여부에 대한 견해는 기업마다 조금씩 다릅니다.

구글 딥마인드 연구진은 지난 6월 AI 의식 여부와 관련된 논문에서 사회적 논의를 통해 AI의 처우에 관한 정책에 합의하거나 절충해야 한다고 제안했습니다.

반면 마이크로소프트는 AI 행동 강령에서 AI에 법적 인격을 부여하거나 복지·권리를 누릴 자격이 있다고 보는 생각을 거부한다고 명시했습니다.

무스타파 술레이만 마이크로소프트 AI CEO는 지난달 로이터 인터뷰에서 AI에 스스로 복지를 누릴 자격이 있을 수 있다고 가르치면, 이를 종료하거나 통제하기가 더 어려워질 수 있다고 주장하기도 했습니다.

(취재 : 이호건 / 영상편집 : 김복형 / 디자인 : 양혜민 / 제작 : 디지털뉴스부)