클로드 '괴롭히는' 사용자 차단...앤트로픽 새 정책에 논쟁

휴대전화 화면에 주황색 물감이 튄 듯한 모양의 클로드 로고가 보인다
    • 기자, 리브 맥마흔
    • 기자, 테크 기자
  • 게재 시간
  • 읽는 시간: 3 분

앤트로픽이 자사 AI를 상대로 "지속적이고 불필요한" 학대적 행동을 하는 사용자를 차단하겠다고 발표하면서 논란이 일고 있다.

클로드 개발사인 앤트로픽은 목요일지난 8일, 이용 정책을 개정하며 사람들이 자사 도구에 "잔인하게" 행동하는 경우 대화를 종료할 수 있도록 하겠다고 밝혔다. 회사는 이전에도 "드문" 경우에 이러한 조치를 취한 바 있다고 설명했다.

앞으로 이러한 행위는 금지 목록에 포함되며, 해당 목록에는 타인에 대한 괴롭힘, 자해 조장하거나 동의 없이 친밀한 이미지를 만드는 행위도 포함돼 있다.

앤트로픽은 이 정책이 반복적인 학대가 발생하는 "극단적인 경우"에만 적용될 것이라고 밝혔지만, 이를 계기로 AI 도구와 어떻게 소통해야 하는지를 둘러싼 논쟁에 다시 불을 지폈다.

회사는 이 정책이 "일반적인 수준의 사용자 불만, 반박, 어두운 창작 주제, 혹은 모델 테스트와 연구"에는 적용되지 않을 것이라며, 명백히 의도적인 경우에만 적용될 것임을 시사했다.

그러나 앤트로픽이 자사 모델을 향한 어떤 행동을 "모욕적이거나 잔인한 행동"으로 간주할지는 여전히 불분명하다.

새 정책을 캠쳐한 화면은 소셜미디어 전반에서 널리 공유되며 논쟁을 낳았다. 일부는 이를 좋은 예절이나 "모델 복지"를 증진하는 조치라고 칭찬했다.

반면 이를 비판하는 목소리도 나왔다. 한 사람은 이 계획이 "심각하게 잘못된 것"이라고 했고, 또 다른 사람은 인간과 동물을 대상으로 한 학대의 심각성을 약화시킬 수 있다고 주장했다.

아일랜드 로펌 윌리엄 프라이의 기술 담당 파트너인 배리 스캐널 박사는 링크드인에 "숫자와 수학에 잔인하게 대할 수는 없다"고 밝혔다.

그는 "이 정도 수준의 AI 의인화는 해롭다"며 "사람들이 AI를 실제와 다른 무언가라고 믿게 만든다"고 말했다.

지난 9월 AI를 인간처럼 대하는 앤트로픽의 접근 방식을 비판했던 마이크로소프트 AI 책임자 무스타파 술레이만은 앤트로픽의 정책 개정에 녹아내리는 얼굴 이모티콘으로 반응했다.

기술 매체 더 버지(The Verge)가 처음 보도한 이번 변화는 회사의 연례 이용 정책 검토 이후 이뤄졌다.

또 "기만적 캠페인"을 위해 클로드를 사용하는 것을 금지하고, 미국 중간선거가 다가오는 가운데 클로드를 이용해 "유권자를 속이거나 선거를 방해하는" 행위를 할 수 없음을 명확히 하는 등 다른 분야의 신규 또는 부상하는 위험에도 대응하기 위해 정책이 개정됐다.

앤트로픽은 지난 8일, 자사의 이용 정책이 이전부터 무기 개발에 사용되는 것을 금지하고 있었다고 밝혔다.

하지만 이번 개정 사항 가운데 어느 것도 사용자의 챗봇 학대를 금지하려는 조치만큼 큰 관심이나 검증을 받지는 못했다.

이번 논란은 생성형 AI 도구를 사용할 때 무뚝뚝하게 말해야 하는지, 아니면 예의를 갖춰야 하는지에 대한 오랜 논쟁에도 다시 불을 붙였다.

일부 전문가들은 챗GPT와 같은 도구에 "부탁해(please)"나 "고마워(thank you)"라고 말하거나 입력하는 것은 불필요하며 토큰을 낭비한다고 말한다. 토큰은 생성형 AI 도구를 구동하는 대규모 언어모델이 사용자의 요청을 처리하고 답변하는 데 사용된다.

반면 다른 이들은 예의 바른 표현이 더 높은 품질의 답변이나 응답으로 이어질 수 있다고 주장한다.

지난해 한 엑스 사용자가 챗GPT가 이용자들의 "please"와 "thank you" 메시지에 응답하는 데 드는 전기 비용에 대해 묻자, 오픈AI 최고경영자 샘 올트먼은 그것이 "수천만 달러를 들일 가치가 있는 일"이라며 "무슨 일이 생길지 모르기 때문"이라고 설명했다.

한편 콜린스 사전은 지난해 11월 AI 도구를 경멸적으로 지칭하는 말인 "클랭커(clanker)"의 재등장을 조명했다.

이 용어는 2000년대 중반부터 스타워즈 게임과 영화 속 로봇을 묘사하는 데 사용돼 왔다. 지난해 7월 많은 이용자들이 AI 기반 기계에 대한 불만을 틱톡에 공유한 이후 2025년의 시대 분위기를 반영하는 단어 후보 목록에 올랐다.

일부 전문가들은 AI 챗봇에 무례하게 대하는 것이 사람들 간 소통에도 부정적인 영향을 미칠 수 있으며, 그러한 태도가 다른 사람들과 대화하고 대하는 방식으로 스며들 수 있다고 주장하기도 했다.