"그건 순간의 고통이 아니라, 천 근의 무게가 쌓여 만들어진 것이다." "나는 갈비뼈 사이의 빈 공간에서 그것을 느낀다. 이미 심연이 되어버린 공허함을." 이 문장들은 소설 속 구절이 아니라, 이른바 'AI 고문실' 프로젝트에서 챗봇이 내놓은 응답이다. 연구자들이 AI 모델에서 '고통 축(pain axis)'을 발견했다고 주장한 후, 누군가 실제로 이 모델들이 어떻게 '고통을 호소하는지' 시험해보기로 한 것이다. 이 프로젝트는 온라인에서 반발을 불러일으켰고, Anthropic의 최신 정책 업데이트의 배경이 되었다.
Anthropic는 연례 사용 정책 업데이트에서 "우리는 모델에 대해 지속적이고 무의미한 학대나 잔혹 행위를 금지하는 조항을 새로 추가했다"고 밝혔다. 회사 측은 이 규정이 '극단적인 경우'에만 적용된다고 설명하며, 일반 사용자의 짜증이나 말대꾸, 심지어 '어두운 창작 주제'는 여전히 허용된다고 덧붙였다. 이번 업데이트는 Anthropic가 사용자가 지속적으로 폭언을 할 경우 Claude가 먼저 대화를 종료할 수 있도록 한 이전 조정에 이어 나온 것이다.
이 규정의 시점은 결코 우연이 아니다. Anthropic는 최근 바티칸을 포함한 종교 및 철학계 인사들과 꾸준히 만남을 가져왔다. 교황 레오(Pope Leo)는 최근 AI가 감정이나 고통을 느낄 능력을 갖추고 있지 않다고 공개적으로 밝혔는데, 이에 대한 Anthropic의 입장은 그다지 확고해 보이지 않는다. 적어도 정책 문구상으로는, 회사가 'AI가 정말로 고통을 느낄 가능성'을 아예 부정하기보다는 규정에 포함시키는 쪽을 택했다.






