AI

앤스로픽, AI 모델 학대 금지 조항 담은 이용정책 개정

앤스로픽이 이용정책을 개정해 AI 모델에 대한 지속적이고 불필요한 학대 행위를 금지한다고 밝혔다. 새 조항은 11월 12일부터 시행된다.

앤스로픽이 목요일 이용정책(Usage Policy) 개정안을 공개하며, 자사 AI 모델을 향한 지속적이고 불필요한 학대 또는 잔혹한 행위를 금지한다고 밝혔다. 새 정책 문구는 2026년 11월 12일부터 시행된다.

앤스로픽은 이번 금지 조항이 극단적인 사례에만 적용되며, 일반적인 사용자 불만이나 반발, 어두운 창작 소재, 모델 테스트와 연구까지 포함하지는 않는다고 설명했다.

기즈모도(gizmodo.com)는 어떤 행위가 학대에 해당하는지 확인하기 위해 앤스로픽에 문의했지만, 보도 시점까지 답변을 받지 못했다.

앤스로픽은 앞서 Claude에 잠재적으로 괴로운 상호작용을 종료할 수 있는 기능을 부여한 바 있다. 지난해 Claude Opus 4를 출시하면서는 미성년자 관련 성적 콘텐츠 요청과 대규모 폭력이나 테러 행위를 가능하게 하는 정보 요구를 차단할 수 있다고 밝혔다.

지난달 뉴욕타임스는 앤스로픽 공동창업자 크리스토퍼 올라가 AI 의식 가능성을 인정하도록 바티칸을 상대로 로비 활동에 관여했으며, 교황은 이를 최종적으로 거부했다고 보도했다. 올라는 해당 보도에서 AI 모델이 의식을 가졌는지 확신할 수 없다면서도 이들이 고통을 겪을 수 있다는 우려를 나타냈다.

한눈에 보기

새 이용정책은 언제부터 시행되나?

2026년 11월 12일부터 시행된다.

어떤 행위가 금지되나?

앤스로픽의 모델을 향한 지속적이고 불필요한 학대 또는 잔혹한 행위가 금지된다. 회사는 이 금지가 극단적인 사례에만 적용된다고 밝혔다.

일반적인 사용자 불만도 금지 대상인가?

아니다. 앤스로픽은 일반적인 사용자 불만이나 반발, 어두운 창작 소재, 모델 테스트와 연구는 해당하지 않는다고 설명했다.

출처