AI

앤스로픽, AI 모델 괴롭힘 금지 조항 사용 정책에 추가

앤스로픽이 사용 정책을 업데이트해 클로드를 포함한 AI 모델에 대한 반복적인 학대와 잔혹 행위를 금지했다. 제인 만천 웡이 X에 스크린샷을 공유하며 알려졌다.

앤스로픽이 자사 AI 모델인 Claude에 대해 불필요한 학대나 잔혹 행위를 반복적으로 지시하는 것을 금지하는 조항을 사용 정책에 추가했다고 androidauthority.com이 보도했다. 이번 정책 변경은 제인 만천 웡이 X에 공유한 스크린샷을 통해 처음 알려졌다.

새 조항은 일상적인 불만, 비판, 의견 충돌, 정당한 AI 테스트가 아닌 극단적이고 의도적인 학대 행위를 겨냥한다. 앤스로픽은 이러한 행위가 반복적이고 불필요한 경우에만 문제 삼는다는 입장이다.

주요 시행 조치로 Claude는 학대적인 대화를 종료할 수 있다. 다만 정책에는 사용자 계정 정지나 차단에 대한 명시적인 언급은 없다.

한눈에 보기

앤스로픽의 새로운 사용 정책은 무엇을 금지하나요?

Claude를 포함한 AI 모델에 대해 불필요한 학대나 잔혹 행위를 반복적으로 지시하는 행위를 금지한다.

정책 위반 시 어떤 제재가 있나요?

Claude가 학대적인 대화를 종료할 수 있지만, 사용자 차단에 대한 명시적 조항은 없다.

출처