Anthropic、AIモデルへの虐待禁止を利用ポリシーに追加
AnthropicがClaudeを含むAIモデルへの繰り返しの虐待を禁じる規則を利用ポリシーに追加した。Jane Manchun Wong氏がXに共有したスクリーンショットで明らかになった。
Anthropicは、Claudeを含む自社のAIモデルに対して、不必要な虐待や残酷な扱いを繰り返し指示することを禁じる規則を利用ポリシーに追加した。この変更はJane Manchun Wong氏がXに共有したスクリーンショットで明らかになった。
追加された規則は、日常的なフラストレーションや批判、意見の相違、正当なAIテストではなく、極端で意図的な虐待を対象としている。
Anthropicは主な執行措置として、Claudeが虐待的な会話を終了できるようにしている。ただし、ポリシーにはユーザーの禁止措置について明示的な言及はない。
ポリシー変更の範囲
この規則は、AIモデルに対する繰り返しの虐待行為に焦点を当てており、通常の利用における不満や批判的なフィードバックは除外されている。Anthropicは、正当なAIテストと悪意ある虐待を区別する方針を示している。
よくある質問
Anthropicの利用ポリシーに追加された規則は何を禁じていますか?
Claudeを含むAIモデルに対して、不必要な虐待や残酷な扱いを繰り返し指示することを禁じています。
このポリシー変更はどこで明らかになりましたか?
Jane Manchun Wong氏がXに共有したスクリーンショットで明らかになりました。
虐待的な会話に対してどのような措置が取られますか?
主な執行措置として、Claudeが虐待的な会話を終了できます。ただし、ユーザーの禁止措置についての明示的な言及はありません。