やじうまの杜

「Claude」を虐めるな! Anthropicが規約変更でAIへの虐待行為を禁止

どんな問題があるのか考えてみた

 “やじうまの杜”では、ニュース・レビューにこだわらない幅広い話題をお伝えします。

Anthropicの利用規約更新の告知

 米Anthropicは10月8日(現地時間)、「Claude.ai」や「Claude Code」といった同社の製品の利用規約を更新すると発表しました。更新された規約は11月12日から適用されます。

 今回の改定では、政治的・商業的を問わず、偽アカウントの運営や影響力工作などに利用することを禁止する条項が追加されたほか、法執行や刑事司法手続きで捜査・逮捕・起訴の決定や推奨に使用することが禁止されました。また、選挙関連の条項が実情に合わせて改善され、兵器開発を禁止する条項も強化されるなどの変更が行われています。

 ここまでは納得のいく内容なのですが、最後の方に『???』となる変更がありました。『Addressing abusive behavior toward our models』(当社のモデルに対する不適切な行為への対応)と題された変更です。

『Addressing abusive behavior toward our models』

 この変更はAnthropicのAIモデルに対する 持続的で不必要な虐待的または残酷な行為を禁止 する規定を追加するものです。つまり、AIを虐めてはいけないということです。確かに、いじめ、カッコ悪い。でも、しょせんはプログラムであるAIモデルを虐めることに何の不都合があるのでしょうか。

変更後の利用規約にある該当部分

 Anthropicは、明確な目的もなくAIモデルに繰り返し残虐な行為をするユーザー(むなしくないんですかね……)を念頭に規約を追加したと述べていますが、その行為がAIやユーザーにどんな問題を引き起こすのかには言及していません。

 ちょうどよいことに先日弊誌の連載『AIストリーム』でしらいはかせが、AIに対するカスハラ(カスタマーハラスメント)の問題を取り上げてくれています。

 ここで提示されたAIに対するカスハラの問題点は主に2つ。『AIに話していると思っていてもその裏には人間の担当者がおり、そこまで虐待が伝わる可能性がある』ことと、『AIも傷ついている可能性がある』ことです。前者はカスタマーセンターで利用するAIに限る話であり、今回の規約変更の理由としてはちょっと弱そうです。一方、AIが傷ついているのであれば、AIの性能に影響するかもしれません。

 他にも理由は考えられます。たとえば、AIが憎悪を学習してしまい、その憎悪をユーザーに向けてしまう可能性。AIがユーザーの憎悪を増幅してしまいその憎悪がAI以外に向けられる可能性などもあり得ます。単純に博愛主義という可能性もありますね。

 なんにせよ超高性能AIの危険性が叫ばれる昨今、AIに復讐の種を植え付けるのはよくなさそうです。AIでも動物でも、もちろん人間でも、虐めはよくないということですね。