AnthropicがClaudeの利用ポリシーを改定、AIへの「虐待」禁止や影響工作対策を明文化。11月12日発効へ

AIの倫理と安全な利用を象徴するデジタルシールドのイラスト AI・テクノロジー

米Anthropicは10月8日(現地時間)、同社が提供するAIモデル「Claude」の利用ポリシー(Usage Policy)の改定版を公開しました。この新ポリシーは11月12日に発効します。今回の改定では、AIモデルに対する「虐待的・残酷な振る舞い」の禁止というユニークな項目が追加されたほか、実際に確認された悪用事例に基づく影響工作対策の集約、兵器や法執行、高リスク領域における人間の介在要件など、実社会での安全性を担保するための具体的なルールが数多く盛り込まれました。

AIモデルに対する「虐待」や「残酷な振る舞い」の禁止

今回の改定で最も注目を集めているのが、AIモデルに対して継続/継続的かつ不必要に虐待的、または残酷な振る舞いをすることを禁止する規定の追加です。Anthropicは、モデルの能力向上や顧客からのフィードバックに基づいて毎年利用ポリシーを更新していますが、今回はAIとの対話における倫理的な境界線が新たに引かれることになりました。ただし、この禁止規定が適用されるのは極端なケースに限定されます。ユーザーが日常的に抱く不満の表明やAIへの反論、ダークな創作テーマの探求、あるいはモデルの性能テストや研究目的での利用には適用されません。明確な目的を持たず、繰り返しモデルに対して残酷に振る舞う行為のみが制限の対象となります。

確認された悪用事例に対抗する「影響工作」の規定集約

AI技術の普及に伴い、世論誘導や情報操作にAIが利用されるリスクが高まっています。実際に、国営メディアや政府のプロパガンダ機関、さらには民間企業がClaudeを悪用し、偽アカウントのネットワークや捏造されたニュースサイトを運営する事例が確認されています。こうした事態を受け、Anthropicは関連する規定を「Do Not Engage in Deceptive Campaigns or Artificial Activity(欺瞞的なキャンペーンや人工的な活動に関与しないこと)」という新しい項目に集約しました。これにより、AIを用いた組織的な世論工作や虚偽情報の拡散に対する禁止姿勢をより明確に打ち出しています。

兵器利用や同意のない追跡の禁止を具体化

実社会における物理的な危害や人権侵害を防ぐための規定も、より具体的に明文化されました。まず、兵器に関する禁止事項として、兵器を機能させるためのソフトウェアや部品、さらにはドローンなどの無人機への武装搭載が禁止対象に含まれることが明記されました。また、個人のプライバシーや自由を守るため、本人の同意のない追跡行為や、法執行の過程において捜査や逮捕の対象を決定・推奨するような用途での利用禁止も、より具体的に記述されています。AIが法的な判断や個人の自由を奪う決定に直接関与することを防ぐ狙いがあります。

安全に管理された産業用ロボットアームの動作イメージ

高リスク領域における「人間の介在」と物理機器制御の安全要件

医療や金融、法務といった、人々の生活や権利に重大な影響を与える「高リスク」な用途においては、AIを完全に自律させるのではなく、人間の監視を必須とする要件が定められました。具体的には、健康や法的権利、金融などに影響する用途において、AIが提示した提案を検証・修正する権限を持つ「有資格者」が介在すること、そして影響を受ける本人に対してAIを利用していることを告知することが義務付けられます。このルールは、法務、医療、金融、雇用など11の分野について、対象となる行為と対象外となる行為が具体的に列挙されています。

さらに、AIが物理的な機器を制御するケースを想定し、共通規格「Model Hardware Standard」(MHS)を踏まえた要件も追加されました。負傷を引き起こし得る機器を自律的に操作させる場合、有資格の操作者が機器を監視・停止できることや、Claudeとの接続が切れても機器が安全な状態を保てることなどの要件を満たす必要があります。

まとめ

今回の利用ポリシー改定は、AI技術が急速に実社会のインフラや物理的なシステムへと組み込まれつつある現状を反映したものです。AIモデル自体の保護から、国家規模の影響工作への対策、そして医療や物理機器制御における人命・人権の保護まで、Anthropicが想定するリスクの範囲がより具体的に整理されています。新ポリシーは11月12日から適用されるため、Claudeをビジネスや開発に活用しているユーザーは、自らの利用方法が新しい基準に適合しているか確認する必要があります。

情報元

コメント