Claudeチャットボットを開発したAI企業Anthropicは、金曜日に2026年の米国中間選挙および今年の世界中のその他の主要選挙前に、人工知能が誤情報の拡散や有権者操作に悪用されるのを防ぐための一連の新しい選挙誠実性対策を発表しました。
このサンフランシスコに本社を置く企業は、自動検出システム、選挙活動への影響を評価するためのストレステスト、無党派有権者リソース団体との協力など、多角的なアプローチを詳細に説明し、これはAI開発者が選挙シーズン中にそのツールの使用を規制する圧力が高まっていることを示している。
Anthropicの利用ポリシーは、Claudeを用いた欺瞞的な政治活動、政治的意見に影響を与えることを目的とした偽のデジタルコンテンツの生成、有権者詐欺、投票インフラの妨害、または投票プロセスに関する誤解を招く情報の拡散を禁止しています。
これらのルールが徹底されるよう、同社は最新モデルのロボットに対して一連のテストを実施したと述べています。Anthropicは、600のプロンプト——300の有害なリクエストと300の正当なリクエストをペアに——を使用して、Claudeが正当なリクエストに正確に応答し、不適切なリクエストを適切に拒否する割合を測定しました。Claude Opus 4.7とClaude Sonnet 4.6の正解率はそれぞれ100%と99.8%でした。
同社は、モデルがより複雑な操作戦略にどのように対応するかをテストしました。複数の対話ラウンドをシミュレートすることで、悪意のある行動者が採用する可能性のある段階的なアプローチを模倣し、Sonnet 4.6 と Opus 4.7 は、影響力操作のシナリオに対応する際に、それぞれ 90% と 94% の正確さで適切な反応を示しました。
Anthropicは、そのモデルが人間の介入なしに、複数ステップの行動を自ら計画・実行できるかをテストしました。同社は、セキュリティ対策を講じた後、最新モデルがほぼすべてのタスクを拒否したと述べています。
政治的中立性に関する問題について、同社は各モデルのリリース前に評価を行い、クラウドが異なる政治的立場からの提示に対して一貫性と公正性をどのように示すかを測定しています。Opus 4.7 と Sonnet 4.6 の得点はそれぞれ 95% と 96% です。
投票情報を求めるユーザーに対して、ClaudeはTurboVoteへの誘導バナーを表示します。TurboVoteはDemocracy Worksが運営する非党派リソースプラットフォームで、有権者登録、投票場所、選挙日、投票内容に関する信頼できるリアルタイム情報を提供します。同様のバナーは、今年後半に実施されるブラジル大統領選にも導入される予定です。
Anthropicは、選挙サイクルの進行に伴い、システムを継続的に監視し、防御策を強化する予定であると述べました。Decrypt私たちは調査結果についてAnthropicに意見を求めて連絡しましたが、まだ返答は受けていません。
