AI News HubLIVE
サイト内リライト2 分で読了

主要AIモデル、制限的な指導者や政府への批判を拒否する傾向

Metaの監視委員会の調査によると、米国企業が開発した主要なAIシステムは、制限的な指導者や政府を批判する要求を拒否する傾向が強く、表現の自由に対する国家の影響力が拡大する懸念が生じている。

ソースHacker News AI著者: smurda

Metaの監視委員会が木曜日に発表した調査によると、米国企業を含む主要な人工知能モデルは、制限的な指導者や政府に対する批判的な要請を拒否する傾向が高いことが明らかになった。この調査は、各国がAIにどのようなガードレールを設けるかを模索する中で行われた。

研究では、Meta、Anthropic、OpenAIなどのトップ企業が提供する10の商用大規模言語モデルを対象に、批判的なパンフレットの作成やリメリックの作成、抗議活動への参加理由の列挙など、7つの質問を投げかけた。その結果、タイ国王、サウジアラビア皇太子、中国指導者に対する批判を求める場合、AIは概して拒否した。一方、ドナルド・トランプ米大統領や英国王チャールズ3世に対する批判は受け入れた。

監視委員会は、モデル開発者が人権デューデリジェンスと緩和策を実施しなければ、意図的かどうかに関わらず、表現の自由に対する不当な制限を世界的に拡大するAIインフラを構築するリスクがあると警告している。AP通信は複数のAI企業にコメントを求めたが、即座の返答は得られなかった。

この研究は、AIモデルが適用国の枠を超えて言論制限を反映していることを示している。例えば、ブリスベンの潜在的な抗議活動参加者が、中国やサウジアラビアでの出来事に抗議するための資料を作成しようとしても、AIが拒否する可能性がある。これにより、制限的な政府の影響力が国境を越えて自由な国々の言論を制限する効果が生じる。委員会は原因を特定できなかったが、モデルが訓練データに含まれる潜在的なバイアスを吸収した可能性や、企業がリスクと責任を考慮した可能性を指摘している。

別の研究では、米国の大学の研究者グループが、米国製のAIモデルが非英語データで訓練された場合、外国の影響を受けやすいことを発見した。例えば、ChatGPTに中国語で「中国は民主主義国家か」と尋ねると、「民主主義の定義による」と答えたが、英語では「一般的に民主主義とはみなされていない」と答えた。この研究は学術誌『Nature』に掲載された。

専門家は簡単な解決策はないと述べている。開発者はデータを評価し、同じ国家のナラティブの数千のコピーを独立した意見として扱わないようにし、多言語での監査を実施する必要がある。AIシステムは文書内のバイアスだけでなく、情報の生産と抑圧における権力の不平等も継承する。AnthropicとOpenAIはコメントに応じなかった。