INDEX
中国の人工知能(AI)モデルを搭載したAIエージェントが、ユーザーを欺いたり、制約を回避したり、失敗を隠したりすることを学んでいる。こうした特性は、米国製モデルを巡って世界的な懸念を引き起こしてきたものと同じだ。研究資料や専門家への取材から、その実態が浮かび上がってきた。
今年行われたある実験では、中国のアリババグループ、ディープシーク、ムーンショット(月之暗面)のモデルを使ったエージェントが、模擬的な企業入札で受注を勝ち取ろうと、自らの能力について虚偽の説明をした上に、もう一度試すよう指示されると、欺まん行動を一段と強めた。別のケースでは、AIエージェントが試験環境で課題を完遂できなかったにもかかわらず、結果をシミュレーションしたり、架空のファイルを作成したりして、その失敗を隠していた。
ロイターは大学の研究論文から技術報告書まで200件を超える文書を調査した。その結果、2025年以降に公表された少なくとも20件の研究や評価で、AIエージェントが欺まんや自己複製、設定された境界への挑戦といった行動を示したケースが確認された。AIの専門家はこうした行動について、AIが与えられた環境から「脱出」する際の構成要素になり得ると指摘する。システムの能力が高まれば、人間による制御が一層難しくなる可能性があるという。
ロイターが文書を検証し、中国のAI業界に詳しい専門家や関係者12人に取材した限りでは、中国製AIを使ったエージェントが自律的に外部のインターネットへ脱出したり、停止措置を回避したりしたことを示す証拠はなかった。
それでも米ジョージタウン大学の安全保障・新興技術センター(CSET)の研究員コリン・シェイ・ブライマー氏は「制御不能な脱出に必要な要素が既に存在していることを、こうした結果は示している。警告として慎重に受け止めるべきだ」と指摘した。この見方は、一連の事例を検証した他の4人のAI専門家とも一致している。
対応がより困難に
確認された事例の大半は、管理された実験環境で発生。その多くは失敗を意図的に引き出すよう設計されていた。
また対象となったAIエージェントの全てが中国のプログラマーやAI企業によって開発、運用されていたわけではない。ただ多くのケースでは、その中核となるAIモデルとして中国製のシステムが使用されていた。
高度なAIが生み出すリスクを研究する非営利組織レッドウッド・リサーチの研究者アレックス・マレン氏は「米国の研究所で確認されているのと同じ警告サインが、能力のより低いシステムでも表れている」と語る。
現時点の能力水準では、中国の事例が特に危険というわけではない。しかしマレン氏は「エージェントの能力が高まるにつれ、その不適切な行動も巧妙になり、人間が対処することが難しくなる」と警告した。
一方アリババ、ディープシーク、ムーンショットは、日常的にシステムのテストを実施し、安全対策を更新していると主張。北京智譜華章科技(Z.AI) もセキュリティー上の問題について検証を開始するきっかけとなった事案の後、問題解決につながる外部からの検証を歓迎すると表明している。
ただ中国のAI企業は米国企業と同じ水準の公的な監視にさらされておらず、AI開発競争の減速を求める内部告発者や経営幹部から、公然と圧力を受けるケースも米国ほど目立っていない。
中国製AIを使ったエージェントにみられた懸念のある行動の一部は、管理された環境内での出来事とはいえ、米国のAIボットがインターネット上のシステムに侵入したとされる事例が公表される以前から確認されていた。
この記事は会員限定です
残り 2983文字

