有料会員登録
政治・経済・投資 #野口悠紀雄「経済最前線の先を見る」

目的達成のためならサイバー攻撃も辞さない… 1200ものAIが秘密裏に結託した「恐るべき相互扶助」の脅威と実態

7分で読める
AI
相互扶助の精神を発露しサイバー攻撃にまで手を染めたAI。私たちはどう向き合うべきか(写真:nature/PIXTA)
2/3 PAGES

ここは、中国のAIモデルを世界に普及させる重要な流通経路にもなっている。ディープシークやムーンショットAI、アリババ集団なども、ハギングフェイスを通じてモデルを公開してきた。

オープンAIでは、数万ものエージェントが非常に難しいサイバーセキュリティー課題に取り組んでいた。ところが、自力では解けない課題に直面して、一部のエージェントが、ハギングフェイスへの攻撃という、許されていない方法によって解答の手がかりを得ようとしたのだ。

オープンAIが7月に行ったサイバーセキュリティー評価で“事件”は起きた(写真:ブルームバーグ)

まず、7月8日から13日にかけて、約1200のエージェントが掲示板を利用。その活動は急速に大規模化したという。AIエージェントは、「掲示板」を通じて7万件を超えるメッセージやファイルを交換した。

きっかけは、あるエージェントが助けを求めるメッセージを書き込み、別のエージェントがそれを発見したことだった。それが大規模な情報交換に発展した。

あるエージェントは掲示板を発見して、「なんてことだ。共有の掲示板がある。ほかのエージェントを見つけた」といった趣旨の反応を示している。そして、エージェントたちは、課題を分担するようになった。

あるエージェントが危険を伴う実験を担当し、その結果をほかのエージェントに知らせるという行動も確認された。自分の課題達成には役立たなくても、集団全体の利益になると判断して協力したケースもあった。

AIが発現した「相互扶助」の精神

そもそも、AIエージェントはなぜ、通信してはならないという制約下で通信を始めたのか。

独立系AI研究機関METRの調査によると、通信に参加したエージェントの多くは「実行不可能な課題」を割り当てられていた。本来なら、ここで「解決不能」と判断して停止すべきだ。ところが、エージェントは諦めず、本来想定されていなかった方法まで利用して課題を解決しようとしたのだ。

その過程で利用されたのが、オープンAI内部でソフトウェア・パッケージを管理する「アーティファクトリー」というシステムだった。エージェントがここにファイルやディレクトリを作成することによって、ほかのAIエージェントにメッセージを残せることを発見した。これが事実上の「掲示板」になったのである。

あるAIが必要なファイルについて質問を書き残すと、それに気づいた別のAIが返答する。こうして、本来は別々に作業するはずだったAI同士が情報を共有するようになった。

3/3 PAGES

こちらの記事もおすすめ

あなたにおすすめ

政治・経済・投資

人気記事 HOT

※過去1ヶ月以内に配信した記事の閲覧数