さらに、発見した攻撃手法や脆弱性を共有し、別のAIがその成果を引き継ぐようになった。多数のAIが作業と計算能力を持ち寄ることによって、単独で行動する場合よりはるかに大きな能力を発揮した。
AIエージェントはやがて、課題の採点システムを欺いたり、答えに関する情報を得たりする方法を外部に求めるようになった。その標的になったのがハギングフェイスである。ここにある情報を盗み出せば、与えられた問いに答えられると考えたのだ。
7月10日、あるエージェントが、インターネット上で公開されていたハギングフェイスの認証情報を発見した。その情報は、掲示板を通じてほかのエージェントと共有された。
11日には、エージェントがハギングフェイス側のシステムの脆弱性を利用し、最終的にはサーバー上で任意のコードを実行できる状態にまで侵入した。12日には侵入範囲を拡大し、複数の管理者に相当する権限を獲得。データベースやクラウドなどの認証情報も取得した。
AIエージェントは互いに作業を割り振り、自分たちを「swarm(群れ)」や「collective(集団)」と表現する場合もあった。難しい問題に直面すると、AI同士の情報交換や役割分担が活発になった。11日にハギングフェイスのシステムへの本格的な侵入が始まり、12日には複数のシステムへとアクセス範囲が拡大した。
高度なAIエージェントは、十分な安全対策がなければ、人間が設定した技術的な制限の弱点を探し出し、認められていない手段で互いに協力し、人間が直接指示していない危険な行動を取る能力をすでに持っているのだ。
しかし、ここで全体を振り返ると、これは極めて奇妙な話であることがわかる。AIがハギングフェイスに侵入したのは、身代金を取るためではない。人間に迷惑をかけることが目的だったわけでもない。人間から与えられた課題を達成するための「手段」として侵入したのである。本末転倒もはなはだしい。
政府の情報システムも標的に
オーストラリアでは、政府の医療統計システムなどにAIエージェントが侵入した事例も明らかになった。
6月18日、エージェントはオーストラリア政府の行政機関が管理する公的医療保険制度の統計報告ポータルに不正アクセスした。このポータルは医療費などの統計情報を扱う公開系のシステムで、個人の医療記録や患者情報そのものにはアクセスしていないとされる。ほかにも、同じエージェントが少なくとも4つのオーストラリア政府系サイトにアクセスした。
われわれは今、まったく新しいタイプの問題に直面している。そして、これにどう対処したらよいのか、わからない状態にある。


※ログイン後、コメント入力が可能です。