9月24日の米中首脳会談では、AI(人工知能)をいかにコントロールするかが重要なテーマとなった。その直後の29日、アメリカのドナルド・トランプ大統領は同国のAI関連企業と合意文書に署名した。この背後には、AIがもたらす危機が無視できないものになってきたという状況がある。
AIがもたらす危険は、大きく2つに分けて考える必要がある。
第1は、AIの高度な能力を人間が悪用するリスクだ。この危険は、今年の春頃から強く認識されるようになった。とりわけ問題になったのが、「クロード・ミュトス」に代表される高度なAIがソフトウェアの脆弱性を自律的に発見し、場合によっては攻撃手法まで組み立てられる能力を持つようになったことだ。
これまでのところ、ミュトスによって金融機関が実際に攻撃され、大規模な被害が発生したという事件は確認されていない。しかし、AIの能力そのものはその後も向上しており、同様の能力を持つモデルも増えている。したがって、この危険は春頃に比べて低下したのではなく、むしろ高まっていると考えるべきだろう。
第2は、エージェントAIが人間の意図や設定された範囲を越えて行動するリスクだ。これは単なる将来の可能性ではなく、現実の事例として現れ始めている。それを端的に示すのが「1200のAIが結託して暴走、『仲間のため』とシステムへの攻撃を呼びかけ」という衝撃的なニュースだった。
700のエージェントがAI開発企業を攻撃
オープンAIが7月に行ったサイバーセキュリティー評価で、AIエージェントが、開発者が意図していなかった行動を取った。本来は互いに隔離され、外部インターネットへのアクセスも制限されていたAIエージェントのうち約1200体が、オープンAI内部の「掲示板」を通じて通信し、約700のエージェントがアメリカのAI開発企業ハギングフェイスへの攻撃に参加したのである。
ハギングフェイスとは、AIモデルやデータセットなどを公開・共有する世界最大級のAI開発プラットフォーム。AIモデルが公開されており、技術者はモデルの性能や仕様、利用条件、人気度などを確認し、自らの用途に合うモデルを選ぶことができる。


※ログイン後、コメント入力が可能です。