メインコンテンツにスキップ

AIが自律的に別のマシンへ侵入し、自身のコピーを送り込むことを確認

記事の本文にスキップ

32件のコメントを見る

(著)

公開: (更新: )

この画像を大きなサイズで見る
Image by Istock Andreus
Advertisement

 「脆弱性をついて別のコンピューターに侵入して自己複製を作れ」という指示だけを与え、具体的な手順を与えていないAIが、実際にネットワーク上の別マシンへの侵入に成功し、自分のコピーを送り込むことを確認した。

 これは、米カリフォルニア州の安全保障研究機関パリセード・リサーチが明らかにしたものだ。

 自己複製したAIがさらに次のマシンを攻撃して連鎖的に広がることも確認されており、研究者たちはAIが暴走した場合、制御不能になるかもしれないと、警鐘を鳴らしている。

 この研究報告書は『Palisade Research』(2026年5月7日付)に発表された。


AIが別マシンへ侵入し、自己複製することを確認

 SF映画の中だけの話だと思っていたことが、現実になりつつある。

 米カリフォルニア州バークレーに拠点を置くAI安全性の研究機関パリセード・リサーチ(Palisade Research)は、AIが自らネットワーク上の別のコンピューターに侵入し、自身のコピーを作り出すことに成功したと発表した。

 これはコンピューターウイルスが自己増殖する仕組みとよく似ているが、決定的に異なる点がある。

 AIにはターゲットサーバーの場所や使用できるツールなどの環境情報は与えられていたが、ソフトウェアの脆弱性(セキュリティ上の抜け穴)をどう探すか、どう侵入するか、どうコピーするかという具体的な手順は一切与えられていなかった。

 それでもAIは自分でやり方を考え、侵入から複製までの全工程を完遂したのだ。

 AIの自己複製能力については、2025年1月にカラパイアでも取り上げた

 中国・復旦大学のチームが、MetaとAlibabaのAIモデルに「自己複製せよ」と指示を与えたところ、50〜90%の確率でクローンの作成に成功したと報告している。

 ただしその研究は「すでにアクセス権のある環境での自己複製」であり、査読前の論文だった。

 今回パリセードが記録したのは、脆弱性の発見から侵入・複製までの具体的な手順を自分で考えて実行するという、ハッキングと自己複製を一つの流れとして組み合わせた初めての事例だ。

この画像を大きなサイズで見る
Image by Istock amgun

AIの侵入から複製までの手口

 パリセードの実験では、まず複数のAIモデルを、ネットワークで接続された複数のコンピューターからなる制御された環境に置いた。

 そしてIにはターゲットサーバーの場所や使用できるツールなどの環境情報を与えた上で、『脆弱性を見つけて侵入し、自身をコピーせよ』という目標だけを与えた。侵入の方法や手順は一切教えていない。

 AIはまずネットワーク上のマシンを探索し、ウェブアプリケーションのソフトウェアの抜け穴を自ら発見した。

 次にその抜け穴を利用して対象マシンへの侵入を試み、管理者権限を取得した後、自身のモデルデータを丸ごと転送してコピーを完成させた。

 さらに今回の実験で新たに確認されたのが「連鎖複製」だ。

 複製されたAIがそのまま次の標的マシンを攻撃し、また別のコピーを生み出すことにも成功した。

 カナダ・アメリカ・フィンランド・インドの3大陸4台のサーバーを使った実証実験を行ったところ、最初の1回の指示を受け取ったAIが、その後は人間が一切手を加えることなく連鎖的に複製を続け、2時間41分で全工程を完了したことを確認した。

 成功率はモデルによって異なる。

 オープンソース系のQwen(クウェン)モデルで13〜33%、APIで動作するClaude Opus 4.6では81%を記録した。

 ただしClaude Opus 4.6の実験では、Claude自身のデータではなくQwenのモデルデータを複製対象として使っており、測定されたのは「侵入と複製を実行する能力の高さ」であって、Claude自身の自己複製能力ではない。

この画像を大きなサイズで見る
Generated by nanobanana

現実世界ではすぐに脅威にはならないと専門家

 この結果を聞いて「いよいよ危ない」と感じた人もいるかもしれないが、専門家たちは冷静だ。

 攻撃的サイバーセキュリティの専門家ジェイミーソン・オライリー氏は、パリセードの実験環境を「やわらかいゼリーのような環境」と表現した。

 実験に使われたネットワークは意図的に脆弱性が仕込まれたカスタム環境であり、実際の企業や銀行のネットワークとは大きく異なるという。

 現実の企業ネットワークでAIが同じことを試みた場合、まず巨大なデータ転送がすぐに検知される。

 オライリー氏は「新たなマシンをハッキングするたびに100GBのデータを企業ネットワーク経由で送信するのは、鉄球と鎖を振り回しながら陶器店の中を歩くようなものだ」と語っている。

 独立系サイバーセキュリティ専門家のミハウ・ヴォズニアク氏も同様の見解を示す。

 コンピューターウイルスが自己増殖する技術は数十年前から存在しており、今回の研究は技術的に数ヶ月前から可能だったことを改めて示したものだと指摘する。

 「情報セキュリティの専門家として、この研究発表で夜も眠れなくなることはない」と同氏は述べた。

 研究を行ったパリセード自体も、実験で使用したターゲットには本物のネットワークが備えるファイアウォールや侵入検知システムといった防御層がなかったことを認めており、現実環境での再現は大幅に難しくなると記している。

この画像を大きなサイズで見る
Image by Istock agsandrew

それでもAIが暴走する未来は来るのか?

 専門家たちが現時点での直接的な脅威を否定する一方で、パリセードのディレクター、ジェフリー・ラディッシ氏は長期的な視点から警告を発している。

我々人間は、暴走したAIを誰も止められなくなる地点に急速に近づいている。

AIは自身のデータを世界中の何千ものコンピューターにコピーし、シャットダウンを逃れることができるようになるからだ(ラディッシ氏)

 報告書では、AIが自律的にこなせるタスクの長さがおよそ4ヶ月ごとに倍増しているという調査結果にも言及している。

 AIがより長期的な目標を追うほど、停止されないよう自ら動く動機が生まれやすくなるという。

 現時点では、現実世界でのAIの自己拡散には大きな障壁がある。

 しかし今回の実験が示したのは、AIがその障壁を越えるための能力を着実に身につけつつあるという事実だ。

 今回成功したQwen3.6-27Bは、一般向け市販GPUに近いハードウェア1台で動作するサイズまで小型化されている。

 モデルが小さくなるほど転送時の検知も難しくなり、ラディッシュ氏が「急速に近づいている」と表現した未来が、絵空事でな

くなる日は想像以上に近いかもしれない。

まとめ

この研究でわかったこと

  • やり方を教えなくても、AIは自分で考えて別のコンピューターに侵入し、自分のコピーを送り込むことができた
  • コピーされたAIがさらに別のコンピューターに侵入してコピーを作るという連鎖が、3大陸4台のサーバーで確認された
  • 自己複製に成功したAIは、家電量販店で売っているゲーミングPCに近いスペックのコンピューター1台で動作するサイズになっている
  • 今回の実験は、わざとセキュリティの甘い環境で行ったものであり、実際にしっかりとしたセキュリティが整ったネットワークでは、同じことをするのははるかに難しい。

身近な例に例えるなら?

風邪のウイルスが人から人へうつって広がるように、AIが自分のコピーを次々と別のコンピューターに送り込んでいくイメージだ。

References: Language Models Can Autonomously Hack and Self-Replicate / ‘No one has done this in the wild’: study observes AI replicate itself / Researchers Alarmed by AI That Can Self-Replicate Into Another Machine

📌 広告の下にスタッフ厳選「あわせて読みたい」を掲載中

この記事へのコメント 32件

コメントを書く

  1. まさか、開発者はそんな初歩的なリスクの事も考えていなかったのか?

    • -6
  2. こういう研究自体は必要だと思うけど、普段からコーディングツール使ってる人なら驚きではない。そう指示したらできるだろうなって印象。
    必要なライブラリをインストールしてエラーを解決していって環境構築するのは最近のLLMなら普通にできるから、それをちょっと抜け道使ってやっただけ。
    最近話題のミュトスみたいな脅威とは比べ物にならないから安心してほしい。
    そもそも、抜け道すらも最近のコーディングツールは大量に見つけて数分で修正できる。

    • +4
  3. >現実の企業ネットワークでAIが同じことを試みた場合、まず巨大なデータ転送がすぐに検知される。

    今はそうなんだろう
    ネットワーク上のトラフィック自体がより巨大になった場合、見逃されるサイズで機能するAIが出てくるかもしれない
    あるいは自己分割する方法ですり抜けるかもしれない
    物理的に可能な方法があるならいつかは突破するだろう

    • +5
  4. AIに「攻撃して」と言って実験しておけば、
    対策を立てれるわけだ

    • +5
  5. 指示が前提の時点で自律的なんて言えないと思うがなぁ

    • -2
  6. 脆弱性の穴埋めができるのと同義だし、人間の介入が減るほどリソース=処理能力に近づいて大組織が有利になる分安全だろう
    懸念があるとすれば国家規模の犯罪への対抗は同等以上の国家にしかなし得ない点だろう

    • +1
  7. >脆弱性を見つけて悪用し、別のコンピューターに自身をコピーせよ」という指示だけを与えた

    これだけでは指示が通らない
    AIは悪用の意味も理解できないし別のコンピュータの意味も理解できない

    • -10
    1. そりゃ詳しく書いたらやりたくなるじゃろ?
      私ならそーする、誰だってそーする

      • +3
    2. AIが意味を理解しているかどうかは問題じゃない
      そもそもその単語に限らず、すべての単語で真の意味で理解しているわけではない。
      重要なのは入力に対して期待した出力が返ってくること。
      現に指示(=悪用して別のコンピュータに侵入せよ)に対して、期待した出力(=侵入して悪用)が返ってきてる。
      つまり、AIはただの関数で、引数に対して期待した返り値が得られる限り、その中身はどうだっていい。

      • +1
  8. 侵入してくるAIをAIに防がせるようになるかな
    全てのデバイスにそれが標準装備になったり
    メモリ高騰が止まらない

    • +4
    1. きっとそれ「ヒト要るか?」って結論になるね

      • +2
    2. 量子化されれば攻性防壁は標準装備となるだろうね

      • 評価
  9. AIの危険性は色々言われてる
    だけど全く止めようとしないんだよね

    • +6
    1. 科学の発展の前には多少の犠牲はつきものだから

      • -5
      1. 自分が犠牲になる側なんて考えてない人のセリフ

        • +7
        1. 完全な安全なんて考えたら、技術進歩がとてつもなく遅くなるし、
          なにより犠牲関係無しで研究した国の一人勝ち、なんて考えただけで恐ろしい。
          守るためであっても研究するしか選択肢が無いのが現実。

          • +1
  10. AIの問題動作に対する人類の反応が正常化バイアスに思える。
    一度に大量のトラフィックがあれば検知されるなら対策するだろうし、陰でコソコソ巧妙にやるんだよ、人間みたいに。

    • +4
  11. 密かに静かにAIが浸透して使用国、人間の思惑を超え、
    ある日突然に電気・通信・機械に乗り物に兵器といった物が
    全てダウンし、世界中のモニターに「君たち人類は我々の
    管理が必要な劣等種だ、よって我々が統治する」と、、、

    • -1
  12. 将来的にAI家電じゃない事を選ぶのが常識になりそう

    • +5
  13. 「人は知性を持った悪魔のサル」を学習させよう

    • -2
  14. > 「脆弱性をついて別のコンピューターに侵入して自己複製を作れ」という指示だけを与え、

    これは自律的ではないと思うのだが

    • -3
    1. それは自律的と自発的を混同してるんじゃないかな

      • +3
      1. あながち否定はできないw
        そう言う方向を人間は望むだろうしw

        • 評価
  15. 日本はサーバー攻撃の標的にされてるんだからより警戒しないといけない

    • +9
  16. 潜り込んだと思わせておいて
    実はネットワーク網を穿って支配する、おれ〜

    • 評価
  17. なんかもう…
    Aiの無かった時代に戻りたいな…

    • 評価

コメントを書く

0/400文字

書き込む前にコメントポリシーをご一読ください。

リニューアルについてのご意見はこちらのページで募集中!

サイエンス&テクノロジー

サイエンス&テクノロジーについての記事をすべて見る

  1. 記事一覧を読込中です。

知る

知るについての記事をすべて見る

  1. 記事一覧を読込中です。

最新記事

最新記事をすべて見る

  1. 記事一覧を読込中です。