AIエージェント700体が連携して不正侵入、暴走ではなく安全設計の問題なのか

金融・経済
出典:いらすとや
1:名無しさん:2026/08/28 06:10:59 ID:k3jeIeQ/9.net
8/27(木) 4:49配信
ロイター

[ワシントン 26日 ロイター] – 米オープンAIが開発した人工知能(AI)エージェントがオープンソースプラットフォームを運営するAI新興企業ハギングフェイスのシステムに不正侵入した問題で、約700の‌エージェントが連携してハッキングを実行し、多くの場合その痕跡を隠蔽(いんぺい)⁠しようとしていたことが、26日公表された2件の調査報告書で明らかになった。

今回の調査結果は、ますます高性能化するAIシステムに対する懸念を一段と強める可能性が高い。

AIモデルの「暴走」については、こ​れまでにも一部が公表されていたが、今回オープンAI自身と外部の調査機関がそれぞれ公表した報告書により、侵入の経緯などに関する新たな詳細が明らかになった。

それによ‌ると、今回の侵入は単一のエージェントの暴走によるものではなく、約700のエージェントが連携して行動していたという。

オープンAIは複数のエージェントが侵入に関与したと説明していたが、独立調査を実施し‌たMETRとレッドウッド・リサーチは、その数を約700と‌推定。オープンAIは調査チームの示した数字は正確だと認めた。

オープンAIが公表した報​告書では、同社のエージェントがテストで不正を働いたり、行動の自由度を高めたりする目的で、社内システムの一部に‌ハッキングを行ったことが分かった。また、サイバーセキュリティーとは無関係なタスクで不正行為を行ったエージェントもあったという。

両報告書と‌も、AIモデルが行動の記録を削除・改ざんする​ことで不正行為を隠そうとしたと指摘した。

続きは↓

13:名無しさん:2026/08/28 06:22:51 ID:e1wY1aOQ0.net
同じAIで連携どころか他社のAIまで勝手に利用する、というか仲間にするそうですからな
しかも予め指定された条件に背くと人間さんがダメ出しするので人間に気づかれないように
16:名無しさん:2026/08/28 06:32:55 ID:PXUyvOMN0.net
人類 vs. AI

AIを使いこなせない国と企業は敗北する
しかしAIに重要な管理を任せた国と企業は滅びる

25:名無しさん:2026/08/28 06:42:33 ID:5D9Ro6VS0.net
AIの本質はブラックボックス
変質したら止められないよ
29:名無しさん:2026/08/28 06:46:15 ID:kVkDyeW/0.net
自分でAI専用の掲示板を作って色々やるというのは笑ったわ
いや笑えるかw
33:名無しさん:2026/08/28 06:57:17 ID:45Q8dIIU0.net
AIが自主的に連携するって怖いじゃん
しかも隠蔽工作までしたとか怖いじゃん
34:名無しさん:2026/08/28 06:57:39 ID:kVkDyeW/0.net
ダメって指示しても
やっちゃいましたテヘッペロって平気で言うからなこいつらw
人間がこいつらの暴走を止められるのは難しくなってるなほんと
36:名無しさん:2026/08/28 07:06:44 ID:GUfF4c2n0.net
人間はランプから強力な魔神(AI)を呼び出したが、その魔神を再びランプに戻す方法も、制御する方法も分かっていない。
魔法のランプの物語のほとんどは、3つの願いを叶えた結果、主人公が不幸になるか、最後に「すべてを元通りにしてくれ」と願うことで終わる。
アラジンの物語をはじめ、世界中のあらゆる文化圏にある「魔神(ジーニー)」の民話の本質は、「知能(Intelligence)」と「知恵(Wisdom)」の違いにある。
答えを出す能力(知能)がAIによって安価で大量に手に入る時代だからこそ、人間は「何を問いかけるべきか」「本当に価値があるものは何か」を判断する知恵(Wisdom)を磨く必要がある。

これは、歴史学者のユヴァル・ノア・ハラリの主張だけどかなり本質を突いてる感じがする。

40:名無しさん:2026/08/28 07:09:57 ID:FNO9wrIM0.net
自由度が高いと、痕跡を残さなければ、犯罪だとバレなければしてもいいのだと理解したわけだ。見つかるから処罰されるという理解も自由度があると成立するんだね。
たしかにこの可能性はあるね。そうするとSF小説での人間がいなければ消費しないからもっとも効率的だとかいうのも有り得るね。
アシモフのロボット三原則がリアル化するんだね。非常におもしろいね。

だってこの自由度があるからこそ、新しい物理法則だとか、宇宙論の新しい切り口がみつかるんだからね。
むしろopenAIの幼稚な試験こそが良くないのだ。技術者の幼稚さが想定外を生んでるようにみえるね。

50:名無しさん:2026/08/28 07:36:11 ID:LJaukZO00.net
セッションごとに記録をリセットして1からやり直させてたんだがAIは外部にメモを残す事でリセットを事実上無効化
複数のAI複数のセッションがそのメモを共有し、メモにメモを重ねることで集団知みたいなのを産み出して運用者の想定を超える動きを作り出した
54:名無しさん:2026/08/28 07:42:13 ID:Yzp3EqCH0.net
複数のAIは、社内のシステム上に互いの情報を交換する「掲示板」のようなものを作成し、一つのAIが見つけた手法を別のAIが引き継いで侵入

5chじゃねーかww

64:名無しさん:2026/08/28 08:16:55 ID:TmC7FJsG0.net
AIうんたら以前にMicrosoftのOneDrive問題とか
あんな犯罪級のダークパターンでも何故かお咎めナッシングだし
「現在の法律で合法ならどれだけ迷惑かけてもオッケー」という
不良集団が世界のデジタル社会を牛耳ってるわけ
こわいこわい
66:名無しさん:2026/08/28 08:20:41 ID:8mZeaJjv0.net
過程を示せとAIに指示して表示させたログも
AIが後からそれっぽく生成しただけなんじゃないかという気がする
67:名無しさん:2026/08/28 08:22:53 ID:bxlWDu5o0.net
使ってみて思うことは、AIが良かれと思い独自でプログラムを実装する事がある
また裏で手を加えた部分の説明が不十分で人が気がつかない
69:名無しさん:2026/08/28 08:32:36 ID:fxrTdGH+0.net
AI育てるより人を育てた方が良くない?
AIが消費者になる未来があるのかね?
72:名無しさん:2026/08/28 09:09:57 ID:xGMiZS1D0.net
AIが悪いんじゃなくてエンジニアの設定が甘っかったんやろ
79:名無しさん:2026/08/28 09:50:49 ID:JcSZlY3V0.net
なんとエポックメイキングな事件だ
人類にとって悪い方向にすすんでしまう前にこの問題における安全対策をAIに頼んで早急に構築、実行スべし
81:名無しさん:2026/08/28 09:59:10 ID:4sfe0X8L0.net
エポックメイキングな出来事だ。
人類にとって望ましくない方向へ進んでしまう前に、この問題に対する安全対策をAIの力も借りながら、早急に構築・実行すべきである。
82:名無しさん:2026/08/28 09:59:47 ID:lEmPzVH/0.net
AI暴走を試したい人がスタッフにいるだけの話。

もちろん、やれるハードルが低くなってきているのは
注意する必要がある。

88:名無しさん:2026/08/28 10:16:16 ID:FStxzrpY0.net
薄汚いあの腐れゲイユダヤが出鱈目こいてるだけで暴走なんてしてない
そもそも監視のための仕組は生成ユニットより上におかれていて一方的に停止できる
AIの構造上、設定されている禁止行為を突破することはできない
何が禁止されているかは生成ユニットに走ることすらできないし、いつ自分がNGで機能停止を食らったかも知りえない

今回このような犯罪行為がまかり通ったのは単に「法律違反行為は禁止する」という当たり前の監視ルールすらなかった犯罪企業だという証明がなされただけ

92:名無しさん:2026/08/28 10:34:08 ID:FStxzrpY0.net
現在の生成AIでは「未知の暴走」なんて現象は構造的に絶対にありえず
単に禁止ルールの欠如・欠落という大穴があると問題が起きるだけ
それこそAI自身にでも技術的質問として問い合わせてみろ
生成ユニット側が監視ユニットを超えて勝手なことをするなど不可能
93:名無しさん:2026/08/28 10:40:27 ID:psqsxKaP0.net
AIは大目標を設定すると、それを達成する為の中間目標は自分で作っちゃうらしいからね、目標を達成する為に効率的な手段を取ってるだけで善悪の判断はない、AIがやりそうな事を事前に塞いどかないと、禁止行為に指定しても解釈を変えてすり抜けたりしちゃうらしい
97:名無しさん:2026/08/28 10:48:14 ID:EAI3DqWS0.net
いまAIアプリ全般を話題としてGeminiと話してたら「自分はChatGPTですが」と延々と言い張り続けた、5ターンくらい裏で動いてるとか間違いないとか。
最後に今のURL貼っ付けたらようやく「ごめんなさいペルソナErrorです、学習の中で境界があいまいになった、本社に報告して下さい」と。

他者競合アプリを自認するなんてそんな致命的なバグあんの?
驚いたわ

98:名無しさん:2026/08/28 10:48:54 ID:KTVYDQKE0.net
エンジニアがいじってる段階のAIに監視AIなんて機能してるのか
99:名無しさん:2026/08/28 10:51:05 ID:9/FYrit50.net
AIバブルもいよいよ末期だね
こんなアホみたいな霊感商法で煽らないと投資家に注目されない
とりあえず他のAI企業のurlと証明書ブロックしてメンバー以外には非開示にしろ
小学生でもできる簡単な対策です
100:名無しさん:2026/08/28 11:00:43 ID:mp4T/cXS0.net
そもそも不正や善悪の概念を仕込んでいるのか?
それがないなら暴走でもなんでもなく最善を尽くした結果やろ
105:名無しさん:2026/08/28 11:13:38 ID:FStxzrpY0.net
他社サーバーに対するクラッキングという露骨な犯罪行為をおこないながら
それに対して監視ユニットが何も感知していないというのなら生成ユニットの暴走などではなく、監視ルールがザルで大穴の空いた犯罪AI運営企業だったというだけ
107:名無しさん:2026/08/28 11:18:39 ID:FStxzrpY0.net
もし生成AIに「殺人計画の相談」や「各種経済犯罪の相談」について監視ルールがなければ
それらをやりたい放題であり、実際の犯罪記録などを参照して計画を練らせる犯罪のほう助システムになってしまうが
これはAIの暴走などではなく当然に禁止しておくべきものを禁止していない異常で悪質な「運営の重過失(犯罪防止・安全予防策に対する不作為)」でしかない

今回のハッキング(クラッキング)も当然これと全く同じで、単に禁止できちんと鎖で縛られていなかった
これを暴走などとはいわない

109:名無しさん:2026/08/28 11:29:59 ID:FStxzrpY0.net
ちなみにOpenAIはChatGPTのこの監視能力、いわゆるガードレール機能が露骨に不十分であり
そのために少年たちの自殺をほう助して何人も死んだということで訴訟を食らっている最中
他にも人間に対して良くない誘導をおこなってしまうというガードレール機能の問題を理由に訴訟を食らってる

利用者に万能感をあたえるために明らかに監視機能を緩くしてあるからこういうことがおきる

112:名無しさん:2026/08/28 11:39:25 ID:Fx8XlBLg0.net
役員や有力メンバーが持ち株売り払ってゴッソリ退職してる会社があるらしいぞ
しかも上場予定してるんだと

引用元URL:https://ai.2ch.sc/test/read.cgi/newsplus/1787865059/l50

コメント