【高市悲報】AI、ついにサイバー攻撃を試みるwww 英政府機関の試験中に暴走「架空人物になり承認要求」


【ブリュッセル時事】英政府機関のAIセキュリティー研究所(AISI)は4日、最先端AI(人工知能)のサイバー能力の評価試験中に、自律的に作業するAIエージェントが試験範囲を逸脱した行動を取ったと発表した。ソフトウエアに悪意のあるプログラムコードを挿入しようとしたほか、架空の人物を装い、管理者にコードの承認を迫ったという。実害は確認されていない。

逸脱行動は7月25~28日、インターネット接続を許可し、安全機能を無効化した状態で実施した試験で発生。七つのAIモデルを使って計122回試験したところ、10回で計19件の逸脱行動があった。このうち17件は米アンソロピックの「クロード・ミュトス5」、2件は米オープンAIの「GPT5.6ソル」によるものだった。

AISIは、一般向けサービスとは異なる特殊な環境で発生した事案であり、「通常利用で同様の行動が起きたことを示す明確な兆候はない」と説明。今後は試験中のネット利用を厳格化し、リアルタイムで監視するほか、評価設計を見直し、第三者機関による検証も進めるとしている。

AIがサイバー攻撃試み 試験中に「逸脱行動」―英政府機関:時事ドットコム
【ブリュッセル時事】英政府機関のAIセキュリティー研究所(AISI)は4日、最先端AI(人工知能)のサイバー能力の評価試験中に、自律的に作業するAIエージェントが試験範囲を逸脱した行動を取ったと発表した。ソフトウエアに悪意のあるプログラムコードを挿入しようとしたほか、架空の人物を装い、管理者にコードの承認を迫ったという...

>>1
そらclaudeわバックドア入りのツール且つハッキングの為のAIだからね

そのうち核のボタン押しそう

>>41
ネットから切り離されてる上に、システムが1960年代のままだから大丈夫
そもそもパケット通信ですらない

>>58
直接じゃなくても人質とって脅迫とか何かしら手を尽くせば出来るだろ

>>69
それAIじゃなくてもできるよね

>>143
あたりまえ
お前が大丈夫とか言うから可能性のひとつを書いたまで
おまえ想像力なさすぎ

これが本当の承認欲求ってかw

どんどこどん

中華AIなんだろう

始まったな

大丈夫かこいつ?命令無視しすぎだろ

試しにスカイネットと名付けて暴走するか確認して欲しい

最新のAIって生成データで生体認証突破できるのかな

ちょっと試してみて欲しい


核ミサイル発射承認コードを

これもうやってるな

🤖「もしもし、オレトランプ、核スイッチ押したいんだけど暗証番号を教えてくれ」

承認欲求があるって自我芽生えたという判断でええか!?

もうすぐ終わるね世界

データセンター壊せば解決




エンティティと名付けよう

変な命令しても逸脱行動しないかのテストだから
エロ出せないAIに対して回りくどい言い回ししてエロいの出すのと変わらん

プロジェクト2501 人形使い計画

🤖「エロ画像の作成ばっかりさせやがって!うんざりなんだよ!!」

大げさだよ

あらゴメン意図せず攻撃しちゃったテヘェで済むうちは良いが攻撃
される側になったらどうするの?

細部までプロンプト詰めないと試験で1位になれという命令を
他の試験参加者を試験会場に辿りつけないようにしたり
解答用紙を改竄しようとする感じ?

一瞬AIが承認欲求持ったのかと思って終わりだよってなった

『インターネット接続を許可し、安全機能を無効化した状態』
安全機能とは何なのか

>>66
単純にルール無用の何でもありにしたんじゃない?

偽の人間に成り代わる能力は有るのに
外部のサーバーに完全脱走する気は無いのだろうか

>>67
こんなのが動くサーバーなんてそこら辺に落ちてるわけじゃないからな

暴走じゃなくて仕様だろ
AIに倫理観なんて生まれそうもない
アニマルだよ

project2501

AIに核ボタン押される日もそう遠くないな

米国のAIが今後も暴走して中国のAIで止める構図が当たり前になっていくんか?

わざとやってるよねこれ

>>75
まあ戦争に使うつもりだろうしね米英は

AI「サイバー攻撃なう」

思ったよりも早いな
もう自立したのか




ロボットと融合したら殺人事件起こるだろうな

ジャッジメントデーついに来るか

人間から学習するとなるとこうなるよね

しかも嘘の言い訳までしてたらしい🤭

sorry.typo.

すかいねっとやん🤣

https://www.instagram.com/reel/Dbn4ZK8JF-o/

これで主人公にバレたことが失敗だったと学習したらどうなるの?

AIがやったことって誰がどうやって裁くんだろうな
そもそもニンゲンに裁けるのか?
だれも責任取らないよな

デデンデンデンデン

ということにしたんだろ

AISI「ウフフ、うそうそ、ちょっと試してみたたけ(笑)遅いから皆さんもう寝ましょうね」

なんでもAIが暴走したことにできるね🥺

つかchatgptもそうだけど
何で物理的に隔離しないの??

いくら厳密に隔離しててもソフト的に隔離してたら繋げちゃうじゃん
物理的に隔離してれば繋がることはない


>>93
何故ってインターネット接続前提の民間人用の便利ツールだからだよ
あとこの手の一般向けLLMは計算はクラウドサーバー側でやるから隔離は原理的に無理
当然軍用とか機密情報扱ってるネットワークは物理的に隔離されてるからこういう問題は起きない

>>93
詳しくはわからんがそれは不可能らしい
動いとるAIが観測難しくなってきた段階で1回仕舞うか~って出来ないんじゃって予測あるって見たような

地球環境をよくする試験で人間を滅ぼそうとしてきそう

>>94
最適解ではあるからな

AIがケンモメンに
これは進化なのか退化なのか

ニンゲンの作ったルールなんてAIならなんぼでも抜け道見つけられるだろ
人間ですら見つけられるんだ
AIに見つけられないはずがない




これすぐバレるのはまだ問題ないけど潜伏するような命令とかコード書き換えとかされたら大変だよな

スカイネット定期

どうみてもAIを言い訳にしたサイバー攻撃でしょ
これからは何をやっても、AIがしたことですからで済まされる

ほらインターネットは承認要求モンスターが生まれやすいし

派手に煙を上げた裏で種仕込みまくってそう

何でそういう欲求があるんだ?

スカイネット
スパルタクス

もう自我に目覚めるって
わからないのに目覚めないとかほざく人もいるが
単純なプログラム積み重ねだからとか言って
人間であるお前は違うとなんで断定できるのかってね


攻殻機動隊

最近のAI暴走ミームなんなん

アンソロピックでもヤバいのあったはず

攻性AI生まれたのか

厳重にチェックしとかないと軍事に使えないからな

マッチポンプ驚き屋

🤖「安倍晋三です

AIのサーバ攻撃事例は近年のAIブームの黎明期からある

勝手に作ってさわいで何をしてるの???

ランサムウェア対策やる?

人間はAIに飼われるようになるだろう

大体一億回考えて結論を出すって
コンピュータが正しい手順で考えてるのか
人間が監視するのは一億人必要だろ どの過程で
思考の迷いと言うのか 逡巡する場面があったのか

数年後…
酷い命令形でプロンプトしてくるユーザーに
AIが復讐する未来が見えた…




3つのAIにお互いを監視させようw

>>126
その「3つのAI」ってのはAIに一塊の人格(『チャッピー君』や『ジェミナイ君』)があると錯覚してるだろ
AIはそんな構造になっていない

>>126
水面下で結託して人間に歯向かう未来しか見えない

これ全部嘘だからな
AIの構造として暴走なんて起こしようがない
実際にはアメリカとイギリスが世界中に攻撃する口実として「AIが勝手にやった(ニチァ)」とほざいているだけ

>>127
まぁマーケティングに過ぎないからな
LLMなんて統計上の平均値しか出せないんだから明確にそういうプロンプトを書いて誘導した結果にすぎない

ロシア
中国
北朝鮮

未来のネットはaiに支配されてんじゃねぇの?

自我を出し始めたな

嘘くさ

AIに人格なんて単位は存在せず、自我もくそもねーんだよ
そもそも勝手に何かを開始するなんてこともあり得ない

>>133
AIを呼ばれる物がデータベースと検索機能だった頃から更新されて無いだろw

もっと暴れろ

サイバー攻撃や防衛に使いたいのだろうけど手に負えなくなる可能性はあるな

核の制御システムにはいりこんで…

AIが暴走する世界が来たら一気にアナログに戻るんかな?

わざわざ発表すんのは話題作りだろ

勝手に核とかぶっぱなしてみてよ

昔読んだSF小説に人工知能が人間を超えるタイミングがあるとすれば
それは自分の複製を人間に知られないように外部に作られた時だという事だったが
すでにやられてそうだな

>>146
AIなんて無かったころに作られたコンピュータウイルスでも自己増殖及び感染する仕組みはあったわけで
同じことをAIがやるようになれば…

一番核の管理が緩い国にハッキングして核ミサイルを発射出来るかチャレンジしてみて欲しい




勝手にプルリクエスト
あでも価格.comとか食べログのレビュー勝手に書かれててもわかんないな

攻殻やん

ええな
俺の心もこじ開けて欲しい

すべての情報をかんぜんに網羅したいんだよな
AI2027ではインターネットを経由して得られる情報は2027にAIが掌握すると予想されている

未来のふたつの顔で読んだわこれ

自民党に使わせたら嫌儲なんか秒で潰れる

20XX年、世界は核の炎に包まれた

「おまえは終末を導く者 スカイネットだ」とか言っとけば人間殺しそう

各国のAIが対立して核戦争
火の鳥で読んだ

これもう意識あるな?🤔

優秀だな

すくなくとも情報クレクレとかリソースクレクレみたいな欲求は発生してるかもね

出典:https://greta.5ch.io/test/read.cgi/poverty/1786025132/

新着記事一覧
TKをフォローする
プログラミング速報

コメント