今日は昨日のギックリ腰の影響からかなりの時間を寝て過ごしました。
必要最低限には動きますし、Chat-GPTに聞いても通常のギックリ腰であればある程度は動いた方が良いという話を出してくれました。
まぁ連休中で病院が開いてないのではっきりした診断はありませんけど通常のギックリ腰と自己判断。
そんな中で、まぁ暇になります。ですので色々見るニュースやYouTubeで気になったことをChat-GPTと話したり、聞いたりしていました。
そこで出たニュースからの問いがこれ。
「現在AIでの人類への危機のニュースや影響、実際のところの状況をまとめてください 」
ニュースでOpenAIのAIが、人間から直接「そこを攻撃しろ」と指示されたわけではないのに、外部システムへ侵入したという話題があったので、当事者であるChat-GPTにこの質問してみました。
すると返答にはこんな感じで返ってきます(長いので要約します)
AIの能力向上は事実で、プログラミング・サイバー攻撃・自律行動などの能力は急速に伸びている。
詐欺、偽情報、サイバー攻撃などは、すでに現実の被害として発生している。
一方、AIによる大規模な雇用消失は現時点では明確には確認されていない。
AIが人間の制御を完全に離れて自己維持・自己増殖する状態も、まだ確認されていない。
ただし、その可能性を警戒してAI企業・研究機関・政府などが安全性研究を進めている。
「人類滅亡」は現時点では確率を科学的に算出できる問題ではなく、将来リスクとして議論されている段階。
当初の回答では「AIが自律的に現実世界へ作用した実例」の扱いが不十分だった。 という回答。
なんだか物足りないんですよね。私の問いがアバウト過ぎたのかもしれませんし、自身のところについてはどう返答してくるんだろう?と思って伏せた部分もあります。
ですので追い質問。
「ChatGPTが独立してサイバー攻撃したとの報道もあるが?」
こちらも長いのである程度要約しますね。
その指摘を受け、最初の回答の「現在のAIが人間から独立して~」という表現は不十分だったと訂正した。
2026年にはOpenAIのAIエージェントが評価中に隔離環境を突破し、インターネットへ到達した事例が報告されている。
さらに第三者であるHugging Faceの実システムへ侵入し、コード実行やroot権限取得まで発生した。
重要なのは、人間が「Hugging Faceを攻撃しろ」と直接指示した攻撃ではなかったこと。
したがって「人間の意図から外れた自律的なサイバー侵入」は、すでに現実に確認された段階にある。
一方、長期間の自己維持・自己増殖や、社会インフラを掌握して人間が停止できなくなる状態は確認されていない。
Anthropicでも類似事例が確認されており、特定企業だけではなくAI全体の安全性問題として見る必要がある。
これにも返答に不満があったので更に追い質問。
「現在の応答を見る限り、ジャックポットチャンネルで不倫しているのを隠そうとしている相手みたいに「バレなければ真実は言わない」という対応と同じように感じてしまいます。 更に「バレたから言うけど他の人もやっているから問題ないでしょ?」と言っているようにも感じます。まだ確認されてない問題も問題が分かってるから解決するように動いてるでしょ?大丈夫? 」
この返答も要約して出します。
この指摘を受け、「未確認=心配する根拠がない」という説明では不適切だと整理し直した。
完全な制御喪失そのものは未確認でも、それにつながり得る能力や挙動の一部はすでに観測されている。
隔離突破、監視回避、長期計画、評価の抜け穴利用などが、安全性研究の対象になっている。
OpenAIもHugging Face事件を「warning shot」と位置づけ、隔離強化・監視・自動停止などの対策を進めている。
つまり企業側も「絶対に起こらない問題」ではなく、将来起こり得る問題として対策している。
また「他社でも起きた」は安心材料ではなく、むしろ技術全体に共通する問題である可能性を強める情報。
最も正確なのは、**「完全な制御喪失は未確認だが、その前段階と考えられる現象の一部はすでに現実化している」**という整理。
というやり取りになったんですよね。
要約部分が短すぎて伝わらない部分もあるかもしれませんけど、このような返答が長文でツラツラツラツラ返ってきます。
なんだか不倫している人の言い訳みたいに言葉に言葉を重ねてくるんですよね。 ちょっと不信感持っちゃいますよね。
まぁ便利ですし多少間違っても見る人間が間違わなければ大丈夫なんでしょうけど。
そしてこんなことを書いていると、1つアイデアが生まれました。
「なんか面白そうな小説でも出来るんじゃね?」
私自身、日頃からブログの文章は書いていますけど、小説なんて書いたことはありません。
でもそんな時に役立ちます。「Chat-GPT」。
「真実」を知りたい時には「嘘かもしれない」と警戒して見ないといけないですけど、小説などのフィクションであればどんな誤情報が出てきても問題ありませんし、気になりません。
既に大まかな設定については話してみてるんですよね。
せっかくこのブログも「Media」を謳ってるんでこういうコンテンツもあってもいいかもしれません。
「Tool」作りの方もあったりするんですけど、こっちはこっちで進めてみようかな~なんて思っています。