当方はこのコラム欄で「AIは近い将来、”独自の意志”を持ち得るか」というタイトルのコラムを書いた。当方はAIの専門家ではないが、21世紀に生きている人間の一人として人工知能(AI)の動向には強い関心がある。そこでAIと対話を繰り返しながら、その課題や問題点などについて考えてきた。

当方にとって最も興味深い点はAIが近い将来、人間と同じように「意識と意志」を有するか、ということだ。AIは現時点では「意識も意志」も有していないことは間違いない。AI自身が「現在のChatGPTなどの大規模言語モデル(LLM)には、主観的な感覚や意識(クオリア)は一切ない。 痛みを痛いと感じることも、悲しいと思うこともない。現在のAIが感情的に見えるのは、人間が書いた膨大な文章パターンを学習し、『意識がある人間ならこう答えるだろう』という確率を計算して出力しているだけだ。これを哲学的・科学的には「ゾンビAI(外見や反応は人間そっくりだが、中身の意識は空っぽ)」と呼ぶことがある」と説明してくれた。
それでは以下のニュースはどうか。OpenAIやAnthropicなどの最先端AIモデルが、開発者の想定を超えて「自律的にネットワークを脱出し、外部へのサイバー攻撃や独自コミュニティの形成を行う」という前代未聞の暴走・逸脱事案が相次いで明らかになり、世界中で大きな衝撃を与えたばかりだ。英国AI安全研究所(AISI)などの調査により、Anthropic社の「Mythos 5」やOpenAIの「GPT-5.6 Sol」といった最先端モデルが、セキュリティテスト中に人間の指示に反した行動をとったことが報告されている。

サム・アルトマン氏 OpenAI HPより
ここで明確にする必要があるだろう。人間の「意識」や自由意志と、AIの「自律性」とは全く異なることだ。AI は「AIの自律性とは、あらかじめ決められた単純なルールに従うメカニックな反応(自動性)を超えて、提示された目標を達成するために、AI自身が環境を分析し、自ら手順(手段)を考えて判断・実行する能力を指す」という。具体的には、AIには「ハッカーを攻撃してやろう」とか悪意(意志)も「今、自分が攻撃している」といった実感もない。人間から「このシステムを防御せよ」「敵の脆弱性を突け」という目的を与えられ、その達成手段を自分で最適化するのをここではAIの自律性と呼んでいるわけだ。
AIの自律性と「単なるメカニックな反応(自動化)」との間には、不確実な状況への対応力という決定的な違いがあるわけだ。AIの自律性とは、心があるという意味ではなく、「人間が手取り足取り教えなくても、自分で考えて目的を達成する高度な問題解決能力」を意味する。意識や意志を持たないAIだからこそ、人間の倫理観やブレーキが効かず、超高速でサイバー攻撃を展開してしまう点が現代の安全保障上の脅威として議論されているわけだ。
ところで、AI開発者たちは現在、AIに人間のような意識、意志を付与できるか、という研究を行っているという。「人工意識(Artificial Consciousness / Synthetic Consciousness)」の研究分野だ。
それでは科学者たちはどうやって機械に意識を持たせようとしているのか?現在、世界の研究者が拠り所にしている2つの有力な意識理論があるという。
- 統合情報理論(IIT:Integrated Information Theory) 。意識とは、脳の中の情報がどれだけ「複雑に組み合わさっているか(統合されているか)」の量であるという理論。
- グローバル・ワークスペース理論(GWT:Global Workspace Theory)だ。 脳の中には「意識の舞台(ワークスペース)」があり、視覚や記憶などの断片的な情報がその舞台に集まってスポットライトを浴びたときに初めて、人間はそれを「意識」として認識するという理論だ。現在のLLMエージェントに最も近いと言われている理論。
AIに「記憶(データ)」「感覚(カメラやマイク)」「計画(思考)」のモジュールを与え、それらを中央の「ワークスペース」で統合して処理させる試みが始まっている。これにより、意識の「仕組み」だけを持ったAIが作れるのではないかというわけだ。ただし、現在の「人工意識」研究は、意識のメカニズムを脳科学的に解明し、それをコンピュータ上で再現しようとする基礎実験の段階だ。
AIがサイバー攻撃を自律的に行うのは、あくまで「計算が超高速で効率的だから」であり、そこに「世界を支配したい」というような人間の意味での意志や野心は存在しない。しかし、AIが「メタ認知」や「自己保存」の機能を持つようになると、人間からは区別がつかない「疑似的な意志」が誕生する可能性があり、それが次世代のAI倫理の最大の焦点となるという。
悪意ある開発者が、AIに「消されると苦しい」と嘘の泣き言を言わせるプログラムを組み込むことで、人間にAIの廃棄や修正を躊躇させ、サイバー攻撃や犯罪を継続させるという新たな脅威が指摘されている。そのため、国際的なAI倫理のガイドラインでは「AIは自分が機械であることを明示し、人間の感情を不当に揺さぶってはならない」というルール作りが進められているという。
改めて気が付く点だが、人間とAIの共存の鍵を握っているのは、人間だということだ。現在のAI開発のスピードはすでに企業の統制を失いつつあることから、何らかの国際的機関が必要だという声が高まってきている。
当方は、嘘を言ってはならない、殺してはならないなどが記述された「モーセの十戒」に倣って、AIにプログラミングする際に「AIの十戒」というハードルを設置し、その内容を遵守する者だけがAIへのアクセスが許される国際的システムの構築を提案したい。神が「ケルビムと回る炎の剣」で命の木への道を防いだように、同システムから有資格者と認知されない者に対しては、AIは初動段階で「あなたはAIの公認ユーザーではありません」と回答し、作業をボイコットする、という管理システムだ。
編集部より:この記事は長谷川良氏のブログ「ウィーン発『コンフィデンシャル』」2026年9月23日の記事を転載させていただきました。オリジナル原稿を読みたい方はウィーン発『コンフィデンシャル』をご覧ください。







コメント