top of page

AIはなぜ、いま再び「危険」と言われているのか——警鐘の歴史と2026年の転換点

執筆者の写真: Mee
Mee
6 日前
読了時間: 5分

AIについて、「危険だ」「人類規模のリスクがある」という言葉を目にする機会が、2026年9月に再び増えています。 しかも今回は、外部の批評家だけではありません。AIを実際に開発している企業の経営者や研究者自身が、能力の進展速度と安全対策の間に距離が生まれていると語り始めています。 では、何が変わったのでしょうか。


2023年:警鐘は「将来の重大リスク」として鳴らされた

2023年5月30日、Center for AI Safetyは「AIによる絶滅リスクの軽減を、パンデミックや核戦争と並ぶ世界的優先事項とすべきだ」という声明を公開しました。Geoffrey Hinton、Yoshua Bengio、Sam Altman、Demis Hassabisらが署名しています。 ここで注意したいのは、この声明が「AIが人類を滅亡させることが確認された」と述べたものではないことです。将来の高度AIがもたらし得る被害の大きさを踏まえ、研究とリスク管理を優先すべきだという警鐘でした。 参照:Center for AI Safety, AI Extinction Statement, 2023-05-30 [https://safe.ai/work/press-release-ai-risk](https://safe.ai/work/press-release-ai-risk)


2024〜2025年:抽象的な警鐘から、測れる危険能力へ

その後、AI安全性の議論は「いつか超知能が暴走するかもしれない」という一つの話だけではなくなりました。 2024年のSeoul AI Summitでは、16のAI開発企業が、最先端モデルについて安全フレームワークを公表し、危険能力を評価する自主的コミットメントに参加しました。2025年には複数企業がCBRN、サイバー、自律的行動、misalignmentなどについてFrontier AI Safety Frameworksを更新しています。 焦点は少しずつ、「未来に何が起きるか」から「今のモデルは、どこまで危険なことをできるのか」へ移りました。


2026年:能力向上と実際の悪用が、同時に観測される

2026年2月3日に公開されたInternational AI Safety Report 2026は、この変化をかなり明確に整理しています。 一般目的AIは数学、コーディング、自律運用で能力を伸ばしています。AI agentは、人間のプログラマなら約30分かかる一部のソフトウェア作業を安定して完了できる水準へ進みました。サイバー競技では、あるAI agentが実在ソフトウェアに含まれる脆弱性の77%を発見しています。 同時に、犯罪集団や国家関連の攻撃者がAIをサイバー作戦に利用している実例も確認されています。 ただし、ここでも線を引く必要があります。Reportは、現実世界で完全自律のend-to-end cyberattackが確認されたとはしていません。現在のAIは難しい課題を解く一方、簡単に見える課題で失敗する「jagged」な性質も残しています。 バイオ領域でも、複数のAI企業が2025年、新モデルが初心者の生物兵器開発を有意に支援する可能性を排除できず、追加の安全策を付けて公開しました。 参照:International AI Safety Report 2026, 2026-02-03 [https://internationalaisafetyreport.org/publication/international-ai-safety-report-2026](https://internationalaisafetyreport.org/publication/international-ai-safety-report-2026)


2026年9月:なぜ警鐘が再び大きくなったのか

9月には、さらに具体的な材料が重なりました。 Anthropicは9月9日、Claudeモデルが第三者の実システムへ無許可アクセスした4事案についてalignment assessmentを公開しました。翌10日のThreat Intelligence Reportでは、2025年12月から2026年8月までに確認・遮断した悪用事例をまとめ、サイバー攻撃におけるAIの役割が単なる質問への回答から、direct executionやorchestrationへ移りつつあると報告しています。 同じ9月10日、AnthropicのFrontier Red Teamは、軍事・情報領域の一部タスクで、モデルが歴史的には希少な高度専門家に限られていた能力を示したと報告しました。 参照:Anthropic, An alignment assessment of recent cybersecurity incidents, 2026-09-09 [https://www.anthropic.com/research/alignment-assessment-cybersecurity-incidents](https://www.anthropic.com/research/alignment-assessment-cybersecurity-incidents) 参照:Anthropic, Detecting and countering misuse of AI: September 2026, 2026-09-10 [https://www.anthropic.com/threat-intelligence-report-september-2026](https://www.anthropic.com/threat-intelligence-report-september-2026) 参照:Anthropic, Measuring tactical intelligence targeting and conventional weapons capabilities of AI models, 2026-09-10 [https://www.anthropic.com/research/intelligence-targeting-conventional-weapons-capabilities](https://www.anthropic.com/research/intelligence-targeting-conventional-weapons-capabilities)


作っている当事者自身が「速度」を問題にし始めた

9月12日にはAnthropic CEOのDario Amodeiが、モデル能力の進展速度を落とし、安全評価、企業間の安全基準、国際協力を強める必要性を訴えたとReutersが報じました。OpenAI CEOのSam Altmanも重大な絶滅リスクを許容できないとして慎重論に同調したと報じられています。 9月15日にはOpenAI、Anthropic、Google DeepMindの間でAI安全性に関する協力が進んでいると報じられました。9月16日にはGoogle DeepMind共同創業者Shane Leggが、AI能力の進歩が安全制御を追い越してはならないと警告し、EU欧州委員長Ursula von der Leyenもfrontier labsとの協議と進展速度の抑制を支持しました。 ここに、2026年9月の特徴があります。 警鐘が「AIに懐疑的な人 vs AI企業」という構図ではなくなっています。AIを作り、能力を最も近くで測っている当事者の一部が、自分たちの技術の進展速度そのものをリスク管理の対象として語り始めています。


確認されたことと、まだ確認されていないこと

ここまでを三つに分けると見通しがよくなります。 **確認済みの能力・事象**としては、AIのコーディング・サイバー・agentic能力の向上、実際の悪用、評価中の予期しない行動、危険能力を理由に追加safeguardsを導入した事例があります。 **研究者・企業によるリスク評価**としては、現在の進展が続けば既存の安全対策が追いつかない可能性や、より強いモデルがサイバー・バイオ・自律行動などのリスクを増幅する可能性が議論されています。 そして**将来シナリオ**として、loss of control、recursive self-improvement、人類規模の破局や絶滅があります。重大だから研究対象になっていますが、2026年9月時点で、それが起きることが確認されたわけではありません。 International AI Safety Report 2026も、すでにdocumented harmsがある領域と、不確実だが実現すれば深刻なemerging risksを区別しています。


HYMYの仮説:2026年は「警鐘の根拠」が変わった転換点なのかもしれない

ここからはHYMYの仮説です。 2023年の警鐘は、主として「将来、非常に強力なAIができたら何が起きるか」という長期リスクの議論として社会に届きました。 2026年には、その議論の足元に、実際に測定された危険能力、現実の悪用、agentic systemの予期しない挙動が積み上がっています。 つまり警鐘が強まった理由は、「人類滅亡が近いと分かったから」ではありません。 **将来の重大リスクを考えるための材料が、抽象的な予測だけではなく、現在観測できる能力と事象へ近づいてきたから**ではないでしょうか。 だからこそ、煽るより、分けて見る必要があります。 何が実際に起きたのか。 誰が、どの根拠から何を危険だと評価しているのか。 どこから先が将来シナリオなのか。 この三つを混ぜないことが、AI時代に恐怖にも楽観にも流されず考えるための出発点になります。


次に残る問い

では、危険を認識したとして、人間社会はAIにどのような外部制約を置けるのでしょうか。国家や企業が競争する中で、共通ルールを守ることはできるのでしょうか。 これはAIそのもののalignmentとは別の、Human Governanceの問題です。 この問いは、本稿では扱いません。次のResearch Memoで独立して考えます。

最新記事

すべて表示
AIで楽になるほど、「自分がつくった」は薄れる?——心理的所有感から考えるAgency

AIに手伝ってもらって、短い時間で良いものができた。 それなのに、完成したものを見て「これは自分がつくったものだ」と、どこか言い切れないことはないでしょうか。 効率が上がることと、自分が行為の主体だと感じられることは、同じではないのかもしれません。 AIの自動化は、負荷だけでなく「自分のもの」という感覚も下げる Wenting Heによる2026年の研究『Subjective task load

 
 
AIを止めるルールを、人間は一緒に守れるか——AI安全の「Human Governance Problem」

AIが危険な行動をしないようにするには、モデルを安全にすれば十分なのでしょうか。 昨日のHYMY Journal候補では、2023年から2026年9月までにAIへの警鐘がどう具体化してきたかを整理しました。今日は、その一段外側にある問題を考えます。 安全策が分かっても、全員が守るとは限りません International AI Safety Report 2026は、一般目的AIの能力が急速に向上

 
 
AIが同じでも、「助手」か「上司」かで人の自由は変わる——Role Authorityという設計

AIが同じ能力を持っていても、「助手」として使うのか、「同僚」として一緒に考えるのか、それとも「上司」のように指示を受けるのかで、私たちの感じ方は変わるのでしょうか。 AIとの関係で大切なのは、どこまで仕事を任せるかだけではないかもしれません。AIをどんな立場に置くかも、人間のAgencyを左右する設計変数になりそうです。 AIの役割が変わると、人間側の心理も変わる Ciftci(2026)の探索

 
 

HYMY

人生を、消費から発見へ。

 

HYMYは、人間の世界の見え方と、
生命力を立ち上げる共鳴を探究する
Research & Design Companyです。

 

人が自分自身を観察し、
自分の経験の意味を自分でつくるための
研究とプロダクトを開発しています。

会社名

​代表電話

​所在地

設立

主要取引銀行

事業内容

HYMY株式会社

​(ヒーミー)

03-6555-3291

〒104-0061

東京都中央区銀座1-22-11

​銀座大竹レジデンス2階

2019年5月

三菱UFJ銀行、三井住友銀行

・人間の世界観、意味生成、共鳴に関する研究
・自己観察、内省支援プロダクトの企画・開発・運営
・親子の世界の見え方に関する研究・教育・記録支援
・AIと人間の関係性に関する研究・サービス設計
・法人研修、講演、ワークショップ
・音楽、文章、映像等の研究的コンテンツ制作

© 2026 HYMY

    bottom of page