AIを止めるルールを、人間は一緒に守れるか——AI安全の「Human Governance Problem」

AIが危険な行動をしないようにするには、モデルを安全にすれば十分なのでしょうか。 昨日のHYMY Journal候補では、2023年から2026年9月までにAIへの警鐘がどう具体化してきたかを整理しました。今日は、その一段外側にある問題を考えます。
安全策が分かっても、全員が守るとは限りません
International AI Safety Report 2026は、一般目的AIの能力が急速に向上する一方、リスク管理の枠組みには定量的な基準や証拠の空白が残っていると整理しています。 政策側には難しい時間差があります。十分な証拠を待てば対策が遅れ、早く動けば不確かな規制になる可能性があります。同報告書はこれを「evidence dilemma」と呼んでいます。 さらに2026年9月、問題は一社の安全技術だけでは解けない形で表面化しました。AnthropicのDario Amodeiは、frontier AIの進展を安全対策に合わせるため、企業間の安全協調と政府・国際的な調整を求めました。9月17日には米司法省高官が、AI安全を目的とした企業間協調は直ちに反競争的とは見えないとの見解を示しています。国連のAntónio Guterres事務総長も同日、AI安全をめぐる「race to the bottom」を避けるため国際協力を求めました。 ここで重要なのは、AIの能力だけではありません。 一社だけが慎重になったとき、競合企業が先へ進めばどうなるでしょうか。ある国だけが強い安全基準を守ったとき、別の国が速度を優先すればどうなるでしょうか。 全員にとって事故を避けることが望ましくても、一人ひとりの主体には「自分だけ先に進んだほうが有利」という圧力が生まれ得ます。
HYMYの仮説:Human Governance Problem
ここからは、既存研究をもとにHYMYが置く仮説です。 AI安全には、少なくとも二つの異なる問題があると考えます。 一つは、AIが人間の意図や価値、安全境界から逸脱しないようにする問題です。 もう一つは、人間社会が自分たちで決めた安全境界を、競争のなかでも共同で守り続けられるかという問題です。 後者を、HYMYでは暫定的に「Human Governance Problem」と呼びます。 これは「人間は愚かだから危険だ」という話ではありません。むしろ、個々の企業や国家が合理的に行動しても、全体として望ましくない競争へ向かう可能性があるという制度設計の問題です。 安全技術が存在することと、安全技術が使われ続けることは同じではありません。 ルールがあることと、そのルールを誰も都合よく解除できないことも同じではありません。
AIの外側にも、安全装置が必要になります
この視点に立つと、AI安全の設計対象はモデル内部だけではなくなります。 たとえば、危険な操作には別の承認を必要とすること。権限を段階的に分けること。何が行われたかを後から検証できる記録を残すこと。一人の判断だけでは重要な安全制約を解除できないようにすること。 こうした仕組みは、AIを「善良にする」ためではなく、人間とAIを含むシステム全体に外側から境界を置くためのものです。 ただし、ここにも次の問いが残ります。 その外部制約を決める人間自身が、競争や利益のために解除したくなったらどうするのでしょうか。 AIを制御する問題の先には、人間が自分たち自身をどう統治するかという問題があります。
Moon&Me / HYMYで考えるなら
この問題は国家間のAI競争だけの話ではありません。 HYMYのAI設計でも、「AIにしてほしくないこと」をプロンプトのお願いだけに置かないことが重要です。権限、承認、記録、監査など、AIの外側にある構造として安全境界を持たせます。 そして、その境界を運用者自身が簡単に外せないかまで設計対象にします。 AIが強くなるほど問われるのは、AIをどこまで賢く制御できるかだけではないのかもしれません。 私たち人間が、自分たちで決めた境界を一緒に守れるか。 それもまた、AI時代の安全設計の中心にある問いだとHYMYは考えています。
参考資料
- International AI Safety Report 2026(2026年2月3日): [https://internationalaisafetyreport.org/publication/international-ai-safety-report-2026](https://internationalaisafetyreport.org/publication/international-ai-safety-report-2026) - Reuters, DOJ official says frontier AI labs' safety coordination does not appear anticompetitive(2026年9月17日) - AP, UN chief urges global AI cooperation saying world can't afford a race to the bottom on AI safety(2026年9月17日) - IAPP, AI leaders support call to slow pace of frontier development as safety concerns grow(2026年9月14日) ※「Human Governance Problem」は、これらの研究・政策動向からHYMYが設定した研究仮説であり、確立済みの学術理論名ではありません。