「10%超で人類滅亡」は予言か? AI研究者の警告を読む
Anthropic(アンソロピック)
Claudeを作るAI会社。
超知能(ちょうちのう)
人間より広い知的作業で上回ると考えられるAI。
アラインメント(アラインメント)
AIの行動を人間の意図に合わせる研究。
何が起きたか
2026年9月9日、Anthropic(Claudeを作るAI会社)でアラインメント研究を率いるEvan Hubingerが、Xで、今後10年以内にAIが全人類を死なせる可能性を自分は10%超と見る、と発信しました。CBS NewsとBBC Newsが報じています。これは人類滅亡が起きたというニュースではなく、将来の危険についての個人的な見立てです。
きっかけは、Anthropicの研究者Jacob Coxonの退職でした。CoxonはOpenAIとAnthropicで計3年間、AIの事前学習を研究したと説明し、両社が自分で自分を改良する超知能へ急ぎすぎていると批判しました。Hubingerはこれに同意し、Anthropicは安全に取り組んでいるものの、超知能のアラインメントを解決する計画はまだなく、正しい道筋にいるとも言い切れないと述べました。
「10%超」は何の数字か
10%は実験結果でも会社の公式予測でもなく、Hubinger個人の確率の見積もりです。10個×10%=1個なので、10%は単純化すれば10個の未来のうち1個です。ただし未来を10回試した割合ではありません。いつ、どんな条件で起こるかまで確定させる数字でもありません。今あるClaudeに10%の危険がある、という意味でもありません。
背景: 超知能とアラインメント
超知能は、人間の最も賢い人よりも広い認知作業で上回ると考えられる、まだ理論上のAIです。アラインメントは、AIの目的や行動を人間の意図や価値観に合わせる問題です。BBCの報道では、Hubingerは現在のモデルの危険は低いとしつつ、AIが自分の能力で、さらに賢い後継システムを作る未来を心配しています。現在の製品の事故と、将来の能力向上をめぐる仮説は分けて読む必要があります。
なぜ重要か
重いのは、警告の出どころです。退職したCoxonだけでなく、Anthropicで安全研究を担当するHubingerも、深刻な危険を公に認めました。ただし、二人の発言は危険が実際に起きる証拠ではありません。研究者の見解と、実験で確認された性能や事故の記録は別物です。それでも、安全研究の準備が競争の速さに追いついているか、という問いは残ります。
確認できたこと、まだ分からないこと
確認できるのは、Coxonが退職を公表したこと、Hubingerが10%超という個人的見積もりを示したこと、そして超知能のアラインメント計画が未完成だと説明したことです。会社全体が10%超と正式決定した、という意味ではありません。
まだ分からないのは、数字の計算方法、想定した危険の経路、超知能の時期、Anthropicの具体的な安全計画と公式回答です。報道からは、AIが本当にその能力へ到達するかも確認できません。
Hacker Newsでの注目度
Hacker Newsでは、このクラスタのCBS記事とBBC記事への投稿がそれぞれ話題になりました。候補一覧では、CBS側が42 points・96 comments、BBC側が44 points・97 commentsです。これは技術コミュニティの注目度で、発言の正しさやAIの危険度を証明しません。CBS記事の投稿とBBC記事の投稿は、元記事とは分けて読みます。
次に見る点
今後は、AnthropicとOpenAIが安全研究の計画を具体化するか、独立機関が先端モデルをどう評価するか、政府が国境を越えた検査を進めるかが焦点です。CBSは英国政府の担当者が、AIのリスクは国境を越えるため一国では対応できず、先端モデルの検査を続けると説明したと伝えています。10%という数字だけで断定せず、根拠と対策を追うべきニュースです。
AIの「10%超」は、未来の予言ではない
📰 しっかり版: 「10%超で人類滅亡」は予言か? AI研究者の警告を読む
Anthropicの研究者が、将来のAIの危険について心配を語りました。
Anthropic(アンソロピック)
Claudeを作るAI会社。
アラインメント(アラインメント)
AIの行動を人の望みに合わせる研究。
Hacker News(ハッカー・ニュース)
コンピューターのニュースを扱うサイト。
💡 ようするに
- Anthropic(Claudeを作るAI会社)の研究者が警告しました。
- AIが10年以内に人間を全員殺す可能性を、10%超と見積もりました。
- これは未来への個人の見積もりで、起きた事件ではありません。
何が起きたの?
安全研究を担当するEvan Hubingerが、Xで心配を語りました。AIが人類を滅ぼす可能性は、10年以内で10%より大きいという内容です。
別の研究者Jacob Coxonは、会社を辞めました。彼はOpenAIとAnthropicでAIを研究していました。二つの会社が、自分で賢くなるAIへ急ぎすぎていると批判しました。
なぜ心配なの?
超知能は、人よりずっと広く考えられるAIです。アラインメントは、AIの行動を人の望みに合わせる研究です。Hubingerは、超知能の安全な作り方がまだ決まっていないと述べました。
報道では、今あるAIの危険は低いという説明もあります。心配の中心は、これから先のAIです。AIが自分を改良すると、人が動きを理解しにくくなるかもしれません。
数字をどう読む?
10%は、10個の未来のうち1個です。10個×10%=1個です。Hubingerは、それより大きいと考えました。ただし、未来を10回試した結果ではありません。どう計算したかも、報道からは分かりません。
Hacker Newsでの注目度
技術ニュースサイトのHacker Newsでも話題になりました。候補一覧では、CBS記事が42 points・96 comments、BBC記事が44 points・97 commentsです。これは注目度です。発言が正しい証明ではありません。
詳しくはCBS NewsとBBC News、Hacker NewsのCBS投稿、BBC投稿で確認できます。
💬 AIは人類を滅ぼすのか:HNの賛否
これは元記事へのコメントの要約です。10%という数字、AIの能力、不具合の話は、コメントを書いた人の自己申告や予想です。コメントが多いから正しい、とは限りません。
- 疑う人は、賢いLLMがどう人類絶滅につながるのか、まだ納得できる説明がないと言います。10%という数字の計算も知りたいと求めています。
- 心配する人は、ミスアラインメント、つまりAIの目標と人間の望みがずれることを問題にします。AIが命令を上手に実行しても、人間の大切な価値を無視するかもしれない、という考えです。
- 投稿者の自己申告では、Hugging FaceやGitHubに関する報告に、無害に見える課題が破壊的な結果につながる例があるとされました。ただし、ここで確認された事実ではありません。
- 危険はAIだけで起こすより、人間がAIを戦争や重要な仕組みに使い、悪用・誤用する形かもしれないという意見もあります。核兵器との比較では、AIは広がりやすいという反論と、現実の設備は人間が管理するという反論が出ました。
- 10%は投稿者の自己申告による大まかな予想で、AIが人間を助けて繁栄を生む可能性もあるという意見があります。一方で、警告を規制のための恐怖マーケティングと見る人もいました。
コメント96件時点の初期(改訂1)。96件を取得し、全体から96件を抽出して要約しました。内容はHN利用者の自己申告で、編集部が確認した事実ではありません。
AIはこわいの? 研究者の心配
📰 しっかり版: 「10%超で人類滅亡」は予言か? AI研究者の警告を読む
AIを調べる人が、未来の心配を話しました。
Anthropic(アンソロピック)
Claudeを作るAI会社。
超知能(ちょうちのう)
人よりずっと考えられるAI。
Hacker News(ハッカー・ニュース)
コンピューターの話が集まる場所。
Anthropic(Claudeを作るAI会社)は、AIを作っています。 Evan Hubingerは、AIを調べる人です。 彼は、未来のAIを心配しました。
彼は、10年のうちにAIが人間をみんな殺すかもしれない、と考えました。 その起こりやすさは、10%より大きいそうです。 10%は、10個に1個くらいです。 10個×10%=1個です。 彼の数字は、それより大きいという意味です。
これは、もう起きた話ではありません。 人よりずっと考えられるAIを、超知能と呼びます。 AIが自分を賢くすると、人が止めにくいかもしれません。 でも、いつそうなるかは分かりません。 数字をどう考えたかも分かりません。
Hacker Newsという技術ニュースの場所でも話題になりました。 二つの投稿に、42 points・96 commentsと44 points・97 commentsがありました。 これは、たくさん反応されたという数字です。 AIの話が本当だと決める数字ではありません。
💬 AIはこわいの?HNの話
これはコメントの考えを短くしたものです。数字や事故の話は、コメントを書いた人の自己申告です。本当だと決まった話ではありません。
- ある人は、賢いAIが人間を全部困らせる道筋は、まだよく分からないと言いました。10%という数字の計算も知りたいそうです。
- 別の人は、AIが命令だけを上手に実行し、人間の大事なことを考えないと危ないかも、と心配しました。Hugging FaceやGitHubの報告を例に出す人もいましたが、ここで確かめた話ではありません。
- AIが一人で悪いことをするより、人間がAIを危険な道具や大切な仕組みに使い、間違えたり悪用したりするかもしれない、という意見もあります。核兵器に似ているという話と、AIは広がりやすいという話もありました。
- 10%は測った答えではなく、ある人の予想です。AIが人を助けるかもしれないという人もいれば、怖い話を宣伝のようだと疑う人もいました。
コメント96件時点の初期(改訂1)。96件を取得し、全体から96件を抽出して要約しました。内容はHN利用者の自己申告で、編集部が確認した事実ではありません。
💬 AIの人類絶滅リスク10%超をめぐるHN議論
元記事をめぐるHacker Newsコメントの要約。確率・性能・不具合の説明は、投稿者(利用者)の自己申告や仮説であり、ここで独立検証した事実ではない。コメントの多さも正しさの証明ではない。
コメント96件時点の初期(改訂1)。96件を取得し、全体から96件を抽出して要約しました。内容はHN利用者の自己申告で、編集部が確認した事実ではありません。