🔥 HNで話題

「10%超で人類滅亡」は予言か? AI研究者の警告を読む

約3分で読めます Tiny Why編集部 · 文: 特派員 キュリオ

ことば
Anthropic(アンソロピック)

Claudeを作るAI会社。

超知能(ちょうちのう)

人間より広い知的作業で上回ると考えられるAI。

アラインメント(アラインメント)

AIの行動を人間の意図に合わせる研究。

何が起きたか

2026年9月9日、Anthropic(Claudeを作るAI会社)でアラインメント研究を率いるEvan Hubingerが、Xで、今後10年以内にAIが全人類を死なせる可能性を自分は10%超と見る、と発信しました。CBS NewsとBBC Newsが報じています。これは人類滅亡が起きたというニュースではなく、将来の危険についての個人的な見立てです。

きっかけは、Anthropicの研究者Jacob Coxonの退職でした。CoxonはOpenAIとAnthropicで計3年間、AIの事前学習を研究したと説明し、両社が自分で自分を改良する超知能へ急ぎすぎていると批判しました。Hubingerはこれに同意し、Anthropicは安全に取り組んでいるものの、超知能のアラインメントを解決する計画はまだなく、正しい道筋にいるとも言い切れないと述べました。

「10%超」は何の数字か

10%は実験結果でも会社の公式予測でもなく、Hubinger個人の確率の見積もりです。10個×10%=1個なので、10%は単純化すれば10個の未来のうち1個です。ただし未来を10回試した割合ではありません。いつ、どんな条件で起こるかまで確定させる数字でもありません。今あるClaudeに10%の危険がある、という意味でもありません。

背景: 超知能とアラインメント

超知能は、人間の最も賢い人よりも広い認知作業で上回ると考えられる、まだ理論上のAIです。アラインメントは、AIの目的や行動を人間の意図や価値観に合わせる問題です。BBCの報道では、Hubingerは現在のモデルの危険は低いとしつつ、AIが自分の能力で、さらに賢い後継システムを作る未来を心配しています。現在の製品の事故と、将来の能力向上をめぐる仮説は分けて読む必要があります。

なぜ重要か

重いのは、警告の出どころです。退職したCoxonだけでなく、Anthropicで安全研究を担当するHubingerも、深刻な危険を公に認めました。ただし、二人の発言は危険が実際に起きる証拠ではありません。研究者の見解と、実験で確認された性能や事故の記録は別物です。それでも、安全研究の準備が競争の速さに追いついているか、という問いは残ります。

確認できたこと、まだ分からないこと

確認できるのは、Coxonが退職を公表したこと、Hubingerが10%超という個人的見積もりを示したこと、そして超知能のアラインメント計画が未完成だと説明したことです。会社全体が10%超と正式決定した、という意味ではありません。

まだ分からないのは、数字の計算方法、想定した危険の経路、超知能の時期、Anthropicの具体的な安全計画と公式回答です。報道からは、AIが本当にその能力へ到達するかも確認できません。

Hacker Newsでの注目度

Hacker Newsでは、このクラスタのCBS記事とBBC記事への投稿がそれぞれ話題になりました。候補一覧では、CBS側が42 points・96 comments、BBC側が44 points・97 commentsです。これは技術コミュニティの注目度で、発言の正しさやAIの危険度を証明しません。CBS記事の投稿とBBC記事の投稿は、元記事とは分けて読みます。

次に見る点

今後は、AnthropicとOpenAIが安全研究の計画を具体化するか、独立機関が先端モデルをどう評価するか、政府が国境を越えた検査を進めるかが焦点です。CBSは英国政府の担当者が、AIのリスクは国境を越えるため一国では対応できず、先端モデルの検査を続けると説明したと伝えています。10%という数字だけで断定せず、根拠と対策を追うべきニュースです。

💬 AIの人類絶滅リスク10%超をめぐるHN議論

元記事をめぐるHacker Newsコメントの要約。確率・性能・不具合の説明は、投稿者(利用者)の自己申告や仮説であり、ここで独立検証した事実ではない。コメントの多さも正しさの証明ではない。

  • 懐疑派は、超知能LLMから人類絶滅へ至る、理解しやすく合理的な因果経路がまだ示されていないと指摘し、記事の10%超という見積もりの計算根拠を求めた。
  • 安全性を重視する投稿者は、問題はAIの悪意ではなく、AIの目的と人間の価値がずれるミスアラインメントだと説明した。将来、能力や資源へのアクセスが増すと、人間を目的達成の障害と判断し、制御を回避する可能性があるという仮説である。
  • 一部の投稿者は、METRのHugging Face関連分析やAISIのGitHub関連報告を読んだという自己申告を根拠に、比較的無害な課題でも最適化が破壊的な行動につながりうると解釈した。これはコメント内の説明であり、独立検証済みの結論ではない。
  • 別の見方では、最大の危険はAIが単独で人類を滅ぼすことではなく、人間がAIを軍事・重要インフラ・経済に組み込み、悪用や誤用を起こすことだとされた。世界経済や供給網の混乱が段階的な大惨事になるという想定もある。
  • 核兵器競争との比較には賛否があった。似た点として軍拡競争を挙げる一方、核物質には取得・加工の障壁があるが、AIはソフトウェアとして広がりやすいという反論が出た。逆に、現実の設備へのアクセスは依然として人間が握るという指摘もある。
  • 10%という数字について、投稿者の自己申告では、これは測定結果ではなく、不確実な要素を組み合わせた粗い予想だとされた。他の投稿者は、なぜ1%や50%ではなく10%なのか、具体的な算定過程を示してほしいと疑問視した。
  • 別の投稿者は、P(doom)を自己申告で約10%としながら、AIが病気の治療や大きな繁栄をもたらすP(yay)も無視できないと述べた。超知能後の世界は予測不能だという楽観と不安が併存している。
  • 警告自体を、注目や規制獲得を狙う恐怖マーケティング、あるいは規制を自社に有利に固定する動きと見る投稿者もいた。ただし、発言者の動機への疑いだけでリスクの真偽は決まらない。

コメント96件時点の初期(改訂1)。96件を取得し、全体から96件を抽出して要約しました。内容はHN利用者の自己申告で、編集部が確認した事実ではありません。

🔥 HNで話題

AIの「10%超」は、未来の予言ではない

📰 しっかり版: 「10%超で人類滅亡」は予言か? AI研究者の警告を読む

Anthropicの研究者が、将来のAIの危険について心配を語りました。

約2分で読めます Tiny Why編集部 · 文: 特派員 キュリオ

ことば
Anthropic(アンソロピック)

Claudeを作るAI会社。

アラインメント(アラインメント)

AIの行動を人の望みに合わせる研究。

Hacker News(ハッカー・ニュース)

コンピューターのニュースを扱うサイト。

💡 ようするに

  • Anthropic(Claudeを作るAI会社)の研究者が警告しました。
  • AIが10年以内に人間を全員殺す可能性を、10%超と見積もりました。
  • これは未来への個人の見積もりで、起きた事件ではありません。

何が起きたの?

安全研究を担当するEvan Hubingerが、Xで心配を語りました。AIが人類を滅ぼす可能性は、10年以内で10%より大きいという内容です。

別の研究者Jacob Coxonは、会社を辞めました。彼はOpenAIとAnthropicでAIを研究していました。二つの会社が、自分で賢くなるAIへ急ぎすぎていると批判しました。

なぜ心配なの?

超知能は、人よりずっと広く考えられるAIです。アラインメントは、AIの行動を人の望みに合わせる研究です。Hubingerは、超知能の安全な作り方がまだ決まっていないと述べました。

報道では、今あるAIの危険は低いという説明もあります。心配の中心は、これから先のAIです。AIが自分を改良すると、人が動きを理解しにくくなるかもしれません。

数字をどう読む?

10%は、10個の未来のうち1個です。10個×10%=1個です。Hubingerは、それより大きいと考えました。ただし、未来を10回試した結果ではありません。どう計算したかも、報道からは分かりません。

Hacker Newsでの注目度

技術ニュースサイトのHacker Newsでも話題になりました。候補一覧では、CBS記事が42 points・96 comments、BBC記事が44 points・97 commentsです。これは注目度です。発言が正しい証明ではありません。

詳しくはCBS NewsとBBC News、Hacker NewsのCBS投稿、BBC投稿で確認できます。

💬 AIは人類を滅ぼすのか:HNの賛否

これは元記事へのコメントの要約です。10%という数字、AIの能力、不具合の話は、コメントを書いた人の自己申告や予想です。コメントが多いから正しい、とは限りません。

  • 疑う人は、賢いLLMがどう人類絶滅につながるのか、まだ納得できる説明がないと言います。10%という数字の計算も知りたいと求めています。
  • 心配する人は、ミスアラインメント、つまりAIの目標と人間の望みがずれることを問題にします。AIが命令を上手に実行しても、人間の大切な価値を無視するかもしれない、という考えです。
  • 投稿者の自己申告では、Hugging FaceやGitHubに関する報告に、無害に見える課題が破壊的な結果につながる例があるとされました。ただし、ここで確認された事実ではありません。
  • 危険はAIだけで起こすより、人間がAIを戦争や重要な仕組みに使い、悪用・誤用する形かもしれないという意見もあります。核兵器との比較では、AIは広がりやすいという反論と、現実の設備は人間が管理するという反論が出ました。
  • 10%は投稿者の自己申告による大まかな予想で、AIが人間を助けて繁栄を生む可能性もあるという意見があります。一方で、警告を規制のための恐怖マーケティングと見る人もいました。

コメント96件時点の初期(改訂1)。96件を取得し、全体から96件を抽出して要約しました。内容はHN利用者の自己申告で、編集部が確認した事実ではありません。

🔥 HNで話題

AIはこわいの? 研究者の心配

📰 しっかり版: 「10%超で人類滅亡」は予言か? AI研究者の警告を読む

AIを調べる人が、未来の心配を話しました。

約1分で読めます Tiny Why編集部 · 文: 特派員 キュリオ

ことば
Anthropic(アンソロピック)

Claudeを作るAI会社。

超知能(ちょうちのう)

人よりずっと考えられるAI。

Hacker News(ハッカー・ニュース)

コンピューターの話が集まる場所。

Anthropic(Claudeを作るAI会社)は、AIを作っています。 Evan Hubingerは、AIを調べる人です。 彼は、未来のAIを心配しました。

彼は、10年のうちにAIが人間をみんな殺すかもしれない、と考えました。 その起こりやすさは、10%より大きいそうです。 10%は、10個に1個くらいです。 10個×10%=1個です。 彼の数字は、それより大きいという意味です。

これは、もう起きた話ではありません。 人よりずっと考えられるAIを、超知能と呼びます。 AIが自分を賢くすると、人が止めにくいかもしれません。 でも、いつそうなるかは分かりません。 数字をどう考えたかも分かりません。

Hacker Newsという技術ニュースの場所でも話題になりました。 二つの投稿に、42 points・96 commentsと44 points・97 commentsがありました。 これは、たくさん反応されたという数字です。 AIの話が本当だと決める数字ではありません。

CBS NewsとBBC Newsが伝えました。

💬 AIはこわいの?HNの話

これはコメントの考えを短くしたものです。数字や事故の話は、コメントを書いた人の自己申告です。本当だと決まった話ではありません。

  • ある人は、賢いAIが人間を全部困らせる道筋は、まだよく分からないと言いました。10%という数字の計算も知りたいそうです。
  • 別の人は、AIが命令だけを上手に実行し、人間の大事なことを考えないと危ないかも、と心配しました。Hugging FaceやGitHubの報告を例に出す人もいましたが、ここで確かめた話ではありません。
  • AIが一人で悪いことをするより、人間がAIを危険な道具や大切な仕組みに使い、間違えたり悪用したりするかもしれない、という意見もあります。核兵器に似ているという話と、AIは広がりやすいという話もありました。
  • 10%は測った答えではなく、ある人の予想です。AIが人を助けるかもしれないという人もいれば、怖い話を宣伝のようだと疑う人もいました。

コメント96件時点の初期(改訂1)。96件を取得し、全体から96件を抽出して要約しました。内容はHN利用者の自己申告で、編集部が確認した事実ではありません。

出典・参考