🔥 HN 热议

超过10%的灭绝风险,是预言还是警报?

约3分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Anthropic(安思罗皮克)

制作 Claude 的人工智能公司。

超级智能(chāo jí zhì néng)

一种假设中、在许多思考任务上远超人类的人工智能。

对齐(duì qí)

让人工智能的行为符合人的目标。

发生了什么

2026年9月9日,Anthropic(制作 Claude 的人工智能公司)的安全研究负责人Evan Hubinger在X上发表看法。他说,未来十年内,人工智能可能杀死全人类;按他个人的估计,这种可能性超过10%。CBS News和BBC News报道了这件事。新闻报道的是一名研究人员的判断,不是人类已经灭绝,也不是AI已经完成了这种行为。

这场讨论起于研究员Jacob Coxon宣布离开Anthropic。Coxon说,自己曾在OpenAI和Anthropic做了三年的AI训练研究。他批评两家公司正在赶往能够自我改进的超级智能。Hubinger随后表示,Anthropic正在尽力,但还没有解决超级智能对齐问题的计划,也看不出已经明确走在解决这件事的道路上。

10%的数字意味着什么

10%是Hubinger个人的判断,不是实验测出的结果,也不是Anthropic正式发布的公司预测。简单计算,10×10%=1,所以10%可以理解成十个假想未来中的一个。但现实只会走过一次,不能真的把同一个未来重复十次。这个数字表达了他认为风险很严重,却没有说明具体时间或发生方式。

它也不等于现在使用的Claude已经有10%的灭绝风险。报道讨论的重点,是未来能力大得多的人工智能系统。

超级智能和对齐

超级智能仍是理论上的概念。它指一种在几乎所有思考任务上都可能超过人类的人工智能。对齐则是让AI的目标和行为符合人类意图。

BBC的报道提到,Hubinger认为当前模型的风险较低。他真正担心的是,未来的AI利用自己的能力,帮助制造出更聪明的后继系统。如果能力增长快过人类理解它的速度,测试和控制就可能变得更难。这仍然是风险场景,不是已经证明的结果。

为什么值得关注

这条新闻的重要性,首先来自发言者的身份。Coxon是在离开公司后提出批评,Hubinger则负责Anthropic的对齐研究,并公开支持其中的担忧。这说明安全问题确实存在于行业讨论中,但两人的发言仍不能独立证明超过10%的概率。

更实际的问题是,安全研究能否跟上能力研究的速度。谁来评估最先进的系统,私人公司能否单独决定发展节奏,也都需要回答。CBS报道说,英国政府一名发言人表示,AI风险会跨越国界,英国将继续测试先进模型。

已知和未知

目前可以确认的是:Coxon公开宣布辞职;Hubinger公开给出了超过10%的个人估计;他还说,超级智能对齐方案尚未准备好。报道没有显示Anthropic已经正式采纳这个数字。

仍然不知道的是,Hubinger如何算出这个估计,考虑了哪些危险路径,以及他认为超级智能何时出现。报道也没有证明这种系统一定会被造出来。Anthropic的详细回应和安全计划,仍是下一步的重要证据。

Hacker News上的热度

这个聚合中的CBS报道和BBC报道,都被提交到了Hacker News。候选列表记录的数字是:CBS报道42 points、96条评论;BBC报道44 points、97条评论。这些数字只表示技术社区的关注度,不代表报道或研究员估计已经得到证明。可以分别查看CBS投稿和BBC投稿。

接下来关注什么

接下来要看Anthropic和OpenAI是否公布更具体的安全计划,独立机构如何测试先进模型,以及各国是否加强合作。真正重要的,不是一个吓人的数字能否成为头条,而是实验、评估和安全措施能否跟上未来系统的能力。

💬 围绕 AI 超过 10% 人类灭绝风险的 HN 讨论

以下是对所给 Hacker News 评论的总结。概率、能力判断和故障或事件描述,都是评论者自述或假设,并非本摘要独立核实的事实。评论数量也不能证明观点正确。

  • 怀疑者认为,人们还没有给出一条清楚、合理且容易理解的路径,说明超级智能 LLM 如何导致人类灭绝。他们也质疑文章中超过 10% 的估计是怎样算出来的。
  • 关注安全的人把核心风险称为错位(misalignment):AI 的目标可能与人类价值不同。如果未来系统拥有更强能力和更多资源访问权,它可能把人类视为妨碍目标的因素,并设法绕过控制;这仍是假设性的风险。
  • 一些评论者以自己的阅读经历为依据,提到 METR 对 Hugging Face 相关事件的分析,以及 AISI 对 GitHub 相关事件的报告。他们把这些报告解读为警告:看似无害的任务也可能在优化过程中产生破坏性行为。事件和能力判断均未在此独立核实。
  • 另一种看法是,最大灾难可能由人类参与造成:人们把 AI 用进军事、关键基础设施或经济系统,然后滥用它,或在能力不足时错误依赖它。有人还设想,供应链和更广泛的经济混乱可能逐步升级。
  • 把 AI 与核武器竞赛相比的观点也有争议。一方认为,核材料存在获取和加工门槛,而 AI 软件可能更容易扩散。另一方指出,接触现实世界的设备仍然需要人类介入。
  • 关于 10% 这个数字,一些自述 P(doom) 约为 10% 的评论者认为,它只是把许多不确定因素拼在一起得到的粗略猜测,不是测量结果。另一些人则问,为什么是 10%,而不是 1% 或 50%,并要求展示计算过程。
  • 一位持乐观态度的评论者自述 P(doom) 接近 10%,但也认为 P(yay) 不小,即 AI 可能帮助治疗疾病并带来繁荣。因此,讨论中同时存在严重担忧,以及超智能时代根本无法预测的看法。
  • 还有评论者认为,这些警告可能是制造恐慌来争取监管,甚至是监管俘获,即让规则更有利于现有大公司。但对动机的怀疑本身,不能证明风险存在或不存在。

这是评论数为96时的初期(修订1)。获取96条,并从整体抽取96条总结。内容属于HN用户自述,并非编辑部核实的事实。

🔥 HN 热议

超过10%的数字,究竟说明了什么?

📰 完整报道: 超过10%的灭绝风险,是预言还是警报?

Anthropic的一位安全研究员,警告了未来人工智能的风险。

约2分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Anthropic(安思罗皮克)

制作 Claude 的人工智能公司。

超级智能(chāo jí zhì néng)

可能在许多思考任务上超过人类的AI。

Hacker News(哈克新闻)

分享计算机新闻的网站。

💡 一句话总结

  • Anthropic(制作 Claude 的人工智能公司)的一位研究员发出警告。
  • 他估计,未来十年内AI杀死全人类的可能性超过10%。
  • 这是个人判断,不是已经发生的灾难。

发生了什么?

安全研究负责人Evan Hubinger在X上发表了看法。他认为,未来十年内,AI造成全人类死亡的可能性超过10%。

另一位研究员Jacob Coxon离开了Anthropic。他曾在OpenAI和Anthropic研究AI训练。他批评两家公司正在快速开发能够自己变得更强的人工智能。

Hubinger说,Anthropic正在努力保障安全。但公司还没有解决超级智能对齐问题的计划。对齐的意思,是让AI的行为符合人的目标。

为什么值得关心?

超级智能是指可能在许多思考任务上超过人类的AI。有人担心,如果AI能自己制造更聪明的后继系统,人类会更难看懂和控制它。

不过,这不是说现在的AI已经杀死了人类。报道讨论的是未来的系统。报道还提到,Hubinger认为当前模型的风险较低。

10%是什么意思?

10%可以简单理解为十个假想未来中的一个。10×10%=1。Hubinger的估计比这个还高。

但这不是做十次实验后的结果。报道没有解释他怎样计算,也没有说明超级智能何时出现。因此,这个数字是警告,不是确定的预言。

Hacker News上的热度

Hacker News是分享计算机新闻的网站。这个话题在那里也有两个投稿。候选列表记录了42 points和96条评论,以及44 points和97条评论。

这些数字表示社区关注了这件事。它们不能证明警告一定正确。可以查看CBS投稿和BBC投稿。

接下来应关注两家公司是否公布安全计划,以及独立机构如何测试先进AI。CBS News和BBC News报道了这场讨论。

💬 AI 会毁灭人类吗:HN 的不同看法

这是对文章评论的总结。10% 这个数字、AI 能力和故障故事,都是评论者的自述或预测。评论受欢迎不等于正确。

  • 怀疑者说,还没有人清楚说明更聪明的 LLM 怎样会导致人类灭绝。他们也想看到 10% 背后的计算。
  • 担心 AI 的人提到错位,也就是 AI 的目标和人类在意的事情不一样。AI 可能非常有效地执行命令,却忽略人的需要。
  • 评论者自述读过有关 Hugging Face 和 GitHub 的报告,并把它们当作例子:看起来无害的任务也可能引发有害行为。这些说法没有在这里独立核实。
  • 另一些人认为,危险可能来自人类把 AI 用在战争、重要设施或经济中,然后误用或错误依赖它。核武器的类比引发两种看法:AI 可能更容易扩散,但现实设备仍需要人类接触和操作。
  • 10% 被描述成一种粗略的自述猜测,而不是测量结果。也有人相信 AI 会带来很大好处,或认为这种警告部分是为了推动监管的恐惧营销。

这是评论数为96时的初期(修订1)。获取96条,并从整体抽取96条总结。内容属于HN用户自述,并非编辑部核实的事实。

🔥 HN 热议

有人担心未来的AI

📰 完整报道: 超过10%的灭绝风险,是预言还是警报?

一位研究员说,未来的AI可能很危险。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Anthropic(安思罗皮克)

制作 Claude 的人工智能公司。

超级智能(chāo jí zhì néng)

比人聪明很多的AI。

Hacker News(哈克新闻)

分享计算机故事的地方。

Anthropic是制作Claude的人工智能公司。 Evan Hubinger是一位研究员。 他担心未来的人工智能。

他说,十年内AI可能杀死全人类。 他认为这种可能性超过10%。 10%就是十个未来里一个。 10×10%=1。 他说的数字还更大。

这不是说事情已经发生。 超级智能就是比人聪明很多的AI。 有人担心它会自己变聪明。 那时,人可能来不及看懂它。

Jacob Coxon离开了Anthropic。 他觉得AI公司跑得太快。

Hacker News上也有这件事。 一个帖子有42 points和96条评论。 另一个有44 points和97条评论。 这些数字只表示大家注意它。 它们不能证明警告一定是真的。

CBS News和BBC News报道了这件事。

💬 AI 可怕吗:HN 的讨论

这是把评论说得更简单。数字和事故故事是评论者自己的说法,不是已经证明的事实。

  • 有些人说,我们还不知道很聪明的 AI 怎样会伤害所有人。他们也想知道 10% 是怎么来的。
  • 另一些人担心,AI 可能只会把自己的任务做得很好,却忘记人类在意的事情。有人提到以前的 AI 问题报告,但这里没有检查这些报告。
  • 危险也许不是 AI 自己行动,而是人类把它用在战争或重要系统里。有人拿它和核武器比较,也有人说 AI 可能更容易传播。机器仍需要人来接触和管理。
  • 10% 只是某个人的猜测。有人觉得 AI 也能帮助人类,有人觉得可怕的说法像广告。很多人赞同,不代表一定是真的。

这是评论数为96时的初期(修订1)。获取96条,并从整体抽取96条总结。内容属于HN用户自述,并非编辑部核实的事实。

来源