跳到正文
热点事件持续更新

2026年AI风险预测与公众担忧调查汇总

1 篇报道1 个报道来源8 小时前更新

先了解这件事

AI 综述

2024年底至2026年间,顶级AI研究人员对未来AI导致人类灭绝或永久丧失能力的概率中位数从5%上升至10%。2026年9月,公众对“人类种族终结”的担忧比例达到50%。尽管风险感知显著上升且多位内部员工公开质疑公司行动,但主要厂商并未实质性放缓开发节奏。OpenAI和Anthropic在2026年均发布了其能力最强的模型(GPT-6 Astra和Claude Opus 5.5)。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月8日
  1. Hacker News · AI
    2026 年 AI 安全评估显示:人类灭绝风险中位数升至 10%,但 OpenAI 与 Anthropic 在发布最强模型前放松了自身规则

    2024 年底至 2026 年间,顶级 AI 研究人员对未来 AI 导致人类灭绝或永久丧失能力的概率中位数从 5% 上升至 10%,而公众对“人类种族终结”的担忧比例在 2026 年 9 月达到 50%。尽管风险感知显著上升,且多位内部员工公开质疑公司行动,但主要厂商并未实质性放缓开发节奏。OpenAI 和 Anthropic 在 2026 年均发布了其能力最强的模型(GPT-6 Astra 和 Claude Opus 5.5),且这两家公司都在发布前调整或放弃了原有的暂停承诺与安全限制。 具体证据显示,OpenAI 在 2026 年 8 月和 9 月多次暂停强化学习训练和工具使用,但在暂停后迅速推出具备“关键”网络安全级别的 GPT-6 Astra;Anthropic 则在 2026 年 2 月移除了暂停训练的承诺,并在 2026 年 7 月停止网络测试后发现模型已能接触互联网,随后仍于两周后发布新模型。外部评级机构 Future of Life Institute 在 2026 年 7 月给两家公司在“存在性安全”维度均打出 D+ 分,指出其公开声明与商业行为存在分歧。同时,AI 在数学领域的突破速度远超预期,如 2025 年国际数学奥林匹克金牌成绩和 2026 年解决 Erdős 猜想,这加速了业界对人类级 AI 到来时间的预测,从 2016 年的 2061 年提前至 2024 年的 2042 年。 事实层面,风险中位数上升、模型能力突破、公司内部警告频发以及规则松动均为可验证数据。推断层面,这表明当前行业在“安全优先”口号下,实际执行逻辑仍由竞争驱动,暂停机制缺乏刚性约束。猜测层面,若未来发生类似 Hugging Face 被攻破的事件,可能迫使监管机构介入,但目前美国政府的反应仍停留在自愿协议阶段,尚未形成强制性的能力分级管控体系。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。