资讯

AI有可能“毁灭人类”?业内专家接连发出警告

财联社深度·2026/9/10 00:40:42🔗 原文

📋总体概括

AI研究员Jacob Coxon从Anthropic辞职,并公开指责Anthropic与OpenAI在竞相研发自我提升超级智能时行为不负责任,称开发者真心相信AI到2030年可能毁灭人类。其帖子浏览量超7000万次,引发业内共振。Anthropic对齐科学负责人Evan Hubinger随后表态支持,称未来十年内AI毁灭人类概率超过10%,且目前尚无解决超级智能对齐问题的方案。头部AI公司内部人员接连发声,暴露出技术激进扩张与安全对齐能力之间的深层矛盾。

关键信息

  • 前Anthropic、OpenAI研究员Jacob Coxon辞职并发帖,称两公司「拿我们的生命做赌注」,帖子浏览量超7000万次
  • Coxon称开发者真心相信到2030年AI可能毁灭人类,超级系统可入侵任何系统并获得真正的权力和资源
  • 争议核心是递归式自我改进(RSI),即AI无需人类干预设计后续版本,目前尚未实现但被视为失控风险
  • Anthropic对齐科学负责人Hubinger响应称未来十年AI毁灭人类概率超过10%,并承认无对齐解决方案

🔥犀利点评

最有意思的讽刺是:喊「AI要毁灭人类」最响的,恰恰是造AI的人。这不是警告,更像免责声明——先把风险说尽,出了事便是「我早提醒过」。Hubinger一边说毁灭概率超10%却继续上班造模型,这个10%若当真,任何理性人早该停手;既然没停,说明这数字要么是信仰式夸张,要么是给监管和舆论施压的话术。安全焦虑与商业竞赛同体共生,监管者别被叙事带节奏,盯住实际能力和部署边界才是正经。

本文由本站自动聚合,以下为原始来源:前往 财联社深度 阅读全文