Anthropic研究员警告AI灭绝风险,马斯克斥为"心理战"
Anthropic多名研究员公开警告超级智能风险,马斯克等人称其为"心理战";公司同时披露已阻止AI被用于生物武器研究的滥用案例。
当一家顶尖AI公司的员工开始公开担心自己正在造的东西可能毁灭人类,而另一位科技巨头却把这种担心称为"心理战"时,这场争论就不再只是技术圈内部的口水仗了。2026年9月,Anthropic内部接连出现的辞职与警告,把"超级智能风险"这个长期停留在论文和播客里的话题,推到了公众舆论的中心。与此同时,公司自己发布的滥用报告显示,AI被用于高危生物研究的尝试已经真实发生。
核心内容
-
一名研究员辞职引爆连锁反应。 Anthropic研究员雅各布·考克森(Jacob Coxon)在社交平台X上宣布辞职,并警告AI公司正在竞相开发"可能在本十年末毁灭我们所有人"的超级人工智能(ASI)技术。他的表态并非孤例,随后多名公司内部人士公开表示认同。
-
内部人士称"许多同事有同感但不敢说"。 从事通用人工智能(AGI)安全工作的王安娜(Anna Wang)表示,目前还没有可行的科学方案来应对递归式自我改进(RSI)型AI带来的风险,公司内很多人希望放慢开发节奏。RSI指的是AI系统不仅能执行任务,还能修改和优化自身代码或架构。
-
安全研究员的措辞相当直白。 另一名员工德雷克·托马斯(Drake Thomas)称"事物发展速度太快,我们距离希望的保障程度还差得很远";安全研究员萨缪尔·马克斯(Samuel Marks)则写道,AI开发者相信自己的技术可能导致人类灭绝,而且"员工级别越高,担忧越强烈"。
-
马斯克阵营给出完全相反的解读。 马斯克在X上回应称"听起来像是个阴谋局",并称这场"心理战"的铺垫已经准备很久,考克森的帖子"不过是点燃干柴的一根火柴"。保守派智库"资本研究"研究员帕克·塞耶(Parker Thayer)在缺乏证据的情况下提出,这是一场"极其精密且资金充裕的公关行动"的开端,目的是推动AI监管。
-
公司报告披露了真实的滥用尝试。 Anthropic在9月10日发布的报告中记录了8个月内的模型滥用情况,称已阻止可能用于制造生物武器的尝试。其中5月的一起案例中,一名科学家试图借助模型Claude撰写关于基孔肯雅病毒实验研究的资助申请书。
-
争议焦点是"功能增益"研究。 该研究希望通过基因改造让病毒在反复感染活体动物的过程中致病性更强。这类研究可能合法并有助于疫苗研发,但也可能创造出"超级病毒变体",而Anthropic注意到该工作原计划在一家军事研究机构开展。
公司承认无法判断意图。 Anthropic威胁情报负责人雅各布·克莱因表示,无法确定这项研究是否旨在武器化,但军事机构开展功能增益研究确实令人担忧。由于正当生物学研究与恶意用途难以区分,公司选择采取谨慎做法。
深度分析
这场争论真正值得注意的地方,不在于马斯克说了什么,而在于AI行业内部第一次出现了"员工公开质疑自家产品路线"的规模化现象。过去几年,AI安全讨论主要由外部学者和监管机构推动,公司内部人员即便有顾虑也大多停留在匿名论坛或私下交流。考克森辞职后多名同事跟进表态,说明这种沉默正在被打破,而这恰恰是行业治理中最难处理的部分——当最了解技术细节的人开始表达恐惧,外界很难简单将其归为"不懂技术的恐慌"。
马斯克阵营的"心理战"叙事则反映了另一种现实:AI监管议题在美国已经高度政治化。把安全警告解读为"为民主党争取支持、进而扼杀AI"的公关行动,本质上是用政治框架消解技术风险讨论。这种操作的危险在于,它让"是否存在风险"这个可以靠证据检验的问题,变成了"你站在哪一边"的立场问题。一旦讨论被这样重构,任何来自公司内部的技术警告都会被自动打折。
从产业角度看,Anthropic的滥用报告提供了比口水战更有价值的信息。生物领域的"功能增益"研究长期处于双重用途的灰色地带,AI模型的介入让门槛进一步降低:过去需要专业训练才能完成的实验设计辅助,现在可能通过对话式模型获得。这意味着AI公司实际上已经被动地成为了生物安全的前线筛查者,而它们并没有相应的授权、标准或国际协调机制。
更值得关注的是时间尺度上的错位。内部员工担心的是"本十年末"可能出现的超级智能,而公司当下能做的只是逐案拦截滥用请求。这两件事之间缺少中间环节:没有可验证的RSI安全方案,也没有跨公司的开发节奏协调机制。在竞争压力下,任何一家公司单方面放慢脚步都意味着把领先位置让给对手,这正是员工所说"希望放缓但做不到"的结构性困境。
未来一段时间,可以预期三种走向:一是更多AI公司员工效仿公开表态,形成某种行业内部的"安全异议"传统;二是监管机构借生物安全案例推进针对性立法,而非笼统的AI法案;三是"心理战"式的话语对抗继续升级,让公众更难分辨哪些警告基于证据、哪些出于立场。对普通读者而言,最实用的态度或许是:既不对"灭绝论"照单全收,也不因为发言者身份可疑就否定其提出的具体事实。
常见问题
问:Anthropic员工说的"RSI"和"ASI"到底指什么? RSI指递归式自我改进,即AI系统能修改和优化自身代码或架构,从而可能进入加速迭代;ASI指超级人工智能,即在几乎所有领域都远超人类能力的系统。员工担忧的核心是:一旦RSI启动,人类可能来不及建立有效的控制与保障机制。
参考 URL: https://www.thepaper.cn/newsDetail_forward_34049099
相关文章
特朗普承诺中期选举后向每位成年人发5000美元"特朗普分红"
特朗普在达拉斯共和党中期选举大会上承诺,若共和党拿下参众两院多数席位,将向约2.7亿美国成年人发放每人5000美元的"特朗普分红",总成本或超1万亿美元,合法性与可行性均存疑。

特斯拉Cybercab“3天撞7辆”传闻核查:报废车照片实为工厂旧测试车
网传特斯拉Cybercab无人驾驶出租车3天撞7辆、被美国立案调查?核查显示图片拍摄于得州工厂报废区,时间早于商业运营,NHTSA调查实为认证流程审查。

儿子去世孙子非亲生案再审听证:老人两审败诉后为何转向争取探视权
广西高院将于9月16日召开亲子关系纠纷再审听证会。老人两审败诉后,律师建议先申请探视权。本文梳理案件脉络、法律争点与未成年人利益最大化原则的博弈。