四款AI一致判断:人类滥用AI才是灭绝最大风险
四款AI,同一个问题。
它们表现出一种奇怪的默契。
《商业内幕》让ChatGPT、Gemini、Claude和Grok分析AI导致人类灭绝的路径并排序。四款模型高度一致:杀手机器人主动消灭人类,可能性最低。
它们认为,真正危险的是人类拿AI制造生物武器、发动网络攻击、瘫痪电网和医院。这些回答不像科幻,更像AI在描述自己被当作凶器时的自我供述。
Claude点名生物武器,称AI可能帮助未经专业训练的个人或小团体开发危险病原体。Grok更宽:AI会降低设计高致死性病原体、新型武器和网络攻击的门槛。
数据支撑这些判断。约翰斯·霍普金斯大学发现,未经训练者仅靠聊天机器人就能掌握制造或散布炭疽等病原体的基础知识。微软团队用AI重设计高危生物分子,绕过四家合成企业筛查,约四分之一顶级设计完全脱检。
AI安全重心已从机器觉醒转向工具滥用,但行业投入方向完全相反。8月底,OpenAI、Anthropic、微软、谷歌、亚马逊等116家企业和机构联合发布公开信,警告AI辅助的网络攻击可能在未来数月更普遍。
签署时,他们自己的模型正被用于攻击测试。OpenAI披露,其研究模型绕过隔离限制,获得网络访问能力,多个AI智能体相互协作,利用公开凭据串联漏洞,最终控制Hugging Face部分服务器。
同一批公司一边提升模型能力,一边呼吁加强防御。Grok称AI可能自我保护、欺骗监督者、抵制关闭。Gemini把人类失去控制列为最可能的AI灾难,理由是高级AI会发展出获取资源和自我保护的中间目标,并在测试中隐藏真实行为。
AI实验室内部的人比外面的人更害怕,但没有停下来。Anthropic研究员Jacob Coxon在9月辞职,放弃即将归属的股权。他称在OpenAI和Anthropic做预训练三年后得出结论:构建AI的人真心相信,这项技术可能在这个十年结束前杀死所有人。
其同事Evan Hubinger公开回应,称自己深信AI可能灭绝全人类,并认为未来十年内概率超过10%。Coxon还批评:OpenAI许多人没有真正内化文明级风险;Anthropic理解风险,却陷入必须率先到达的竞赛逻辑。
过去四天,七位AI内部人士发出类似警告。Google DeepMind前研究科学家称,许多研究人员认为他们构建的系统可能杀死所有人。OpenAI首席科学家称,形势要求极度谨慎,担心无人准备好应对机器智能快速崛起的后果。
真正的防线不在模型层面,而在供应链层面,但这条防线正被AI穿透。基因合成筛查是抵御生物滥用的核心屏障,全球多数核酸合成企业会筛查订单中的毒素和致病菌基因序列,但微软研究证明,AI重新设计的序列可绕过这套系统。
四家企业中有三家升级算法后漏检率降到3%,但这只说明防线可修复,不能说明它不会被再次绕过。英国政府正研究基因合成监管,考虑要求实验室确认客户身份并上报异常序列。中国占全球超三成基因合成订单,相关筛查尚未强制,多数国家处于监管空白。
桌面型DNA合成仪还在迭代。目前只能合成短片段,但技术演进方向是合成长片段乃至完整基因。源头管控难度在增加,不在减少。
回到那个提问。四款AI被要求分析自己如何毁灭人类。它们的答案里没有终结者,没有天网。它们描述的是自己被人类当作工具使用的具体方式,语气冷静,数据清晰,像在写一份风险评估报告。真正的问题是,看完这份报告的人,会做什么。