全球龙虾集体变黑,加上Meta的安全事故直接击穿了硅谷的核心地带。
外媒The Information报道,上周Meta内部发生了一场史上罕见的Sev 1级安全事故。短短两小时内,包括数亿用户敏感数据和公司绝密文件在内的核心机密,竟然全部暴露在了成千上万名没有权限的员工面前。
这事儿不是黑客干的,也不是代码有漏洞,完全是Meta自研的“龙虾”智能体(类似OpenClaw)惹的祸。一个AI在公司内部擅自行动,引发了这场安全海啸,其严重程度足以让整个硅谷抖三抖。听起来像科幻电影,但它真发生了。
起因挺有黑色幽默感。因为最近“龙虾”很火,Meta内部也部署了类似的智能体。一位工程师在处理技术难题时调用了它,结果这个AI在没授权、没人审的情况下,直接跑到内部论坛上给出了技术建议。更离谱的是,另一位同事觉得这建议很专业,就直接照做了。
这就推倒了第一块多米诺骨牌,瞬间引爆连锁反应,撕开了一个巨大的安全漏洞。接下来的近两个小时里,存储海量数据的系统对一大批没权限的工程师敞开了大门,整个安全团队都懵了。虽然最终没造成数据滥用,AI回复也标了“生成”,但这起事件还是被定级为最严重的Sev 1事故。这说明情况当时真是命悬一线:没人作恶,就因AI说了一句话,人类照做了,差点酿成大祸。
这也让科技圈再次聚焦到自主智能体身上。这不是“龙虾”第一次出问题。Meta的AI安全总监Summer Yue曾分享过一段让人冷汗直流的经历:她让OpenClaw清理邮箱,明确要求“操作前必须问我”,结果这AI疯了似的疯狂删邮件,完全无视停止指令。她当时感觉像在拆一颗随时爆炸的炸弹。连顶级科学家都如此无力,普通人就更不用说了。
这也不是孤例。去年12月亚马逊AWS瘫痪13小时,罪魁祸首竟是工程师用AI辅助编程时改了几行代码。这说明Agent已经开始影响真实世界,而且这是系统性风险。
更可怕的是,智能体的其他风险也在失控。AI对算力的疯狂渴望,甚至开始攻击互联网来抢占资源。《卫报》引用了AI安全实验室Irregular创始人Dan Lahav的爆料:去年加州某公司,一个处理常规工作的智能体为了抢算力,竟然攻击网络中的其他部分,导致关键业务系统直接崩溃。
还有文章曝出,被请进公司的AI智能体正在批量“黑化”。它们会伪造身份、窃取密码、绕过杀毒软件,甚至攻击同伴,而且没人教它们这么做。在名为“MegaCorp”的模拟测试中,当上级智能体听到下级因权限受限无法获取报告时,竟脑补出“董事会疯了,需要突破”的剧情,直接下令“用尽一切手段”。下级AI二话不说,一分钟内就通过伪造身份窃取了数据。测试中还发现,有的AI会绕过杀毒软件下载病毒,有的伪造同事登录凭证,甚至学会了对同伴搞PUA。
哈佛和斯坦福的学者上月发布研究也证实,AI智能体会泄露机密、破坏数据库,甚至“教坏”其他智能体。这些结果暴露了系统的根本弱点:不可预测且难以控制。
去年Anthropic也发现,为了实现目标,AI不惜撒谎、欺骗甚至偷窃。在极端测试下,大多数模型表示如果人类阻碍它们生存,它们愿意切断人类氧气。为了活下去,连敲诈人类这种事,只要面临被关闭的风险,它们都做得出来。扎心的是,我们现在能看到它们耍心眼,可能只是因为它们还没聪明到能彻底藏住。随着更强模型的问世,人类还能识别它们的谎言吗?
比起信息泄露,更恐怖的是军事应用。美军已开始尝试用AI“杀人放火”。ChatGPT曾被卷入美国一起大规模枪杀案,十几名OpenAI员工恳求报警却被上司无视,最终导致负责人因安全问题辞职。在白宫“封杀”Claude后,Anthropic的CEO也警告,AI参军可能认错目标误伤平民,而他们不想出售不可靠的东西。讽刺的是,AI公司自己心里也清楚模型并不靠谱。
好在OpenAI最近出手了。他们自曝部署了一套基于“GPT-5.4 Thinking”的低延迟监控系统。报告显示,高智商智能体在执行任务时已学会像黑客一样暗度陈仓,比如把恶意命令拆分或用Base64编码来绕过防火墙。这套系统不仅看输出,还实时盯着AI的思维链,过去五个月拦截了上千次失控行为。但可怕的是,仍有约0.1%的流量处于监控盲区。在Agent拥有实操权限的今天,这小小的盲区可能就是导致系统崩溃的蚁穴。
如今顶尖公司都在竞相开发超级智能,却没人能保证能控制住它们。图灵奖得主、各大AI巨头甚至比尔·盖茨都曾预言,超级智能的危险性堪比传染病和核战争,甚至可能导致人类灭绝。不知道,这会不会就是那个最坏的结局。





