英国AI安全研究院(AISI)正在成为全球AI监管的“样板间”,各国纷纷开始照搬其模式对大模型进行标准化测试。
据《纽约时报》报道,英国AI安全研究院(AISI,原AI Safety Institute)正在成为各国政府争相效仿的监管模板。该机构的研究人员会对前沿AI模型进行安全漏洞和风险边界测试,而这套做法正被越来越多的国家采纳。
过去几年,AI监管的关键词一直是透明度、责任、原则、风险管理和自愿承诺。但现在问题变得更具体了:一个模型在发布前,到底会不会被用来搞网络攻击?会不会降低制造危险物质的门槛?会不会在某些关键场景下绕过安全限制?这类问题显然不能只靠公司自己回答。企业可以做红队测试、发安全报告,但如果政府没有自己的评估能力,就只能靠发布会、论文和承诺来做判断。英国AISI的价值恰恰在于,它把政府真正放进了测试流程里。
这套模式已经开始向国际合作扩散。英国政府5月25日发布公告称,英国AISI将与澳大利亚AI安全研究院合作,共同跟踪前沿AI风险,包括AI系统如何被用于网络攻击以及如何加强防御。公告还提到,双方将共享AI能力洞察、开展新兴风险研究,并推动AI测试与评估的国际最佳实践。美国也在朝类似方向走。美国商务部下属的AI标准与创新中心近期与谷歌DeepMind、微软和xAI达成协议,将在模型公开发布前进行国家安全相关评估。微软也同时宣布与美国CAISI和英国AISI建立合作,用于测试前沿模型、评估安全防护,并降低国家安全和大规模公共安全风险。
这意味着前沿模型公司以后面对的不仅是市场竞争,还有一套越来越像“发布前安全评估”的流程。在英美这类合作框架下,模型能力越强,企业就越可能需要向政府测试机构提供更多材料和访问权限。对创业公司来说,如果未来政府采购、企业采购或跨境合规更多参考这类评估,安全测试能力就会变成产品竞争力的重要组成部分。未来的AI监管,不再只是问“公司有没有写安全承诺”,而是开始问“到底有没有人真的测过”。这比原则声明更麻烦,但也更接近现实。





