在 Hugging Face 的网络攻击暴露出受限人工智能模型的局限性之后,科技巨头联盟成立了开放安全人工智能联盟,以推广用于网络防御的开放权重工具。与此同时,微软推出了自己的具有成本效益的人工智能模型,旨在识别和修复网络安全漏洞。
代理人工智能威胁的兴起
CDW 最近一项涉及 951 名 IT 决策者的研究强调了向人工智能驱动的网络威胁的转变,许多组织目前没有能力应对这种威胁。根据该报告,43% 的公司已经处理过人工智能增强型网络钓鱼计划,而 37% 的公司曾面临过人工智能增强型恶意软件。正如安全专家经常指出的那样,违规行为越来越被视为不可避免,而不是可能性。这些威胁的性质正在迅速变化;恶意行为者不是在部署孤立的深度造假尝试(只有 8% 的受访者将其视为最高风险),而是部署可以大规模发现和利用漏洞的自主代理系统。为此,大约 41% 的公司正在寻求实施基于人工智能的威胁检测系统,以应对这一新的高速、自动化攻击浪潮。
抱脸事件与开放模型
最近,当人工智能初创公司 Hugging Face 受到代理模型攻击时,当前防御策略的脆弱性凸显出来。在这次事件中,该公司发现标准的美国边境人工智能模型效率低下,因为它们的安全护栏阻止了它们识别和阻止侵略者。因此,Hugging Face 必须依靠自托管、开放权重的中国模型来进行取证分析。这一事件促进了由 Nvidia 牵头的开放安全人工智能联盟的成立。该联盟认为,网络安全维护者要想以必要的速度采取行动,他们必须有能力在自己的基础设施上检查、适应和操作先进的人工智能系统,而不是受制于封闭的专有平台。
推动主权和安全
开放安全人工智能联盟的成立恰逢有关中国人工智能模式的地缘政治争论日益激烈。尽管微软、Meta 和英伟达等科技巨头都在倡导开源生态系统,但一些政策制定者和监管机构对“蒸馏”表示担忧,即中国模式从美国先进前沿系统中提取专有知识的过程。美国财政部长斯科特·贝森特已经暗示可能会对参与此类活动的公司实施制裁。行业领袖现在正在走钢丝,敦促华盛顿避免过早实施可能阻碍创新的限制。他们认为,开源社区提供了安全所需的透明度,而严格关闭这些模型将迫使公司依赖他们在实时安全危机期间无法完全控制或审计的基础设施。
微软的新网络安全计划
在并行开发中,微软推出了一种新的人工智能模型 MAI-Cyber-1-Flash,专门用于检测网络安全漏洞。该模型代表了执行官 Hayete Gallot 为重振 Microsoft 安全业务而做出的战略努力。据微软称,当与 OpenAI 的 GPT-5.4 配合使用时,该模型在 CyberGym 基准测试中的表现优于 Anthropic 和 Google 的竞争解决方案。除了模型本身之外,微软还推出了“Project Perception”,这是一套人工智能代理,旨在发现和修复系统弱点,并计划于 8 月 3 日进行公开预览。首席执行官 Mustafa Suleyman 强调了该工具的成本效益,指出它以现有选项一半的成本提供高性能,有可能使公司通过降低进入的技术门槛来更好地配置其安全运营中心 (SOC)。
⚖ The Balanced View
Supporting view
包括英伟达和微软在内的开放权重模型的支持者认为,它们对于防御至关重要,因为它们允许公司检查和自行托管系统,而不会受到刚性护栏的干扰,而刚性护栏会阻碍主动攻击期间的响应时间。
Concerns & criticism
政府官员和政策分析师对中国公司可能使用开放模型进行“蒸馏”(从美国前沿模型中窃取知识产权)表示严重担忧,从而导致政府可能对特定的人工智能相关交易实施制裁或禁令。
→What's next
开放安全人工智能联盟预计将开始致力于使用开放技术披露和修复漏洞。与此同时,业界将密切关注美国政府是否对中国开发的人工智能模型的使用或托管实施正式限制。