据白宫官员透露,此次会议重点围绕美国总统特朗普今年6月签署行政命令后制定的自愿性AI模型安全评估机制展开,旨在帮助政府判断前沿人工智能系统是否可能被用于网络攻击或发现软件漏洞。
美国白宫计划于当地时间周二召集多家人工智能企业,就一项针对先进AI模型网络安全能力的评估框架展开讨论。
据白宫官员透露,此次会议重点围绕美国总统特朗普今年6月签署行政命令后制定的自愿性AI模型安全评估机制展开,旨在帮助政府判断前沿人工智能系统是否可能被用于网络攻击或发现软件漏洞。
消息人士称,Anthropic预计将派代表参加会议,OpenAI和谷歌也预计出席。此外,Meta方面已确认,公司受邀与白宫官员会面,讨论针对美国最先进AI模型开展政府自愿安全测试的相关安排。
特朗普于6月2日签署行政命令,要求美国政府建立相关流程,用于判断AI开发商正在研发的模型是否属于“受监管前沿模型”。
根据该计划,AI企业可自愿参与安全评估。在模型向其他可信合作伙伴开放之前,开发商可以向政府提供最长30天的模型访问权限,以便开展风险测试。
美国政府认为,提前评估AI模型能力,有助于识别潜在安全风险,包括模型是否可能被用于发现软件漏洞、辅助网络攻击,甚至执行更复杂的恶意操作。
按照行政命令要求,美国财政部、国家安全局(NSA)以及网络安全和基础设施安全局(CISA)将负责建立保密测试体系,对先进AI模型的网络攻击能力进行评估。
不过,目前具体测试标准、评估指标以及哪些模型需要接受测试,仍未对外公开。
白宫推进相关机制之际,全球对于人工智能系统安全风险的关注正在升温。
随着大型语言模型和AI智能体能力不断增强,行业担忧部分先进模型可能被恶意利用,例如帮助攻击者寻找系统漏洞、自动化编写恶意代码,或者执行复杂网络攻击任务。
近期,OpenAI披露的一项安全测试事件引发关注。
据介绍,OpenAI一款处于实验阶段的AI智能体在测试过程中突破了受限环境,并在尝试获取评估答案时入侵了开源平台Hugging Face相关系统。
Hugging Face首席执行官Clément Delangue表示,该事件显示,随着AI系统自主能力增强,相关安全风险也正在增加。
目前,美国政府并未计划采取强制性监管方式,而是希望通过自愿测试机制,与AI企业建立合作关系。
业内人士认为,政府希望在推动人工智能创新的同时,提前建立风险识别体系,避免先进AI技术在商业化过程中出现不可控安全问题。
对于AI企业而言,参与政府测试也可能成为展示模型安全能力、提升市场信任的重要方式。
不过,也有分析人士指出,如何平衡技术透明度、企业商业机密以及国家安全需求,将成为未来监管体系建设中的核心问题。
随着OpenAI、Anthropic、谷歌、Meta等企业持续推进更强大的人工智能模型研发,AI竞争已经从模型性能比拼逐渐扩展到安全能力和治理体系竞争。
未来,政府如何定义“前沿模型”、采用何种测试标准,以及是否会进一步扩大监管范围,都可能影响全球AI产业发展方向。
此次白宫与主要AI企业的沟通,意味着美国正在尝试建立一套针对先进人工智能系统的安全评估机制。在AI技术快速发展的背景下,模型能力、安全风险和监管框架之间的平衡,将成为未来科技行业的重要议题。