Anthropic首席执行官达里奥·阿莫迪近日表示,政策制定者应允许较低风险的开放权重AI继续广泛使用,同时对前沿系统实施更严格的保障措施,包括强制性测试,以及限制中国获取先进算力和模型能力。
阿莫迪在一篇阐述Anthropic立场的文章中指出,对中国开放权重模型实施全面限制(包括禁止美国企业使用)并不能解决他所关注的国家安全核心问题。他将关注重点指向威权政府在先进AI领域超越美国的可能性,以及日益强大的AI系统在网络安全、生物安全和模型对齐方面带来的风险。
阿莫迪还呼吁对工业级模型蒸馏行为采取行动,认为这种方式使中国开发者得以用远低于从头训练所需的算力来提升模型能力。
此前,Anthropic因未签署一封由英伟达、微软、Meta、IBM、Mistral、Hugging Face等科技公司联名支持的行业信函而遭到批评。该信函呼吁政策制定者避免对开放权重模型施加过早限制。
信函认为,开放权重有助于扩大AI的普及范围、加剧市场竞争,并使各类组织无需依赖单一服务商即可自主部署和定制模型。阿莫迪对上述部分观点表示认同,但对"开放性天然有助于安全研究"或"开放对防御方比攻击方更有利"等说法提出了质疑。
他表示,监管应基于模型的能力与风险,而非其权重是否公开。在这一框架下,能力达到一定水平的开放与封闭模型均须在发布前接受测试。
分析人士指出,Anthropic通过拒绝全面禁令,已向行业主流立场靠拢,但其支持力度仍低于多数大型科技公司所倡导的开放尺度。
IDC人工智能、分析与数据研究主管迪皮卡·吉里表示,英伟达所支持的信函将开放权重视为应保持广泛可及的战略基础设施,与Anthropic更为保守的立场形成对比。
Omdia首席分析师苏建谊认为,阿莫迪的声明表明Anthropic仅在特定条件下支持开放权重模型,这一立场也有助于该公司作为注重合规与严格管控的专有模型提供商保持自身竞争优势。
Pareekh Consulting首席执行官帕里克·贾恩将此次声明称为向开放权重模型支持者释放的"真诚和解信号"。他表示,争议焦点已从"此类模型是否应当发布"转移到"政策制定者应在哪里划定边界"。
"Anthropic认为,一旦模型变得足够强大,公开发布其权重比将其锁定在应用程序背后风险更高,因为一旦公开便无法收回,也无法在事后添加安全补丁。"贾恩说。
分析人士对于Anthropic提出的管控措施能否实现既定目标、同时又不给规模较小的AI开发者设置新障碍,看法不一。
贾恩表示,芯片限制和打击非法模型蒸馏的措施将主要影响模型开发者和基础设施提供商,而非使用现有市售模型的企业。然而,强制性安全测试可能会推高开发成本,并减少可用的先进开放权重模型数量。
"测试既费钱又耗时,因此Anthropic、谷歌和OpenAI等资金雄厚的大公司能够承担得起,"贾恩说。他补充道,寻求发布前沿开放权重模型的小型开发者可能难以满足同等要求。
苏建谊表示,额外的测试和审查也可能压缩企业可用的开放权重模型数量,从而削弱其核心优势,包括更低成本、减少对单一供应商的依赖以及社区驱动的开发模式。
市场研究机构JP Data董事总经理阿南德·乔希对限制中国获取先进芯片能否实质性地拖慢其AI发展速度提出质疑,认为中国企业已展示出以较少算力构建高能力模型的实力。不过,他支持打击非法蒸馏行为,认为有必要建立保障机制,防止开发者在未经授权的情况下复制其他模型的能力。
贾恩表示,如果能力较弱的模型获得豁免,对多数企业用户的影响将相当有限。部署能力低于测试门槛的模型的企业,所面临的额外成本可能微乎其微。
吉里建议,首席信息官应根据模型能力而非是否开源来进行评估,并应要求提供独立测试报告、明确的授权协议、模型文档,以及监控和事件响应方面的问责机制。
"强制性安全测试应由模型实际表现出的能力触发,而非其规模或训练成本,"贾恩说,尤其是当某个系统可能大幅助力网络攻击、生物滥用或自主有害行为时。
他补充道,在部署之前,首席信息官应寻求独立评估报告、详细的模型文档、安全测试结果以及有关模型软件供应链的信息。Forrester首席分析师查理·戴表示,评估内容还应涵盖有记录的红队测试结果、模型溯源信息、训练与微调相关披露,以及针对公认安全基准进行独立测试的证明。
Q&A
Q1:Anthropic为什么反对全面禁止开放权重AI模型?
A:Anthropic认为,对开放权重模型实施全面禁令并不能解决核心的国家安全问题。该公司主张监管应基于模型的实际能力与风险,而非其权重是否公开。对于能力较弱的模型,应保持可及性;对于能力足够强大的模型,无论开放还是封闭,均须在发布前接受强制性安全测试。
Q2:Anthropic提出的强制安全测试会对小型AI开发者造成什么影响?
A:强制性安全测试可能显著推高开发成本,对资金有限的小型开发者构成较大压力。分析人士指出,Anthropic、谷歌和OpenAI等大型企业有能力承担测试费用,而规模较小的开发者若要发布前沿开放权重模型,可能难以满足同等要求,从而减少市场上可用的先进开放权重模型数量。
Q3:限制中国获取先进芯片,真的能减慢中国AI发展速度吗?
A:部分分析人士对此持怀疑态度。JP Data董事总经理阿南德·乔希认为,中国企业已证明能够以较少算力构建高能力模型,单纯的芯片限制未必能实质性地拖慢其AI发展进程。不过,他支持打击非法模型蒸馏行为,认为应建立保障机制,防止开发者未经授权复制其他模型的能力。