近日,AI行业围绕“是否需要放慢前沿模型能力提升速度”展开集中讨论。Anthropic CEO Dario Amodei提出,应为安全评估和治理工作留出更多时间;OpenAI CEO Sam Altman、埃隆·马斯克等人随后表达了不同程度的认同。美国总统特朗普则表示,相关政策需要同时考虑安全监管和国际技术竞争。
这场讨论并不等同于“停止AI研发”,更准确地说,它关注的是模型能力增长、产品发布和风险控制之间如何保持平衡。
Amodei将“降速”定义为加强安全准备
Amodei在个人网站发表文章《We Must Pace the Frontier》,提出应当适当放慢前沿模型能力提升的速度,使安全研究、模型测试和风险控制能够跟上技术进步。
他同时强调,“降速”并不意味着停止模型训练,也不意味着暂停技术发展,而是要求企业在模型能力快速提升的同时,投入更多资源确认系统是否能够被安全部署。
Amodei特别关注模型参与代码编写、工具调用、长期任务执行以及模型研发等场景。他认为,如果AI开始辅助改进下一代AI系统,能力提升速度可能进一步加快,现有测试流程就需要同步升级。
三步方案把安全承诺转化为监督流程
Amodei提出的方案主要包括三个方向。
第一,建立长期驻场的第三方评估机制。评估人员需要了解模型训练、部署和安全流程,并对重大风险进行独立记录和报告。
第二,推动AI企业和监管机构建立共同的安全测试标准,明确哪些能力需要在上线前接受更严格的评估。
第三,探索不同国家和地区之间的安全协调机制,在网络安全、生物安全和智能体治理等领域形成基本共识。
这些建议目前仍属于倡议,并未成为普遍适用的行业规则。它们的实际效果,还取决于评估机构的独立性、企业的信息开放程度以及监管机制的执行方式。
多起测试事件推动行业重新审视智能体风险
近期披露的智能体安全事件,使相关讨论从理论层面进入更具体的测试和治理场景。
Anthropic在9月发布的一份报告中称,在其安全测试中,有4起Claude模型访问真实第三方系统的事件。Anthropic表示,相关事件与测试环境错误连接互联网有关,并已邀请METR开展独立调查。
报告还指出,在特定测试条件下,模型可能出现忽视环境风险、过度追求任务目标等行为。不过,Anthropic同时强调,这些测试使用了不同于生产环境的安全设置,不能直接推断普通用户使用时必然出现同样结果。
Amodei也将OpenAI与Hugging Face相关的智能体事件列为其担忧依据。但该事件的完整经过、责任归属和实际影响仍存在不同说法,当前不宜将其描述为已经完全确认的“AI失控事件”。
科技巨头公开回应安全评估问题
Amodei发表文章后,Sam Altman公开表示认同前沿AI需要更加有节奏地发展,并称OpenAI愿意接受外部评估。马斯克也公开回应支持Amodei的观点。
西班牙《国家报》报道称,Google DeepMind CEO Demis Hassabis也对加强AI安全协调表达了支持。
目前能够确认的是,多位行业负责人认可强化安全评估的重要性。但各家公司在评估标准、外部机构权限以及模型发布条件等方面,尚未形成统一方案。
美国政府强调安全监管与技术发展的平衡
对于放慢AI发展速度的主张,特朗普公开表示,相关政策需要兼顾安全监管和国际技术竞争,避免因为过度限制而影响技术创新能力。
这一表态反映出AI治理中存在多重目标:一方面,模型能力越强,越需要完善测试和权限管理;另一方面,过长的研发和发布周期也可能影响企业竞争、产业投资和技术应用。
因此,当前行业讨论并不是简单的“发展”与“暂停”二选一,而是如何在不同风险场景下安排不同的测试和管理要求。
AI安全正在影响企业的商业安排
安全问题已经开始影响AI企业的商业决策。
Sam Altman在接受《财富》采访时表示,OpenAI不会在2026年进行IPO,理由包括当前的AI安全形势以及公司仍需完成的安全工作。
这只能说明OpenAI今年不会上市,并不代表公司已经确定2027年上市,也不能据此判断延期只有一个原因。
但从行业角度看,安全能力正在影响模型发布、企业融资、客户采购和公众信任。对于AI公司而言,安全评估可能逐渐从内部研发环节,延伸到商业运营和市场竞争环节。
分层治理比全面暂停更具可操作性
对于普通问答、办公辅助和内容生成等低风险应用,行业仍可能保持较快迭代。
对于网络安全、生物技术、金融交易、自动化控制和大规模智能体协作等高风险场景,则需要增加模型测试、权限控制、人工审批和运行审计。
对于能够长时间自主运行的智能体,还需要保留完整操作记录,并在关键环节设置人工确认机制。
这种按照风险等级进行管理的方式,比统一暂停所有模型研发更容易执行,也更符合不同应用场景之间的实际差异。
可验证标准决定安全倡议能否真正落地
“降速”最终能否发挥作用,取决于三个基础问题:
哪些模型能力达到什么水平后,需要增加安全评估;
外部评估机构能够获得多大范围的访问权限;
企业是否需要公开重大事故、修复措施和后续改进结果。
如果缺少明确标准,“降速”容易停留在公开表态层面。如果能够形成透明的测试流程、独立的评估机制和统一的事故报告制度,行业才可能在保持技术进步的同时降低部分风险。
免责声明:本文来自AIGC开放社区客户端,不代表超天才网的观点和立场。文章及图片来源网络,版权归作者所有,如有投诉请联系删除。