上周末,全球AI三大巨头罕见释放“放缓研发”信号,OpenAI首席执行官Sam Altman也再次呼吁AI行业共同建立安全标准。
9月14日,Altman在X平台发帖称,人工智能发展存在两种最坏结果:一是AI最终失控,人类失去对未来的控制;二是极度强大的AI被少数个人、公司或国家掌控,并将自身意志强加于所有人。他认为,这两条红线都不能触碰。
Altman表示,OpenAI已开始在重大能力提升的强化学习训练启动前,主动制定明确的安全论证(safety cases),并希望其他前沿AI公司采取类似做法,围绕模型失准、监控和安全等问题形成统一标准。
据The Information援引知情人士,Anthropic、OpenAI和谷歌已就合作成立AI行业标准机构展开磋商,相关工作组会议仍在进行。这意味着,头部AI实验室的安全治理思路正从各自制定内部规则,逐步转向推动行业协调框架。
安全治理前移,AI“调速”并非放缓发展
Altman强调,随着模型能力不断提升,对齐(alignment)和安全技术也必须同步甚至更快发展,避免AI能力跑在安全保障之前。AI行业需要走一条“狭窄的中间道路”:既不能因竞争压力牺牲安全,也不能让AI能力提升明显领先于对齐、监控和治理能力。
他认为,AI安全治理的重点正从模型部署后的风险控制前移至开发过程本身。OpenAI目前的做法是,在启动预计将显著提升模型能力的前沿强化学习训练前,就提前制定安全论证(safety cases),而不是等模型完成后再进行安全评估。
他同时强调,“调速”(pacing)并非停止AI进步,而是避免以技术上能够达到的最快速度推进。尽管安全论证和监控措施会增加研发成本,但这些投入仍有必要,以确保安全和治理能力跟上模型能力的提升。
监管尚待落地,AI行业应先行推动安全标准
在监管层面,Altman支持美国政府为前沿AI设立统一安全要求,但认为行业没有必要等到相关立法落地后再行动。即使缺乏政府参与,主要AI实验室也应率先推动行业标准机构成立,并探索独立审计等机制。
据报道,Anthropic首席执行官Dario Amodei上周六已公开呼吁AI公司加强技术测试和审核方面的协调。此前,Anthropic、OpenAI和谷歌已就合作成立行业标准机构展开磋商。
Altman在一次员工大会上表示,即便美国政府暂时没有参与,主要AI实验室也应自行推进标准建设;至于全球层面的协调,则需要政府介入,但“首先我们应当尽力自为”。
在他看来,随着AI能力持续提升,社会对前沿AI公司的安全要求也将越来越高,而行业自律最终需要落实到每一家AI实验室的具体行动中。
