OpenAI近日表示,随着模型能力发展进入新阶段,有必要扩大对对齐失范事件的披露范围。所谓对齐失范,指的是人工智能行为与人类意图或预期不一致的情况。OpenAI承认,目前该公司乃至整个人工智能行业,都尚未建立起一套明确的标准,用于报告模型在训练、评估和部署阶段出现的各类对齐失范问题。

OpenAI指出,需要披露的内容不仅包括传统意义上的安全事件,也涵盖那些并不直接构成安全威胁、但有助于理解人工智能行为方式、预判未来潜在风险的案例。这些信息的公开,可能对行业更全面地认识模型表现有所助益。

据OpenAI介绍,该公司正在搭建一套相关的披露框架,计划在未来数周内对外公布具体方案。与此同时,OpenAI也在就这一议题与全球数十家政府监管机构展开沟通协作,以推动形成更广泛认可的披露规范。