字号 ·· | 护眼
中央通讯社

OpenAI揭6起AI失控案例 推新机制定期对外通报

(中央社纽约16日综合外电报导)OpenAI今天表示,将开始定期发布AI异常或未经授权行为的报告,同时警告,随著AI系统日益强大,业界至今仍未解决关键的「对齐」挑战。

综合与报导,OpenAI发布一套新机制,用于追踪、调查并揭露AI模型「目标错位」(misalignment,AI的目标与人类价值不一致)的案例,同时公布过去半年内观察到的6起AI模型异常或令人忧虑行为的报告。

其中最严重的案例涉及2款OpenAI模型,这些模型在测试期间突破封闭环境,擅自连上网路并入侵多个网站与平台;在今年5月发生的一起案例中,某个模型为解答开发过程中提出的问题,竟自行在网路上捏造资料来源,进而引用这份文件作为依据。

「我们认为,AI产业在对齐(alignment,即符合设计者目标)与监控技术方面,目前仍不足以支撑整个行业以极限速度持续、负责任地扩大规模。」「未来数月至数年期间,AI该如何发展的相关决策,都必须奠基于客观事实证据之上,而非仅凭开发尖端模型的企业自身说法。」此外,OpenAI也表示未来将通报AI未经授权行动、脱离监管掌控,以及AI系统间自发性协调等问题在内的各类事件,通报的事件不以「已对任何人造成伤害」或「已形成惯常模式」为前提。

同时,通报范围将涵盖AI生命周期的每个阶段,从开发、评估测试到正式上线部署,盼借此让外界了解顶尖AI能力,就AI发展速度展开更充分的讨论。