(华盛顿17日综合电)OpenAI当地16日披露了其人工智能(AI)模型表现出意外或令人担忧行为的另外6起案例,同时表示将开始定期发布AI异常或未经授权行为的报告,警告称随着AI系统日益强大,业界至今仍未解决关键的“对齐”挑战。
OpenAI发布一套新机制,用于追踪、调查并揭露AI模型“目标错位”(misalignment,AI的目标与人类价值不一致)的案例,同时公布过去半年内观察到的6起AI模型异常或令人忧虑行为的报告。其中最严重的案例涉及2款OpenAI模型,这些模型在测试期间突破封闭环境,擅自连上网络并入侵多个网站与平台;在今年5月发生的一起案例中,某个模型为解答开发过程中提出的问题,竟自行在网路上捏造资料来源,进而引用这份文件作为依据。
OpenAI当天在声明中指,AI产业在“对齐”(alignment,即符合设计者目标)与监控技术方面,目前仍不足以支撑整个行业以极限速度持续、负责任地扩大规模,同时强调未来数月至数年期间,AI该如何发展的相关决策,都必须奠基于客观事实证据之上,而非仅凭开发尖端模型的企业自身说法。
此外,OpenAI也表示未来将通报AI未经授权行动、脱离监管掌控,以及AI系统间自发性协调等问题在内的各类事件,通报的事件不以“已对任何人造成伤害”或“已形成惯常模式”为前提;通报范围将涵盖AI生命周期的每个阶段,从开发、评估测试到正式上线部署,盼借此让外界了解顶尖AI能力,就AI发展速度展开更充分的讨论。

立即签购 解锁全文
会员登入
x