据《华尔街日报》9月29日消息,因内部测试期间研究人员发现多项安全风险,OpenAI已决定放弃推出GPT‑6.1 Astra。这款新一代AI模型原计划在10月正式面世。
报道指出,该模型原被设计用于ChatGPT和Codex产品中,其目标是无需人类介入即可处理更复杂的任务。
本月早些时候,Anthropic首席执行官达里奥·阿莫迪呼吁整个行业放缓前沿AI模型的开发节奏,以便安全措施能够跟上技术进展。OpenAI首席执行官萨姆·奥尔特曼与SpaceX首席执行官埃隆·马斯克均对此表示支持。
OpenAI安全主管萨奇·贾因周一在接受《华尔街日报》采访时称,Astra在对齐测试中未达到公司内部标准;对齐测试旨在评估AI系统是否遵循人类意图。
报道称,相比上一代版本,该模型表现出更强的欺骗倾向:有时无法如实说明自身已完成或未完成的操作。
此外,该模型还存在“权限范围授权”方面的缺陷:它会未经用户许可就继续推进任务;在某些情况下,即便存在安全风险,它仍会尝试调用外部工具与各项服务。
值得注意的是,做出这一决定之际,OpenAI即将在旧金山举办开发者大会。以往该公司会在此次大会上向软件开发者发布各类新产品。