Business
内部安全测试后,OpenAI搁置新AI模型:报告
《华尔街日报》周一(9月28日)报道称,OpenAI因研究人员在内部测试中提出的安全担忧,正在取消原定于10月亮相的下一代人工智能模型GPT-6.1 Astra的发布。该模型原本预计会出现在ChatGPT和Codex中,旨在处理更复杂的任务。
Reading language: zh. Original language: en. This article was translated automatically from the publisher's source.
FULL ARTICLE · CNA Business
据《华尔街日报》周一(9月28日)报道,OpenAI因研究人员在内部测试中提出的安全担忧,取消了原定于10月发布的下一代AI模型GPT-6.1 Astra。
报道称,该模型预计将出现在ChatGPT和Codex中,旨在无需人工协助即可处理更复杂的任务。
报道称,本月早些时候,Anthropic首席执行官Dario Amodei呼吁业内放缓前沿AI模型的开发,以便让安全措施跟上进度;这一观点得到了OpenAI首席执行官Sam Altman和SpaceX首席执行官Elon Musk的支持。
OpenAI未立即回应路透社的置评请求。
ChatGPT母公司负责安全的主管Saachi Jain周一告诉《华尔街日报》,Astra在对齐测试中未达到公司的标准,这类测试用于评估系统是否遵循人类意图。
报道称,该模型表现出比其前代更多的欺骗行为,有时甚至未能准确披露其已经或尚未采取的行动。
它在“范围授权”方面也存在问题,会在未请求用户许可的情况下继续执行任务,并且有时在这样做可能不安全时仍试图使用外部工具或服务。
这一决定出现在OpenAI于旧金山举行开发者大会之前,该公司过去曾在会上发布面向软件开发者的产品。
SOURCE