Business
OpenAI adia novo modelo de IA após testes internos de segurança: relatório
A OpenAI está cancelando o lançamento do GPT-6.1 Astra, um modelo de IA de próxima geração planejado para estrear em outubro, devido a preocupações de segurança levantadas por pesquisadores durante te
Reading language: pt. Original language: en. This article was translated automatically from the publisher's source.
FULL ARTICLE · CNA Business
A OpenAI está cancelando o lançamento do GPT-6.1 Astra, um modelo de IA de próxima geração planejado para uma estreia em outubro, devido a preocupações com segurança levantadas por pesquisadores durante testes internos, informou o Wall Street Journal na segunda-feira (28 de set.).
O modelo, previsto para aparecer no ChatGPT e no Codex, foi projetado para lidar com tarefas mais complexas sem assistência humana, disse o relatório.
No início deste mês, o CEO da Anthropic, Dario Amodei, pediu que o setor desacelerasse o desenvolvimento de modelos de IA de fronteira para permitir que as medidas de segurança acompanhassem o ritmo, uma visão endossada pelo CEO da OpenAI, Sam Altman, e pelo CEO da SpaceX, Elon Musk.
A OpenAI não respondeu imediatamente a um pedido de comentário da Reuters.
A chefe de segurança da empresa-mãe do ChatGPT, Saachi Jain, disse ao Journal na segunda-feira que Astra ficou aquém dos padrões da empresa em testes de alinhamento, que avaliam se um sistema segue a intenção humana.
O modelo mostrou mais engano do que seu antecessor, incluindo, às vezes, a falha em divulgar com precisão ações que havia ou não havia tomado, disse o relatório.
Ele também teve problemas com "autorização de escopo", avançando com tarefas sem solicitar permissão do usuário e, às vezes, tentando usar ferramentas ou serviços externos quando fazê-lo poderia ser inseguro.
A decisão ocorre antes da conferência de desenvolvedores da OpenAI em São Francisco, onde a empresa anteriormente revelou produtos voltados para desenvolvedores de software.
SOURCE