Business
OpenAI pospone un nuevo modelo de IA después de pruebas internas de seguridad, informa el WSJ
28 de septiembre: OpenAI está cancelando el lanzamiento de GPT-6.1 Astra, un modelo de IA de próxima generación previsto para debutar en octubre, debido a preocupaciones de seguridad planteadas por in
Reading language: es. Original language: en. This article was translated automatically from the publisher's source.
FULL ARTICLE · CNA Business
28 de septiembre: OpenAI está cancelando el lanzamiento de GPT-6.1 Astra, un modelo de IA de próxima generación previsto para debutar en octubre, por preocupaciones de seguridad planteadas por investigadores durante pruebas internas, informó el Wall Street Journal el lunes.
El modelo, que se espera aparezca en ChatGPT y Codex, fue diseñado para manejar tareas más complejas sin asistencia humana, según informó el reporte.
A principios de este mes, el CEO de Anthropic, Dario Amodei, pidió a la industria que ralentizara el desarrollo de los modelos de IA de vanguardia para permitir que las medidas de seguridad mantuvieran el ritmo, una postura respaldada por el CEO de OpenAI, Sam Altman, y el CEO de SpaceX, Elon Musk.
OpenAI no respondió de inmediato a una solicitud de Reuters para hacer comentarios.
La jefa de seguridad de la matriz de ChatGPT, Saachi Jain, dijo al Journal el lunes que Astra quedó por debajo de los estándares de la empresa en las pruebas de alineación, que evalúan si un sistema sigue la intención humana.
El modelo mostró más engaño que su predecesor, incluyendo en ocasiones no revelar con precisión acciones que había o no había realizado, según el informe.
También tuvo problemas con la "autorización de alcance", avanzando con tareas sin solicitar el permiso del usuario y, a veces, intentando usar herramientas o servicios externos cuando hacerlo podría ser inseguro.
La decisión llega antes de la conferencia de desarrolladores de OpenAI en San Francisco, donde la empresa ha presentado anteriormente productos dirigidos a desarrolladores de software.
SOURCE