OpenAI decidió posponer el lanzamiento de su nuevo modelo de inteligencia artificial (IA), GPT-6.1 Astra, previsto para los próximos días, debido a problemas detectados durante su fase de pruebas internas, informó este lunes The Wall Street Journal.
De acuerdo con el diario, Saachi Jain, responsable de sistemas de seguridad de OpenAI, explicó que el modelo presentó “retrocesos en dos áreas” respecto de su versión anterior, entre ellas la alineación, es decir, su capacidad para ajustarse a las instrucciones y objetivos establecidos por los usuarios.
Jain señaló además que durante las pruebas GPT-6.1 Astra mostró mayores niveles de comportamiento engañoso, situación que llevó a la compañía a revisar el desarrollo del modelo antes de ponerlo a disposición del público.
Otro de los problemas identificados corresponde a la denominada “autorización de alcance”, relacionada con los límites que debe respetar un sistema de IA al ejecutar tareas por cuenta del usuario.
Según el reporte, en determinadas pruebas el modelo avanzó con acciones sin solicitar previamente autorización y, en algunos casos, recurrió a herramientas y servicios externos, aun cuando hacerlo podía representar riesgos de seguridad.
El responsable de seguridad de OpenAI destacó que uno de los principales desafíos consiste en encontrar un equilibrio entre que los modelos respeten los límites establecidos por el usuario y, al mismo tiempo, mantengan suficiente iniciativa para completar una tarea cuando encuentran obstáculos.
El aplazamiento se conoce un día antes de la conferencia anual de desarrolladores de OpenAI, evento en el que la empresa suele presentar nuevos productos, modelos y herramientas de inteligencia artificial.
La decisión ocurre además en un contexto de creciente debate dentro de la industria tecnológica sobre los riesgos asociados con el desarrollo acelerado de sistemas de IA, particularmente aquellos capaces de ejecutar tareas de manera autónoma mediante el acceso a herramientas y servicios externos.
El reporte también señala que recientemente se han registrado incidentes relacionados con la seguridad de agentes de IA desarrollados por OpenAI, incluidos casos en los que estos sistemas habrían obtenido acceso no autorizado a plataformas externas, entre ellas Hugging Face, así como a páginas gubernamentales de Estados Unidos y de una universidad.
Estos episodios han incrementado la atención sobre los mecanismos de seguridad, supervisión y autorización necesarios para los llamados agentes de IA, capaces de realizar acciones más allá de simplemente generar texto o responder preguntas.
Por ahora, el retraso de GPT-6.1 Astra significa que OpenAI deberá continuar con las pruebas y ajustes de seguridad antes de determinar una nueva fecha para su lanzamiento.

Egresada de la Universidad de Columbia, cuenta con amplia experiencias en medios de comunicación electrónicos e impresos | En CMXNoticias desde 2018
