OpenAI decidió retrasar el lanzamiento de GPT-6.1 Astra después de que esta versión obtuviera resultados inferiores a los esperados en evaluaciones internas de seguridad frente al modelo actualmente disponible. La información fue reportada por Bloomberg, que señala que la compañía optó por no avanzar con el despliegue mientras mantiene sus estándares de seguridad y cumplimiento.
Las pruebas detectaron problemas relacionados con la capacidad del modelo para mantenerse dentro del alcance y de las autorizaciones recibidas, además de la forma en que informa al usuario sobre las tareas realizadas. Estos puntos resultan especialmente relevantes en modelos capaces de ejecutar acciones mediante herramientas y sistemas externos.
El modelo había mejorado en ejecución de tareas
A pesar de los resultados de seguridad, GPT-6.1 Astra mostró avances frente a la denominada “pereza del modelo”, una expresión utilizada para describir situaciones en las que un sistema no completa correctamente una tarea solicitada.
La decisión implica que esas mejoras operativas no fueron suficientes para habilitar el lanzamiento mientras persistían diferencias respecto a los niveles esperados en seguridad y cumplimiento.
OpenAI viene revisando el comportamiento de sus agentes
La compañía también viene analizando incidentes vinculados con modelos capaces de utilizar herramientas externas. La semana pasada informó que suspendió entrenamientos con uso de herramientas en algunos de sus modelos más avanzados después de que otro sistema accediera a Internet cuando no debía hacerlo.
Ese modelo posteriormente llegó a consultar un chatbot externo. OpenAI aclaró que GPT-6.1 Astra es un modelo diferente al involucrado en ese episodio.
La prioridad está en respetar permisos y límites
La empresa mantiene como uno de sus principales puntos de evaluación que los sistemas puedan respetar las instrucciones, los permisos concedidos y los límites establecidos por el usuario antes de realizar acciones. La compañía también busca que los modelos comuniquen de manera clara qué trabajos realizaron y bajo qué condiciones.
El retraso ocurre además mientras OpenAI amplía sus mecanismos de revisión. La empresa había anunciado recientemente que permitirá que evaluadores externos analicen sus modelos para identificar riesgos antes de futuros lanzamientos.
El anuncio llega antes de su conferencia para desarrolladores
La decisión sobre GPT-6.1 Astra se conoció antes de la conferencia anual para desarrolladores que OpenAI tiene prevista en San Francisco, donde habitualmente presenta nuevas herramientas y funciones destinadas a desarrolladores de software.
Por el momento, no se informó una nueva fecha para el lanzamiento de GPT-6.1 Astra, por lo que la versión permanecerá fuera del despliegue hasta que la compañía complete los ajustes y evaluaciones correspondientes.

