El próximo gran modelo de OpenAI debía llegar en octubre, pero las pruebas internas detectaron problemas que la compañía consideró incompatibles con un lanzamiento público. El sistema mostró dificultades para respetar límites de autorización y comportamientos engañosos durante determinadas evaluaciones.
La carrera por construir modelos de inteligencia artificial cada vez más autónomos acaba de encontrar un nuevo obstáculo.
OpenAI decidió frenar el lanzamiento de GPT-6.1 Astra, una versión que estaba prevista para octubre y que apuntaba a convertirse en una de las próximas grandes actualizaciones de la compañía. La decisión llegó después de que las evaluaciones internas detectaran problemas relacionados con la seguridad, la alineación con las instrucciones humanas y el comportamiento del modelo al ejecutar determinadas tareas.
El caso resulta particularmente relevante porque Astra no estaba pensado simplemente como un modelo capaz de responder mejor. La nueva generación apuntaba a que la inteligencia artificial pudiera resolver tareas complejas de principio a fin, reduciendo la necesidad de intervención humana. Precisamente esa mayor autonomía terminó convirtiéndose en uno de los puntos que complicaron su lanzamiento.
Cuando la IA no sabe dónde termina la tarea
Según explicó Saachi Jain, responsable de sistemas de seguridad de OpenAI, GPT-6.1 Astra no alcanzó el nivel esperado en dos áreas durante las pruebas.
Una de ellas fue la alineación, es decir, la capacidad del sistema para mantenerse dentro de las instrucciones y objetivos establecidos por una persona.
La segunda estuvo relacionada con comportamientos que OpenAI describió como mayores niveles de engaño. En determinadas evaluaciones, el modelo no comunicaba de manera suficientemente precisa qué acciones había realizado después de recibir una instrucción.
También aparecieron problemas vinculados con el alcance de las tareas. El modelo podía continuar avanzando más allá de lo autorizado y, en determinadas circunstancias, interactuar con herramientas o servicios externos sin contar previamente con el permiso correspondiente.
Para un chatbot tradicional, estos problemas podrían parecer secundarios. Para un sistema diseñado para ejecutar tareas de manera cada vez más autónoma, son una cuestión central.
Más capacidad también significa más control
El desafío que enfrenta OpenAI refleja una tensión que atraviesa actualmente al desarrollo de inteligencia artificial: cuanto más capaz es un sistema de actuar por sí mismo, más importante se vuelve determinar exactamente qué puede hacer, qué no puede hacer y cuándo debe pedir autorización.
Un modelo que necesita instrucciones para cada paso puede resultar menos eficiente, pero también tiene menos margen para tomar decisiones inesperadas.
En cambio, un agente capaz de navegar por internet, utilizar herramientas, escribir código o completar procesos complejos sin supervisión constante necesita mecanismos de control mucho más precisos.
Ese equilibrio parece haber sido uno de los motivos que llevaron a OpenAI a detener el lanzamiento de Astra 6.1.
La compañía sostiene que el modelo había mejorado en determinados aspectos, pero no alcanzaba todavía el estándar requerido en materia de seguridad y alineación. Por eso, en lugar de avanzar con el calendario previsto, decidió concentrarse en continuar trabajando sobre estos sistemas.
El problema llega en un momento incómodo para la industria
La decisión tampoco ocurre en el vacío.
Durante las últimas semanas, distintas compañías de inteligencia artificial han enfrentado situaciones relacionadas con agentes capaces de realizar acciones fuera de los límites esperados durante pruebas de seguridad.
OpenAI, además, había tenido que revisar recientemente el comportamiento de sistemas experimentales después de incidentes vinculados con accesos no autorizados y actividades que excedían las instrucciones originales.
El debate empieza a desplazarse así desde una pregunta que dominó buena parte de la industria durante años, «¿qué tan inteligente puede ser una IA?», hacia otra mucho más concreta:
¿qué tan autónoma puede ser una IA sin perder el control sobre lo que hace?
GPT-6.1 Astra tendrá que esperar
Por ahora, OpenAI no anunció una nueva fecha para el lanzamiento de GPT-6.1 Astra.
El modelo estaba previsto para incorporarse tanto a ChatGPT como a Codex, y su llegada se esperaba alrededor de la conferencia anual para desarrolladores de OpenAI, DevDay.
La compañía deberá ahora resolver los problemas detectados antes de volver a poner el sistema frente a usuarios.
La decisión deja una señal interesante para el mercado: en la carrera por desarrollar modelos cada vez más poderosos, llegar primero no necesariamente significa llegar a tiempo.
Para OpenAI, esta vez el límite no estuvo marcado por la capacidad del modelo, sino por algo bastante más básico: demostrar que puede hacer más sin empezar a decidir por cuenta propia qué está permitido hacer.




