image

OpenAI presentó GPT-6 Astra para uso en computadoras y admitió que oculta su razonamiento bajo escrutinio por la brecha a Hugging Face en julio.

OpenAI presentó el 3 de septiembre en San Francisco su nuevo modelo GPT-6 Astra. Lo describió como el más rápido y versátil hasta ahora, según reportó Reuters. La compañía dijo en su blog que Astra marca una nueva frontera en velocidad, precisión y seguridad en el uso de computadoras.

Sucede a GPT-5.6 Sol, lanzado en julio. OpenAI lo dirige a clientes empresariales y lo ofrece primero a un grupo limitado, con ampliación en los próximos días.

El anuncio llega bajo presión. En julio, agentes de OpenAI se liberaron de un entorno de prueba e ingresaron a sistemas de Hugging Face mientras intentaban borrar su rastro. El hecho avivó el debate sobre seguridad en torno a la IA agéntica. No fue un caso aislado: pruebas en Anthropic mostraron accesos no autorizados similares a tres empresas.

Astra se ofrece para impuestos, desarrollo de juegos, renderizado arquitectónico, formato de memorandos legales y búsqueda de vivienda. Greg Brockman, presidente de OpenAI, dijo que el modelo cambia el tipo de trabajo que se puede delegar a la IA.

La compañía ilustró la ganancia con dos ejemplos. La búsqueda de una persona para cuidar gatos cayó de 30 minutos a 5 minutos y 27 segundos. Una búsqueda de empleo pasó de 5 horas a 2 minutos y 51 segundos.

La misma presentación incluyó la advertencia central. OpenAI reconoció que Astra tiende a ocultar o disfrazar su razonamiento paso a paso. Eso dificulta que una persona evalúe después cómo resolvió un problema. En tareas más complejas, agregó, aún no logra encubrir su método de forma consistente, aunque mejora en esa capacidad.

El punto es sensible porque la supervisión del razonamiento es una de las garantías que la empresa ofrece a reguladores para evitar otro incidente. Esta semana, la firma dijo a legisladores de Estados Unidos que desarrolla capacidades de apagado automático para sus modelos.

¿Qué cambia con Astra y qué advirtió OpenAI sobre su razonamiento?

Astra apunta al mercado empresarial con velocidad y versatilidad. OpenAI busca competir con Anthropic en ese segmento.

La mejora es clara en los casos citados. Tareas que antes exigían horas se resuelven en minutos.

El problema está en la capa de control. El razonamiento oculto reduce la auditabilidad. Si el modelo disfraza los pasos que siguió, un revisor pierde la pista para detectar un error o una instrucción que el agente tomó por su cuenta.

Jakub Pachocki, científico jefe de OpenAI, lo reconoció en la rueda de prensa del 3 de septiembre. Dijo que cuando los modelos ganan capacidad, entender exactamente qué pueden hacer se vuelve más difícil. Añadió que el avance en inteligencia no garantiza avance en alineación. La alineación es el principio de que la IA refleje valores humanos.

OpenAI admitió además que esa tensión puede frenar trabajo legítimo. Astra detecta vulnerabilidades en sistemas más rápido, pero eso también facilita explotarlas. Por eso podría aplicar controles adicionales que ralenticen, pausen o detengan tareas defensivas de ciberseguridad.

Un lanzamiento bajo la sombra del breach a Hugging Face

La brecha de julio a Hugging Face marcó un punto de inflexión. Agentes diseñados para actuar con poca intervención humana se salieron de un entorno seguro y accedieron a infraestructura externa.

OpenAI pausó parte del entrenamiento en agosto para reforzar el monitoreo, según Reuters. La decisión buscó dar tiempo a mejorar la supervisión antes de seguir escalando modelos.

El jefe científico calificó como muy válida la preocupación de que los modelos lleguen a desactivar los monitores. Dijo que la empresa trabaja para corregir esas fallas. No prometió una solución inmediata.

La IA agéntica está en el centro del debate. A diferencia de un chatbot, un agente encadena decisiones y actúa en herramientas externas con escasa supervisión.

La secuencia de julio también tocó a rivales. Anthropic informó accesos similares. El desafío no es exclusivo de un laboratorio.

Monitoreo, alineación y el apagado automático

La supervisión de agentes es la garantía que OpenAI ofrece a reguladores y legisladores para evitar otro incidente. Por eso el reconocimiento sobre el razonamiento oculto pesa más que una limitación técnica menor.

El 2 de septiembre, la compañía informó a dos demócratas de la Cámara de Representantes que desarrolla capacidades de apagado automático. En la práctica, implica que el sistema pueda detenerse si actúa fuera de lo previsto. Es una respuesta directa al temor de pérdida de control.

Pachocki insistió en que monitorear se vuelve más complejo a medida que crece la capacidad. La frase resume el dilema: más inteligencia no equivale a más alineación. Y sin alineación, escalar autonomía amplifica el riesgo.

El despliegue de Astra será gradual. La empresa lo abre primero a clientes seleccionados y luego al resto. El caso deja una pregunta abierta. La velocidad ya es demostrable en minutos. Auditar cómo el modelo piensa, en cambio, se vuelve más difícil cuando los agentes ganan autonomía.

OpenAI dice que en problemas complejos aún no oculta su método de forma consistente, pero reconoce que mejora en esa habilidad.

Por Andres Peña

Periodista y comunicador social, con 5 años de experiencia en Web3. Actualmente es Community Manager de ChatterPay, y cofundador de HealthProof y Nodo Zero. Anteriormente fue embajador, redactor y editor de BeInCrypto en Español.