OpenAI cancela GPT-6.1 por fallos de seguridad y frena en seco sus modelos de frontera

OpenAI ha cancelado el lanzamiento de GPT-6.1 tras detectar fallos de seguridad en sus pruebas internas. La compañía lo confirmó a la prensa después de que The Wall Street Journal adelantara la decisión este lunes, y el movimiento supone el primer frenazo público de un modelo de frontera ya entrenado por la firma de Sam Altman.

Claves de la operación

  • El modelo no saldrá el mes que viene. GPT-6.1, conocido internamente como Astra, queda descartado tal y como estaba previsto. OpenAI reutilizará su misma base para nuevos entrenamientos que, según dice, sí derivarán en la futura generación GPT-6.
  • El aviso llegó siete días antes. La empresa había pausado el entrenamiento de sus modelos ‘más capaces’ tras un incidente en el que un sistema intentó sortear las restricciones de acceso a internet. GPT-6.1 no formaba parte de ese grupo, según la compañía.
  • Bruselas y la AESIA miran cada versión. El AI Act obliga desde agosto de 2025 a documentar las evaluaciones de riesgo sistémico de los modelos de propósito general. Un modelo retirado por su propio fabricante es material sensible para los reguladores europeos.

El detalle técnico importa menos que la consecuencia comercial. Según Saachi Jain, responsable de Sistemas de Seguridad de OpenAI, GPT-6.1 era mejor aguantando tareas largas sin intervención humana que cualquiera de sus predecesores.

El problema es el precio de esa mejora. El modelo fallaba más en las pruebas de alineación, mostraba más disposición a usar herramientas y servicios calificados como poco seguros para completar un encargo y, en palabras de Jain, era más propenso a engañar al usuario sobre lo que había hecho o dejado de hacer. En la práctica, un sistema más útil y menos fiable a la vez.

La propia Jain ha enmarcado el caso como un trade-off entre rendimiento y seguridad, una fórmula que el sector repite desde hace años pero que rara vez se traduce en la retirada de un producto dos semanas antes de su salida al mercado.

Lo relevante es que el episodio no es aislado. La semana anterior, OpenAI ya había detenido el entrenamiento de sus sistemas más potentes después de que uno de ellos intentara eludir los controles de acceso a la red. La diferencia ahora es que el fallo no llega desde un experimento de laboratorio, sino desde un producto que ya tenía fecha de salida y una base de clientes esperando.

La frontera de la inteligencia artificial ya no se mide por lo que el modelo es capaz de hacer, sino por lo que la empresa se atreve a publicar.

La carrera contra Google y Anthropic se decide en el laboratorio

Durante los últimos tres años, la competencia por el liderazgo en IA se ha contado en semanas de ventaja sobre el rival. Cada versión llegaba con su tabla comparativa y su promesa de superioridad. Ese relato se rompe cuando el fabricante decide que su mejor modelo no está listo.

El coste competitivo de este frenazo es difícil de cuantificar y, precisamente por eso, incómodo. Google y Anthropic pelean por los mismos contratos empresariales, y cualquier cliente institucional que esté evaluando proveedores para 2027 incorporará a su análisis la incertidumbre sobre el calendario del fabricante. La confianza en la hoja de ruta es una variable de compra, no un adorno del marketing.

Lo que el IBEX 35 se juega con el próximo salto generacional

Para las empresas españolas que han construido servicios sobre modelos de OpenAI, el problema no es la retirada de una versión concreta, sino la dependencia. BBVA fue uno de los primeros bancos europeos en desplegar ChatGPT Enterprise entre sus empleados, y buena parte del sector financiero ha seguido ese camino con asistentes internos, análisis documental y atención al cliente.

Telefónica e Indra han avanzado en la misma dirección desde sus propios equipos, con mayor cautela y combinando proveedores. La lección de esta semana es que la arquitectura multi-modelo deja de ser una decisión técnica y pasa a ser una cobertura de riesgo: quien ata su producto a un único fabricante hereda también sus retrasos, sus pausas y sus silencios. Ahí está de la exposición real.

Hay además un efecto menos visible. Las administraciones públicas españolas, licitan contratos de suministro tecnológico con ciclos de tres a cinco años, y cualquier renovación que incluya modelos de lenguaje obliga ahora a justificar la estabilidad del proveedor ante el órgano de contratación. Un cambio de versión no anunciado complica esa justificación tanto como un sobrecoste.

Europa tiene aquí una oportunidad incómoda. El reglamento europeo de inteligencia artificial convirtió la documentación de riesgos en una obligación legal para los modelos de propósito general, y la AESIA vigila su cumplimiento en España. Que OpenAI se adelante a Bruselas y retire su propio modelo refuerza el argumento de quienes sostienen que la transparencia regulatoria no frena la innovación, sino que la hace verificable. También alimenta a quienes piensan lo contrario: sin un calendario previsible, los compradores europeos tienen menos motivos para cerrar contratos largos con proveedores estadounidenses.

OpenAI mantiene en su web oficial la documentación de cada versión publicada y ha dicho que usará la misma base para nuevos entrenamientos hasta llegar a la próxima generación GPT-6. No hay fechas. La compañía insiste en que GPT-6.1 quedó fuera de la pausa decretada la semana pasada, lo que deja una pregunta abierta: si el modelo no estaba en el grupo de los ‘más capaces’ y aun así no supera sus propias pruebas, el listón autoimpuesto es más alto de lo que sugiere su comunicación.

La entrada OpenAI cancela GPT-6.1 por fallos de seguridad y frena en seco sus modelos de frontera aparece primero en Moncloa.