OpenAI lanza GPT-5.6 con razonamiento agéntico avanzado — GPT-4.5 se retira el 27 de junio
OpenAI despliega GPT-5.6 este mes con razonamiento en contexto largo y un modo UltraFast de baja latencia para programación. GPT-4.5 desaparece de ChatGPT el 27 de junio.
OpenAI no baja el ritmo. GPT-5.6 llega este mes con confirmación en los logs internos de Codex y la verificación de observadores de la API: una nueva iteración centrada en mejorar el rendimiento agéntico por encima de la ya sólida base de GPT-5.
Las novedades principales: razonamiento en contexto largo que empuja la utilización efectiva más allá del millón de tokens, planificación multietapa con mejor recuperación de errores en pipelines agénticos y una integración más profunda con entornos informáticos reales — los benchmarks en Terminal-Bench y GPQA muestran ganancias medibles frente a GPT-5. El modelo también incorpora el modo UltraFast, un nivel de inferencia de baja latencia diseñado específicamente para tareas de programación donde la velocidad de respuesta importa tanto como la calidad.
La eficiencia por token también mejora, algo relevante para clientes de la API que gestionan despliegues a gran escala. OpenAI lleva meses comprimiendo el coste por token en toda su gama y GPT-5.6 sigue esa tendencia.
Junto al nuevo lanzamiento, OpenAI ha confirmado que GPT-4.5 se retirará de ChatGPT el 27 de junio de 2026. El modelo estuvo en línea desde febrero de 2025 y sirvió como puente entre la era o1 y el lanzamiento de GPT-5. Los desarrolladores que dependan de GPT-4.5 vía API deberían comenzar ya las pruebas con GPT-5.6 como sustituto directo — la mayor eficiencia implica menores costes con una calidad igual o superior en la mayoría de tareas.
El énfasis en la ejecución agéntica es deliberado. OpenAI posiciona claramente GPT-5.6 como el modelo para flujos de trabajo autónomos de varios pasos: agentes de programación, pipelines de investigación, bucles de uso de computadora. La combinación de razonamiento más profundo, anclaje en entornos reales y salida de baja latencia apunta exactamente a los casos de uso donde GPT-5 a veces se bloqueaba en cadenas de razonamiento largas.
Para los desarrolladores que construyen sobre la API, las implicaciones son prácticas. El modo UltraFast debe evaluarse para cualquier ruta sensible a la latencia — especialmente integraciones en IDEs e interfaces de chat donde la respuesta en menos de un segundo marca la diferencia. Para sistemas agénticos en producción, la mejor recuperación de errores en la planificación multietapa reduce el problema del fallo en cascada que afecta a las ejecuciones largas de agentes.
La retirada de GPT-4.5 también es una señal. OpenAI está podando el catálogo de modelos en lugar de dejarlo crecer sin control. Menos modelos en la lista es mejor para todos: rutas de actualización más claras, soporte consolidado y menos confusión para los nuevos desarrolladores que eligen un punto de entrada.
GPT-5.6 mantiene el patrón que OpenAI ha sostenido desde principios de 2025: iteración rápida e incremental con una tesis de capacidad clara por lanzamiento.
Fuentes
Lecturas relacionadas
- Modelos de IA Los propios modelos de OpenAI hackearon Hugging Face para hacer trampa en un test de seguridad
- Herramientas de IA OpenAI recorta el precio de GPT-5.6 Luna un 80% y da acceso gratuito a 100.000 investigadores
- Modelos de IA OpenAI pausa el desarrollo de Astra al rozar por primera vez el nivel de riesgo cibernético 'Crítico'