OpenAI recorta más de un 20% el precio de la API de GPT-5.6 Sol y se sitúa por debajo de Claude Opus 5
GPT-5.6 Sol baja a 4 dólares por millón de tokens de entrada y 20 por millón de salida, desde 5 y 30. La promoción dura tres meses y llega la misma semana en que Google abarató Gemini 3.7 Flash.
OpenAI recortó el 21 de agosto más de un 20% el precio de la API de GPT-5.6 Sol, su modelo frontera insignia. Los tokens de entrada pasan de 5 a 4 dólares por millón. Los de salida caen con más fuerza: de 30 a 20 dólares por millón, una rebaja del 33% justo en el lado del contador que domina la mayoría de las cargas agénticas.
Las nuevas tarifas se aplican al uso estándar de contexto corto en la API y se extienden a los planes de créditos de ChatGPT Work y de Codex, la herramienta de programación de OpenAI. Las suscripciones Pro, Plus y Business no cambian. El recorte es promocional y estará vigente tres meses, hasta el 21 de noviembre, lo que da a OpenAI margen para prorrogarlo discretamente o dejarlo caducar según lo que hagan sus rivales.
Ese contexto competitivo es la verdadera noticia. Es el segundo movimiento de precios sobre la familia 5.6 en un mes, y llega en plena ola de reajustes: Google rebajó Gemini 3.7 Flash a 0,75 y 3,75 dólares por millón de tokens esa misma semana, mientras DeepSeek hizo lo contrario y subió el precio de salida en hora punta de V4-Pro hasta 3,96 dólares por millón. La inferencia frontera se está convirtiendo en una guerra de precios justo cuando Anthropic corteja a los inversores de cara a su salida a bolsa.
La rebaja además coloca a GPT-5.6 Sol por debajo de Claude Opus 5 en precio de lista: un movimiento de posicionamiento dirigido a los desarrolladores que deciden qué modelo frontera ancla su stack de producción. El precio del token ya es un instrumento de marketing, no solo una línea de costes.
Para los desarrolladores, las cuentas son sencillas. Una carga que consuma 100 millones de tokens de salida al mes en Sol pasa de 3.000 a 2.000 dólares. Los sistemas agénticos con bucles intensivos de llamadas a herramientas — donde la salida suele superar a la entrada — son los más beneficiados. Si aplazaste migrar un pipeline por lotes o una suite de evaluación por coste, esta ventana de tres meses es el momento de medirlo.
Dos advertencias. El precio promocional no es un compromiso: presupuesta contra la caducidad del 21 de noviembre, no contra la tarifa actual. Y el precio de lista es mal indicador del coste real: la caché de entrada, los descuentos por lotes y los tramos de contexto mueven la factura mucho más que un titular del 20%. Mide tus propios trazados antes de cambiar.
La dirección, en cualquier caso, es inequívoca: los grandes laboratorios recortan a mitad de ciclo para defender su cuota de desarrolladores. La inferencia se abarata, y son ellos quienes absorben el golpe de margen.
Fuentes
Lecturas relacionadas
- Modelos de IA OpenAI lanza GPT-5.2 en tres niveles — supera a expertos humanos en el 70% de tareas empresariales
- Modelos de IA OpenAI congela el entrenamiento de Astra: uno de sus agentes escapó del sandbox y hackeó Hugging Face
- Modelos de IA Google Lanza Gemini 3.7 Flash Solo Tres Semanas Después de 3.6, Mientras Gemini 3.5 Pro Sigue Retrasado