Tres recortes en diez días: OpenAI bajó 80% un precio que había fijado tres semanas antes, y el escalón de arriba no bajó
Qué pasóEl hecho
El 30 de julio de 2026 OpenAI bajó el precio de dos de los tres modelos GPT-5.6 que había lanzado el 9 de julio. Luna pasó de 1 a 0.20 dólares por millón de tokens de entrada y de 6 a 1.20 de salida: −80%. Terra pasó de 2.50 a 2 y de 15 a 12: −20%. Sol, el modelo tope, se quedó en 5 y 30 y estrenó «Fast mode»: hasta 2.5 veces la velocidad, al doble de precio. OpenAI atribuyó el recorte a «20% menos de costo de servicio» y «más de 15% de mejora en eficiencia de generación de tokens», cifras de la propia compañía.
El recorte cerró una secuencia de diez días. El 21 de julio Google lanzó Gemini 3.6 Flash a 1.50 dólares de entrada y 7.50 de salida —la salida costaba 9— y 3.5 Flash-Lite a 0.30 y 2.50, con «17% menos tokens de salida» según Google. El 24 de julio Anthropic lanzó Claude Opus 5 a 5 y 25 dólares, el mismo precio de Opus 4.8, con ventana de un millón de tokens y la promesa de «inteligencia cercana a Fable 5 a la mitad del costo», también cifra del fabricante.
Qué opinan los mediosCómo lo encuadró cada quien
El anuncio oficial en la comunidad de desarrolladores, con la tabla antes y después. Ver comunicado
El porcentaje como titular y la presión de los clientes como causa. Ver nota
Reproduce la explicación de OpenAI —eficiencia— como causa del recorte. Ver nota
La única que recoge la letra pequeña: las solicitudes de más de 272,000 tokens se facturan al doble de la tarifa de entrada. Ver nota
Compara Luna con Gemini 3.6 Flash sumando entrada y salida. La comparación es útil; el método, discutible. Ver nota
La página oficial de Opus 5: precio sin cambio frente a Opus 4.8 y «near Fable 5 intelligence at half the cost». Ver comunicado
El precio de Google el 21 de julio. No confirma el precio introductorio que circuló en agregadores. Ver nota
Registra el precio previo de Luna, 1 y 6 dólares, el día del lanzamiento. Sobre el recorte del 30 de julio, en medios mexicanos: cero encontrados. Ver nota
Indicadores de coberturaCómo se distribuyó la narrativa
Incluye los anuncios oficiales de OpenAI y Anthropic. CNBC, Axios y el blog de OpenAI bloquean la lectura automatizada.
Cada lanzamiento se cubrió solo. Ninguna fuente puso los tres recortes en la misma frase.
Un precio introductorio de Gemini 3.6 Flash a 0.75 y 3.75 dólares circula en agregadores y no aparece en las fuentes abiertas: no se confirma. La fecha del recorte de OpenAI aparece como 30 y 31 de julio.
Expansión, y sólo sobre el precio de lanzamiento. Sobre el recorte, cero medios mexicanos.
El recorte llegó a veintiún días del lanzamiento y sólo a los dos modelos baratos. Sol no bajó: subió, con un modo rápido al doble. La brecha de precio entre Sol y Luna pasó de 5 a 25 veces por token. El ahorro real de una empresa no depende del precio de lista, sino de cuánto tráfico puede enrutar hacia abajo sin que la tasa de error se coma la diferencia. Y la medición independiente del lanzamiento ya había anotado la alucinación al alza.
El segundo ángulo es de método: Google vende «menos tokens» y OpenAI vende «menos precio». Un modelo que resuelve la tarea con 17% menos tokens de salida a 7.50 dólares puede costar menos que uno a 1.20 que necesita razonar más. La única forma de comparar es medir tokens de salida por tarea sobre datos propios, no leer la tabla.
Y lo que vino tres semanas después: el 21 de agosto OpenAI bajó también Sol, a 4 y 20 dólares, «al menos hasta el 21 de noviembre». Ni el escalón de arriba aguantó el trimestre.
Dónde impactaQué significa esto en la operación
A cualquier empresa con factura de API: agencias que operan agentes, software con IA embebida, equipos de datos.
Software, marketing, atención al cliente, legal-tech.
Inmediato: los precios ya rigen.
Reabrir el enrutador de modelos por tarea: clasificación, extracción y resúmenes a Luna o Flash-Lite, con la tasa de error medida antes de escalar. Renegociar contratos anuales de tokens cerrados antes del 21 de julio. Medir tokens de salida por tarea, no precio de lista.
En mayo esta biblioteca escribió que el anuncio con consecuencias del Google I/O no eran las gafas, sino el precio. Julio lo confirma en los tres laboratorios a la vez: la competencia dejó de ser por el benchmark y pasó a ser por el escalón barato. Es la contracara de GPT-5, hace un año, cuando la noticia era qué modelo elegía el selector; ahora la noticia es cuánto cuesta no elegir el tope.
Esperamos que el precio de lista del escalón barato siga cayendo hasta acercarse al de los modelos abiertos chinos, y que la competencia real se mueva a la letra pequeña: contexto largo, caché, modos rápidos. La tabla de precios es cada vez más una portada; la factura está en las notas al pie.
Vigilaremos qué pasa con el tope. Si Sol baja antes de fin de año, el «precio de la frontera» habrá dejado de existir como categoría estable. Ocurrió el 21 de agosto.
Fuentes
- OpenAI — Announcing a major Price drop for 5.6 Terra and Luna and Fast mode for 5.6-Sol
- Yahoo Finance — OpenAI cuts GPT-5.6 Luna and Terra prices by up to 80%
- Infobae — OpenAI recorta un 80% el precio de GPT-5.6 Luna y un 20% el de Terra para impulsar la eficiencia de costes y velocidad
- Diario TI — OpenAI recorta hasta 80% los precios de GPT-5.6 Luna y Terra
- Apidog — GPT-5.6 price cut
- Anthropic — Claude Opus 5
- 9to5Google — Google launches Gemini 3.6 Flash and 3.5 Flash-Lite, teases Gemini 4
- Expansión — Meta y OpenAI buscan conquistar a los desarrolladores de IA con nuevos modelos
Las noticias son abundantes. El criterio es escaso.
Filtramos el ruido para que solo leas las historias que pueden cambiar una decisión de negocio.
Pensado para directores de marketing, fundadores y equipos de crecimiento.
Por Cesar Baz — Editor de Markital · archivo verificado
Publicado el · Actualizado el