El 21 de agosto de 2026, OpenAI recortó oficialmente de nuevo el precio de la API de GPT-5.6 Sol: la entrada bajó de 5 a 4 dólares por millón de tokens, y la salida bajó de 30 a 20 dólares, una reducción de más del 20%, vigente al menos hasta el 21 de noviembre. Esto se produce después de los recortes del 30 de julio para Terra (−20%) y Luna (−80%): la segunda ronda oficial de recortes de precios de GPT-5.6 en dos meses. Tras este recorte, el precio de lista de Sol ya está por debajo del de Claude Opus 5 (5 dólares de entrada / 25 de salida), pero eso no lo convierte automáticamente en "la opción más económica": todavía hay que considerar el Fast Mode, la caché, los precios de contexto largo y el procesamiento por lotes (Batch) antes de saber cuánto pagarás realmente.
El precio completo de GPT-5.6 hoy: Sol, Terra y Luna
Así está el precio oficial más reciente de agosto de 2026 (por millón de tokens, en dólares, modo Standard):
Contexto corto (Short context):
GPT-5.6 Sol: entrada $4.00, entrada en caché $0.40, escritura en caché $5.00, salida $20.00
GPT-5.6 Terra: entrada $2.00, entrada en caché $0.20, escritura en caché $2.50, salida $12.00
GPT-5.6 Luna: entrada $0.20, entrada en caché $0.02, escritura en caché $0.25, salida $1.20
Contexto largo (Long context, generalmente solicitudes por encima de cierto umbral de tokens):
GPT-5.6 Sol: entrada $8.00, entrada en caché $0.80, escritura en caché $10.00, salida $30.00
GPT-5.6 Terra: entrada $4.00, entrada en caché $0.40, escritura en caché $5.00, salida $18.00
GPT-5.6 Luna: entrada $0.40, entrada en caché $0.04, escritura en caché $0.50, salida $1.80
Notarás que el precio de entrada en contexto largo es exactamente el doble del de contexto corto, pero la salida no aumenta en la misma proporción (por ejemplo, la salida de Sol solo sube de 20 a 30, no a 40). Esto significa que OpenAI aplica una lógica de incremento distinta para "salida más larga" frente a "entrada más larga", así que al estimar el costo de documentos largos o conversaciones extensas no basta con multiplicar por dos.
No es el primer recorte: en dos meses, OpenAI ha bajado el precio de GPT-5.6 en dos etapas
Este recorte no ocurrió de la nada, sino que es continuación de una acción anterior:
El 30 de julio, OpenAI anunció en su comunidad de desarrolladores que el equipo de GPT-5.6 le encargó al propio modelo optimizar su eficiencia de ejecución, y obtuvo dos resultados: una reducción del 20% en los costos de servicio gracias a mejoras en los kernels de GPU en producción, y una mejora de más del 15% en la eficiencia de generación de tokens mediante una decodificación especulativa (speculative decoding) mejorada. OpenAI trasladó esas mejoras de eficiencia directamente al precio: Luna bajó un 80%, Terra un 20%, y al mismo tiempo Sol incorporó el Fast Mode (hasta 2.5 veces más rápido que el modo Standard, al doble de precio).
El 21 de agosto, OpenAI anunció que Sol bajaría más de un 20% (entrada −20%, salida −33%), aclarando explícitamente que esto "se aplica al Fast Mode, a las solicitudes de contexto largo, y al procesamiento Batch y Flex"; es decir, este recorte no afecta solo un precio de entrada, sino toda la curva de precios. OpenAI también explicó que este ajuste "abarca la API, los créditos de Codex, y se está expandiendo gradualmente a los planes elegibles de ChatGPT Work", pero el precio de los planes de suscripción Pro, Plus y Business no cambia; esto recuerda que la facturación de la API y la del consumo por suscripción son dos sistemas de precios completamente independientes: un recorte de un lado no se refleja automáticamente en el otro.
Fast Mode (antes Priority): ¿cuánto más caro es que el Standard y cuándo conviene usarlo?
Fast Mode es el nuevo nombre oficial de "procesamiento Priority" desde el 30 de julio de 2026. En tus solicitudes a la API puedes seguir usando `service_tier: "priority"`, o cambiar al nuevo nombre `service_tier: "fast"`; ambos son equivalentes. El precio de Fast Mode tras el recorte (contexto corto):
GPT-5.6 Sol: entrada $8.00, entrada en caché $0.80, escritura en caché $10.00, salida $40.00
GPT-5.6 Terra: entrada $4.00, entrada en caché $0.40, escritura en caché $5.00, salida $24.00
GPT-5.6 Luna: entrada $0.40, entrada en caché $0.04, escritura en caché $0.50, salida $2.40
En resumen: Fast Mode cuesta uniformemente el doble que Standard, a cambio de hasta 2.5 veces más velocidad de procesamiento, sin cambios en la capacidad del modelo. Si tu aplicación es atención al cliente en tiempo real o interacción de voz —donde el usuario está esperando—, pagar el doble por menor latencia suele valer la pena. Si es una tarea por lotes en segundo plano o un informe fuera de horas pico, pagar por velocidad no tiene sentido; en ese caso conviene ir directamente a Batch/Flex, que se explica a continuación.
Batch y Flex: la mitad de precio, a cambio de esperar
Los modos de procesamiento Batch y Flex tienen exactamente el mismo precio, ambos con un 50% de descuento sobre Standard (contexto corto):
GPT-5.6 Sol: entrada $2.00, entrada en caché $0.20, escritura en caché $2.50, salida $10.00
GPT-5.6 Terra: entrada $1.00, entrada en caché $0.10, escritura en caché $1.25, salida $6.00
GPT-5.6 Luna: entrada $0.10, entrada en caché $0.01, escritura en caché $0.125, salida $0.60
La diferencia es que Batch envía un conjunto de solicitudes de forma asíncrona y espera a que se completen, ideal para consolidar informes, resumir grandes volúmenes de documentos y otras tareas donde no necesitas el resultado de inmediato. Flex es otro modo de procesamiento flexible de OpenAI, con el mismo precio que Batch pero con una forma de uso distinta. Ninguno de los dos es adecuado para escenarios que requieren responder al usuario de forma inmediata.
Modelos Cyber (Daybreak): otra lista de precios, que la mayoría no necesitará
La familia GPT-5.6 también tiene una rama independiente llamada modelos Cyber, correspondiente al programa Daybreak de OpenAI, que por ahora solo tiene precio de contexto corto: GPT-5.6 Sol se mantiene en $4.00 / $0.40 / $5.00 / $20.00 (igual que el Sol normal), mientras que GPT-5.6 Cyber cuesta $12.50 de entrada / $1.25 de entrada en caché / $15.625 de escritura en caché / $75.00 de salida, notablemente varias veces más caro. La documentación oficial también indica que los alias `daybreak-blue-latest` y `daybreak-red-latest` actualmente apuntan a `gpt-5.6-sol` y `gpt-5.6-cyber` respectivamente, y se actualizarán —con precios ajustados— a medida que el programa Daybreak lance nuevos modelos. Si tu aplicación no está relacionada con evaluación de ciberseguridad, ejercicios de red team o casos similares del programa Daybreak, normalmente no te encontrarás con el precio del modelo Cyber.
La promoción dura hasta el 21 de noviembre de 2026: ¿subirá el precio después?
La documentación oficial dice claramente que "el precio promocional de GPT-5.6 Sol se mantendrá al menos hasta el 21 de noviembre de 2026"; nota que la expresión usada es "al menos", lo que significa que OpenAI no ha prometido que el precio vuelva a los $5/$30 originales al terminar la promoción, ni tampoco ha prometido mantenerlo en $4/$20. En los foros de la comunidad de desarrolladores de OpenAI, las opiniones están divididas: algunos creen que la presión competitiva —sobre todo de modelos de código abierto y de la guerra de precios entre proveedores— hará que el descuento continúe; otros creen que es probable que dentro de tres meses salga una nueva generación de modelos, momento en el que la estrategia de precios del modelo anterior quedaría superada de todos modos. Por ahora no hay ningún anuncio oficial que confirme esto: es una especulación de la comunidad, no un hecho comprobado. Al planificar tu presupuesto más allá de noviembre, conviene contemplar tanto el escenario de "el descuento se mantiene" como el de "vuelve el precio original", sin apostar todo a uno solo.
¿Es GPT-5.6 Sol realmente más barato que Claude Opus 5?
Poniendo lado a lado los precios oficiales de ambos: GPT-5.6 Sol (Standard, contexto corto) cuesta $4.00 de entrada / $20.00 de salida; Claude Opus 5 (Standard) cuesta $5 de entrada / $25 de salida. Solo mirando el precio de lista, Sol efectivamente es más bajo en ambas dimensiones que Opus 5. Pero esta comparación tiene dos limitaciones que debes tener en cuenta: primero, ambas empresas usan tokenizadores distintos, así que el mismo texto no genera la misma cantidad de tokens en Sol y en Opus 5; un precio de lista más bajo no garantiza una factura real más baja para la misma tarea. Segundo, Claude Opus 5 ofrece un 50% de descuento en Batch ($2.50 / $12.50) y hasta un 90% de descuento con caché de prompts, mientras que el descuento de Batch de GPT-5.6 Sol también es del 50% ($2.00 / $10.00), pero con una estructura de caché diferente (la entrada en caché de Sol es una décima parte del precio estándar, mientras que la lectura de caché de Opus 5 es 0.1 veces el precio de entrada, y la escritura es 1.25 o 2 veces según sea una escritura de 5 minutos o de 1 hora). Lo que realmente conviene comparar no es el número destacado en el anuncio, sino la factura real que genera tu carga de trabajo específica.
Decisiones de compra empresarial: una noticia de recorte de precios no significa que debas cambiar de modelo de inmediato
Ver una noticia de recorte de precios y querer cambiar toda tu pipeline de inmediato es la manera más fácil de terminar gastando más dinero. Antes de hacer el cambio, confirma tres cosas: en qué modo está distribuido tu uso actual (Standard / Fast Mode / Batch), y si el recorte realmente cubre el modo que usas; qué tan sensible es tu tarea a la latencia —si en realidad es una tarea en segundo plano, el recorte de Fast Mode no te afecta—; y si estás usando la opción de Data Residency (residencia de datos). La documentación oficial indica que los endpoints de procesamiento regional tienen un recargo del 10% para modelos elegibles lanzados a partir del 5 de marzo de 2026, y la familia GPT-5.6 entra en ese rango, así que el precio tras el recorte debe multiplicarse por 1.1 para reflejar tu costo real de procesamiento regional. Aclara estos tres puntos antes de decidir si mueves tu pipeline.
Preguntas frecuentes
P1: Tras este recorte, ¿los créditos de ChatGPT Work o Codex que ya compré se abaratarán automáticamente? El anuncio oficial dice que el recorte "abarca la API, los créditos de Codex, y se está expandiendo gradualmente a los planes elegibles de ChatGPT Work", pero el precio de los planes de suscripción Pro, Plus y Business no cambia. Es decir, si usas API o créditos de Codex, el descuento normalmente se aplicará de forma automática; pero si eres usuario de suscripción, este recorte no afecta el costo de tu suscripción.
P2: ¿El precio subirá seguro a $5/$30 cuando termine la promoción el 21 de noviembre de 2026? Por ahora OpenAI no ha anunciado qué pasará al terminar la promoción; solo dice que se mantendrá "al menos" hasta esa fecha. Este es un evento futuro aún no confirmado; puedes tenerlo en cuenta, pero no deberías tratarlo como un hecho seguro para planificar tu presupuesto a largo plazo.
P3: ¿Fast Mode es lo mismo que el antiguo procesamiento Priority? Sí. La documentación oficial indica que "Priority processing was renamed Fast mode on July 30, 2026" (el procesamiento Priority se renombró a Fast Mode el 30 de julio de 2026). El parámetro de la API `service_tier` puede seguir usando `"priority"`, o puedes cambiar al nuevo nombre `"fast"`; el efecto es el mismo.
P4: ¿Este recorte también se aplica a Batch y a contexto largo? Sí. El anuncio oficial del 21 de agosto menciona que "la reducción de precio también se aplica al Fast Mode, a las solicitudes de contexto largo, y al procesamiento Batch y Flex". Los precios de cada modo listados en este artículo ya son las cifras oficiales más recientes tras el recorte.
P5: ¿Es GPT-5.6 Sol realmente más barato que Claude Opus 5? Comparando los precios de lista oficiales, el precio de entrada y salida de Sol son ambos más bajos que los de Opus 5. Pero como los tokenizadores de ambas empresas son distintos, y las estructuras de descuento por caché y Batch también difieren, el gasto total real debe basarse en una prueba con tu propia carga de trabajo, no solo en el precio unitario destacado en el titular.
P6: ¿En qué se diferencia GPT-5.6 Cyber del Sol normal, y debería preocuparme por eso? Cyber es una rama de modelo independiente correspondiente al programa Daybreak (relacionado con evaluación de ciberseguridad), con un precio notablemente más alto que el Sol normal (la salida llega a $75) y por ahora solo con precio de contexto corto. Si tu aplicación no está relacionada con evaluación de seguridad o ejercicios de red team, normalmente no lo usarás ni necesitas prestarle atención a este precio.
Declaración de fuentes
Las cifras de este artículo fueron verificadas al 25 de agosto de 2026, con base en las siguientes fuentes oficiales:
Página oficial de precios de OpenAI, Pricing | OpenAI API (verificado el 2026-08-25)
Anuncio oficial de la comunidad de desarrolladores de OpenAI, «20% price reduction for GPT 5.6 Sol: API, Codex credits and ChatGPT Work», publicado el 21 de agosto de 2026 (verificado el 2026-08-25)
Anuncio oficial de la comunidad de desarrolladores de OpenAI, «Announcing a major Price drop for 5.6 Terra and Luna and Fast mode for 5.6-Sol», publicado el 30 de julio de 2026 (verificado el 2026-08-25)
Página oficial de precios de Anthropic, Pricing - Claude Platform Docs (verificado el 2026-08-25), usada como base para las cifras de comparación de Claude Opus 5
Si estás evaluando si este recorte de precios justifica un cambio en tu combinación de modelos, o quieres entender exactamente en qué se está gastando tu consumo de tokens, visita Ai Token para una prueba gratuita: primero entiende tu factura, y luego decide si cambiar.