GPT-5.6: Luna 80% más barato y Terra 20% menos

En pocas palabras: El 23 de julio de 2026 OpenAI recortó los precios de GPT-5.6: Luna, el modelo más rápido, quedó 80% más barato y Terra 20% menos. Además, Sol estrenó un modo Fast hasta 2,5× más veloz que el procesamiento estándar.

Si venías pagando de más por tareas simples, esto te interesa: el precio de GPT-5.6 Luna y Terra bajó fuerte el 23 de julio de 2026. Luna, el modelo más rápido y barato de OpenAI, quedó 80% más barato, y Terra, el balanceado para el día a día, un 20% menos. Sol, además, estrenó un modo Fast hasta 2,5× más veloz.

GPT-5.6 es la familia de modelos de lenguaje de OpenAI de 2026, dividida en tres variantes: Sol (máxima capacidad para tareas complejas), Terra (balanceado para trabajo cotidiano) y Luna (el más rápido y económico, pensado para alto volumen). El 23 de julio de 2026 OpenAI recortó los precios de Luna en 80% y de Terra en 20%, y sumó un modo Fast para Sol en la API que reemplaza al viejo Priority Processing.

En 30 segundos

  • Luna: 80% más barato desde el 23/07/2026, el modelo más rápido y económico de la familia.
  • Terra: 20% más barato, la opción balanceada para trabajo de rutina.
  • Fast mode para Sol: hasta 2,5× más rápido que el procesamiento estándar. Reemplaza a Priority Processing.
  • Cuenta en tus suscripciones: los precios menores de Luna y Terra también aplican al uso en Codex y ChatGPT Work.
  • Luna ya no es un juguete: usa herramientas y completa flujos multi-paso, así que sirve para apps a escala.

GPT es un modelo de lenguaje grande desarrollado por OpenAI, diseñado para generar texto y responder preguntas. Se entrena mediante aprendizaje supervisado y por refuerzo a partir de datos de internet.

¿Qué anunció OpenAI sobre GPT-5.6 el 23 de julio de 2026?

OpenAI pasó a los clientes las mejoras de eficiencia que había logrado en la infraestructura, con precios más bajos para Luna y Terra y un procesamiento más veloz para Sol. Según el anuncio oficial, el día anterior la empresa había explicado cómo hizo cada capa del sistema más barata de correr, y este movimiento traslada esa ganancia a la factura del usuario.

El mensaje de fondo es el de siempre en OpenAI: hacer la inteligencia avanzada más abundante y accesible. Lindo para el press release. Lo concreto, y lo que te importa, es que la misma calidad ahora cuesta menos.

Ojo con un detalle. El anuncio comunica los recortes en porcentaje (80% y 20%), no publica en esa nota una tabla de precios por token. Así que cualquier número de tarifa exacto conviene chequearlo en el tarifario oficial de la API antes de armar tu presupuesto.

¿Cuáles son los nuevos precios de GPT-5.6 Luna y Terra?

El precio de GPT-5.6 Luna bajó 80% y el de Terra bajó 20%, con vigencia desde el 23 de julio de 2026. En criollo: lo que antes te costaba correr Luna, ahora te sale una quinta parte. Con Terra pagás el 80% de lo de antes. Y esos precios más bajos no son solo para la API: también cambian cómo se cuenta tu consumo contra las suscripciones pagas cuando usás Codex y ChatGPT Work. Sobre eso hablamos en si nunca usaste ChatGPT antes.

¿Por qué el recorte es tan desparejo entre uno y otro? Porque OpenAI empujó más fuerte en el modelo pensado para volumen. Luna es el que corre millones de llamadas repetitivas, y ahí un 80% de descuento cambia qué proyectos cierran y cuáles no.

Terra queda como el punto medio sensato: más barato que antes, sin resignar la calidad para trabajo cotidiano.

¿Cuál es la diferencia de capacidades entre Sol, Terra y Luna?

Cada modelo apunta a un tipo de tarea distinto: Sol es el modelo de máxima capacidad para lo complejo, Terra es el caballito de batalla del día a día, y Luna es el veloz y económico para procesar a lo bestia. La gracia del ajuste de julio es que Luna, sin dejar de ser el más barato, según OpenAI mantiene “muy altos niveles de calidad”, usa herramientas y completa flujos multi-paso. Eso lo saca del casillero de “solo para clasificar texto” y lo mete en aplicaciones de verdad.

ModeloPara qué esPrecio (jul 2026)Novedad
GPT-5.6 SolTareas complejas y razonamientoSin recorte anunciadoModo Fast, hasta 2,5× más rápido
GPT-5.6 TerraTrabajo cotidiano, balanceado−20%Precio menor también en Codex y ChatGPT Work
GPT-5.6 LunaAlto volumen, rápido y barato−80%Usa herramientas y flujos multi-paso
gpt-5.6 precio luna terra diagrama explicativo

El patrón que conviene adoptar es simple: Sol para lo que necesita cabeza, Terra para la rutina, Luna para el volumen. Mandar todo al modelo más pesado “por las dudas” es la forma más rápida de inflar la factura sin ganar nada.

¿Qué es el nuevo modo Fast y cuánta velocidad gana de verdad?

Fast mode es una opción de infraestructura en la API que hace correr a GPT-5.6 Sol hasta 2,5× más rápido que el procesamiento estándar, y reemplaza a la oferta anterior de Priority Processing. No es un modelo nuevo ni más inteligente. Es el mismo Sol, servido más rápido, para cuando el tiempo de respuesta importa. Revisá nuestro análisis completo de GPT para más detalles.

¿Dónde te cambia la vida? En aplicaciones interactivas. Un asistente de código dentro del IDE, un chat en vivo, cualquier cosa donde el usuario está esperando la respuesta mirando la pantalla. Ahí, que Sol conteste más de dos veces más rápido se nota.

Eso sí: la velocidad extra no es gratis. Fast mode tiene un costo más alto que el procesamiento estándar (lógico, estás pagando prioridad), así que reservalo para lo que de verdad necesita responder ya y dejá el resto en Standard.

¿Dónde puedo usar GPT-5.6 Luna, Terra y Sol?

El anuncio de OpenAI menciona tres lugares de forma explícita: la API, Codex y ChatGPT Work. En la API elegís el modelo que quieras (Sol, Terra o Luna) y Fast mode vive ahí. En Codex y ChatGPT Work, los precios más bajos de Luna y Terra ya se reflejan en cómo se descuenta tu consumo del plan pago.

Para el resto de los tiers (por ejemplo, qué modelos ves en un plan personal de ChatGPT), la nota oficial no da un desglose detallado. Si dependés de eso para tu flujo, chequealo en la documentación de OpenAI en vez de asumir. La regla práctica: si querés elegir Luna a mano, el camino seguro es la API o los entornos donde aparece el selector de modelo.

¿Cuánto voy a ahorrar usando Luna en lugar de Sol?

Con un recorte del 80% en Luna, una carga de trabajo de alto volumen que hoy corrés en un modelo más caro puede pasar a costar cerca de una quinta parte, siempre que la tarea tolere el modelo más liviano. Es matemática directa sobre el descuento anunciado, no una tarifa oficial: ponele que una app de etiquetado te gasta $1.000 al mes con un modelo caro; migrando la parte repetitiva a Luna, esa porción tiende a bajar a algo así como $200. El número exacto depende de tu mix de tokens y de cuánto podés mover a Luna. Más contexto en en la comparativa de precios y benchmarks.

La cuenta conceptual es fácil: identificás qué porcentaje de tus llamadas son “tontas” (clasificar, enrutar, resumir, extraer) y esas se van a Luna. El razonamiento pesado se queda en Sol. El punto es que ese reparto, que antes no cerraba por costo, ahora sí.

No te obsesiones con el centavo. El ahorro real aparece cuando dejás de pagar un modelo premium por trabajo que no lo necesita.

¿Qué aplicaciones de alto volumen ahora son viables con Luna?

Con Luna 80% más barato y capaz de usar herramientas, se vuelven factibles cargas que antes eran prohibitivas por costo: procesamiento batch masivo (resúmenes, etiquetado, enrutamiento de tickets), generación de contenido a escala y automatización de tareas repetibles. La propia OpenAI lo enmarca así: Luna hace “práctico correr a escala” un rango más amplio de aplicaciones de IA.

Pensá en un flujo típico de soporte. Entra un ticket, Luna lo clasifica y lo enruta, arma un borrador de respuesta y consulta una herramienta interna, todo por centavos; solo los casos raros o delicados escalan a Sol, que es donde de verdad querés el músculo caro. Ese esquema de tres capas es el que la comunidad ya venía recomendando, y ahora los números lo acompañan.

Para equipos en Latinoamérica esto abre la puerta a automatizar procesos que antes no daban el ROI. Si vas a desplegar una de estas apps de alto volumen, vas a necesitar donde alojar el backend que orquesta las llamadas, y ahí un hosting o VPS en la región como donweb.com te baja latencia y te simplifica el soporte en tu huso horario. La API la ponés vos; la infraestructura que la consume conviene tenerla cerca.

Errores comunes al elegir modelo y precio en GPT-5.6

  • Mandar tareas simples a Sol por inercia. Es el error más caro y el más frecuente. Clasificar un texto o extraer un campo no necesita el modelo top. Revisá tus llamadas y mové todo lo rutinario a Luna o Terra: la factura baja sola.
  • Creer que Fast mode es un modelo mejor. No lo es. Es el mismo Sol servido más rápido, y cuesta más. Si tu tarea no es interactiva y el usuario no está esperando en vivo, Standard te alcanza y pagás menos.
  • Asumir que cualquier plan te da acceso libre a Luna. El anuncio nombra la API, Codex y ChatGPT Work. Antes de diseñar tu app suponiendo que vas a elegir Luna a mano, confirmá en qué entorno estás y qué selector tenés disponible.

Preguntas Frecuentes

¿Cuánto bajó el precio de GPT-5.6 Luna?

El precio de GPT-5.6 Luna bajó 80% desde el 23 de julio de 2026, según el anuncio oficial de OpenAI. Es el modelo más rápido y económico de la familia, y el recorte también se refleja en cómo se cuenta tu consumo en Codex y ChatGPT Work. Esto se conecta con lo que analizamos en como ves en aplicaciones empresariales reales.

¿Cuánto más rápido es el modo Fast de GPT-5.6 Sol?

Fast mode hace correr a GPT-5.6 Sol hasta 2,5× más rápido que el procesamiento estándar. Es una opción de infraestructura en la API que reemplaza a Priority Processing, pensada para aplicaciones interactivas donde la latencia importa. No cambia la inteligencia del modelo, solo la velocidad de respuesta.

¿Cuándo debería usar Terra en vez de Sol o Luna?

Terra es la opción para trabajo cotidiano que necesita más criterio que una tarea de clasificación pero no llega a razonamiento complejo. Quedó 20% más barato en julio de 2026. Usalo como punto medio: Sol para lo difícil, Luna para el volumen masivo, Terra para la rutina que está en el medio.

¿Los precios más bajos aplican a mi suscripción de ChatGPT Work?

Sí. OpenAI confirmó que los precios menores de Luna y Terra se reflejan en cómo se cuenta el uso contra las suscripciones pagas al usar Codex y ChatGPT Work. Es decir, tu mismo plan rinde para más trabajo con esos dos modelos.

¿Fast mode cuesta lo mismo que el procesamiento estándar?

No. Fast mode tiene un costo más alto que Standard porque estás pagando por prioridad y velocidad. Conviene reservarlo para aplicaciones en tiempo real (chat en vivo, asistentes dentro del IDE) y dejar en Standard todo lo que puede esperar unos segundos.

Conclusión

Lo que cambió el 23 de julio de 2026 no es un modelo nuevo, es la economía de usarlos. Con Luna 80% más barato y Terra 20% menos, OpenAI corrió la frontera de qué tareas cierran por costo, y de paso metió un modo Fast para cuando Sol tiene que responder ya.

¿Qué hacer con esto? Auditá tus llamadas actuales. Todo lo repetitivo se va a Luna, la rutina a Terra, el razonamiento a Sol, y Fast mode solo donde el usuario está esperando en vivo. Ese reparto en tres capas, que antes era una idea linda pero cara, ahora es la forma sensata de no tirar plata. La inteligencia se abarató; aprovecharla bien sigue dependiendo de vos.

Fuentes

Desplazarse hacia arriba