Precios de OpenAI API: cuánto cuestan GPT-6 y GPT-5.6
Los precios de OpenAI API dependen del modelo, los tokens de entrada y salida, el uso de caché, el tamaño del contexto y determinadas herramientas. Modelos como GPT-6 Astra, GPT-5.6 Sol, Terra y Luna tienen tarifas diferentes según la capacidad y el tipo de workload.
¿Cuánto cuesta OpenAI API?
El costo depende del modelo utilizado. Actualmente, por cada millón de tokens, GPT-6 Astra cuesta US$10 de entrada y US$50 de salida, GPT-5.6 Sol US$4 y US$20, Terra US$2 y US$12, mientras Luna cuesta US$0,20 de entrada y US$1,20 de salida. El cached input tiene una tarifa inferior.
Precios actuales de GPT-6 y GPT-5.6
Las tarifas siguientes corresponden a texto y se expresan por un millón de tokens.
| Modelo | Entrada | Cached input | Salida |
|---|---|---|---|
| GPT-6 Astra | US$10,00 | US$1,00 | US$50,00 |
| GPT-5.6 Sol | US$4,00 | US$0,40 | US$20,00 |
| GPT-5.6 Terra | US$2,00 | US$0,20 | US$12,00 |
| GPT-5.6 Luna | US$0,20 | US$0,02 | US$1,20 |
Estos precios corresponden a tokens de texto. Algunas herramientas y modelos especializados pueden tener cargos adicionales o métricas de facturación diferentes.
Qué significa entrada, cached input y salida
El costo total de una solicitud puede dividirse en diferentes categorías.
Input tokens
Son los tokens enviados al modelo: instrucciones, contexto, mensajes y datos.
Cached input
Parte del contexto puede reutilizarse con un precio inferior cuando cumple las condiciones de caché.
Output tokens
Son los tokens generados por el modelo como respuesta.
El modelo más potente no siempre es el más rentable
Una aplicación bien optimizada puede utilizar diferentes modelos según la dificultad de cada tarea y reducir considerablemente el costo total.
Gran volumen
Ideal para tareas simples y repetitivas con precio mínimo.
Equilibrio
Más capacidad cuando Luna no es suficiente.
Casos complejos
Reserva los modelos más caros para tareas donde aporten valor real.
Precio de GPT-6 Astra
Astra es el modelo más capaz de OpenAI para los trabajos end-to-end más difíciles.
| Concepto | Precio por 1M tokens |
|---|---|
| Entrada | US$10,00 |
| Cached input | US$1,00 |
| Cache write | US$12,50 |
| Salida | US$50,00 |
Astra tiene sentido cuando la calidad de un trabajo complejo justifica una tarifa superior.
Ver GPT-6 Astra →Precio de GPT-5.6 Sol
Sol está pensado para trabajo profesional complejo a un costo menor que GPT-6 Astra.
| Concepto | Precio por 1M tokens |
|---|---|
| Entrada | US$4,00 |
| Cached input | US$0,40 |
| Salida | US$20,00 |
Para muchos proyectos profesionales, Sol puede ofrecer mejor rendimiento por dólar que Astra.
Ver GPT-5.6 Sol →Precio de GPT-5.6 Terra
Terra está diseñado para equilibrar inteligencia y costo en aplicaciones de producción.
| Concepto | Precio por 1M tokens |
|---|---|
| Entrada | US$2,00 |
| Cached input | US$0,20 |
| Salida | US$12,00 |
OpenAI indica para Terra que las escrituras de caché se cobran actualmente a 1,25× la tarifa de entrada no almacenada.
Terra puede ser útil cuando Sol funciona bien, pero su costo resulta demasiado alto para el volumen esperado.
Ver GPT-5.6 Terra →Precio de GPT-5.6 Luna
Luna es el nivel optimizado específicamente para cargas de gran volumen y bajo costo.
| Concepto | Precio por 1M tokens |
|---|---|
| Entrada | US$0,20 |
| Cached input | US$0,02 |
| Salida | US$1,20 |
Luna cuesta aproximadamente una décima parte de Terra en entrada y salida, por lo que puede transformar la economía de workloads masivos.
Ver GPT-5.6 Luna →Cómo calcular el costo de una llamada
El cálculo básico consiste en separar entrada y salida.
Costo total aproximado
Costo =
(tokens_entrada / 1.000.000 × precio_entrada)
+
(tokens_salida / 1.000.000 × precio_salida)
Si parte del contexto califica como entrada almacenada en caché, esa porción debe calcularse con la tarifa de cached input.
Ejemplo de costo con GPT-5.6 Sol
Supongamos una solicitud con 10.000 tokens de entrada y 2.000 de salida.
| Concepto | Cálculo | Costo |
|---|---|---|
| Entrada | 10.000 / 1M × US$4 | US$0,04 |
| Salida | 2.000 / 1M × US$20 | US$0,04 |
| Total | US$0,04 + US$0,04 | US$0,08 |
No incluye herramientas, cache writes, contexto largo ni otros cargos aplicables.
El volumen cambia completamente la decisión
Una diferencia pequeña por solicitud puede convertirse en cientos o miles de dólares al escalar.
No uses el mismo modelo para todo
Una estrategia habitual consiste en ejecutar clasificación y extracción con Luna, análisis general con Terra y reservar Sol o Astra para problemas de mayor dificultad.
La caché puede reducir el costo del contexto repetido
Los modelos actuales publican una tarifa de cached input considerablemente inferior a la entrada estándar.
| Modelo | Input | Cached input |
|---|---|---|
| GPT-6 Astra | US$10 | US$1 |
| GPT-5.6 Sol | US$4 | US$0,40 |
| GPT-5.6 Terra | US$2 | US$0,20 |
| GPT-5.6 Luna | US$0,20 | US$0,02 |
Las aplicaciones que reutilizan instrucciones, políticas o grandes bloques de contexto pueden beneficiarse especialmente del caching.
El contexto muy largo puede costar más
Los modelos actuales admiten ventanas enormes, pero OpenAI aplica una tarifa superior a solicitudes especialmente grandes.
Multiplicador de precio
En modelos como GPT-6 Astra y GPT-5.6 Luna, las solicitudes con más de 272.000 tokens de entrada se cobran actualmente a 2× en entrada y 1,5× en salida para la solicitud completa.
Tener una ventana de más de un millón de tokens no significa que debas llenarla en todas las solicitudes.
Las herramientas pueden tener precios propios
El costo de una aplicación no siempre se limita a tokens del modelo principal.
Web Search
Las búsquedas pueden utilizar una tarifa específica por herramienta o llamada.
Computer Use
Los modelos especializados en herramientas pueden tener cargos por uso.
File Search
Determinadas operaciones de almacenamiento o recuperación pueden tener otra estructura de precio.
Las tarifas de herramientas pueden cambiar independientemente del precio de los tokens del modelo principal.
Fast Mode tiene una tarifa superior
OpenAI también ofrece opciones orientadas a mayor velocidad con precios superiores al procesamiento estándar.
| Modelo | Entrada Fast | Cached | Salida Fast |
|---|---|---|---|
| GPT-6 Astra | US$20 | US$2 | US$100 |
| GPT-5.6 Sol | US$8 | US$0,80 | US$40 |
| GPT-5.6 Terra | US$4 | US$0,40 | US$24 |
| GPT-5.6 Luna | US$0,40 | US$0,04 | US$2,40 |
Utilízalo únicamente cuando la mejora de latencia justifique un costo superior.
ChatGPT Plus y OpenAI API se cobran por separado
Tener una suscripción de ChatGPT no significa disponer automáticamente de consumo incluido en la API.
| Producto | Facturación |
|---|---|
| ChatGPT | Suscripción o plan del producto |
| OpenAI API | Uso de API y recursos asociados |
Cómo reducir el costo de OpenAI API
La optimización no consiste solamente en elegir un modelo barato.
Model routing: usa Luna para tareas simples y escala casos difíciles.
Reduce contexto: no envíes información que el modelo no necesita.
Limita output: evita respuestas innecesariamente largas.
Aprovecha caché: reutiliza contexto repetido cuando corresponda.
Batch: utiliza procesamiento asincrónico cuando no necesites respuesta inmediata.
Monitoriza usage: mide el costo real por endpoint y feature.
¿Qué modelo ofrece mejor precio?
Depende de cuánto razonamiento y capacidad necesita realmente la tarea.
| Necesidad | Modelo recomendado |
|---|---|
| Máxima capacidad | GPT-6 Astra |
| Trabajo profesional complejo | GPT-5.6 Sol |
| Equilibrio capacidad / costo | GPT-5.6 Terra |
| Alto volumen / costo mínimo | GPT-5.6 Luna |
Si un modelo barato obliga a realizar más reintentos, pasos o correcciones, un nivel superior puede resultar más eficiente.
Precio y rate limits son problemas diferentes
Pagar más consumo no significa automáticamente que puedas enviar solicitudes sin restricciones.
RPM, TPM y usage tiers
Los límites de capacidad dependen del modelo, organización, proyecto y usage tier.
Ver límites de OpenAI API →Consulta siempre los precios oficiales de OpenAI
Los precios pueden cambiar y algunos modelos pueden tener promociones, variantes o tarifas especiales.
Models & Pricing
Revisa la documentación de cada modelo antes de realizar estimaciones de producción.
Consultar precios oficiales →Guías relacionadas con precios de OpenAI API
Continúa con modelos, límites y funcionamiento de la plataforma.
FAQ sobre precios de OpenAI API
Respuestas rápidas sobre tokens, caché, modelos y costos.
Depende del modelo, los tokens utilizados y las herramientas. GPT-5.6 Luna es el modelo más económico de la familia actual, mientras GPT-6 Astra tiene una tarifa superior.
Actualmente cuesta US$10 por millón de tokens de entrada y US$50 por millón de tokens de salida.
GPT-5.6 Sol cuesta US$4 por millón de tokens de entrada y US$20 por millón de tokens de salida.
Terra cuesta actualmente US$2 por millón de tokens de entrada y US$12 por millón de tokens de salida.
Luna cuesta US$0,20 por millón de tokens de entrada y US$1,20 por millón de tokens de salida.
Es entrada que puede reutilizarse desde caché y que tiene una tarifa inferior a la entrada estándar cuando cumple los requisitos correspondientes.
No. ChatGPT y OpenAI API tienen sistemas de facturación separados.
Algunas herramientas y modelos especializados utilizan cargos adicionales o métricas diferentes a los tokens estándar.
Puedes utilizar modelos más económicos para tareas simples, reducir contexto, limitar la salida, aprovechar caché y aplicar model routing.
Revisa ahora los límites de OpenAI API
El precio es solo una parte de una integración en producción. Revisa también RPM, TPM, usage tiers y errores 429.
Ver límites de OpenAI API →