OpenAI API · Precios · Tokens

Precios de OpenAI API: cuánto cuestan GPT-6 y GPT-5.6

Los precios de OpenAI API dependen del modelo, los tokens de entrada y salida, el uso de caché, el tamaño del contexto y determinadas herramientas. Modelos como GPT-6 Astra, GPT-5.6 Sol, Terra y Luna tienen tarifas diferentes según la capacidad y el tipo de workload.

GPT-6 Astra GPT-5.6 Precios por 1M tokens
Respuesta rápida

¿Cuánto cuesta OpenAI API?

El costo depende del modelo utilizado. Actualmente, por cada millón de tokens, GPT-6 Astra cuesta US$10 de entrada y US$50 de salida, GPT-5.6 Sol US$4 y US$20, Terra US$2 y US$12, mientras Luna cuesta US$0,20 de entrada y US$1,20 de salida. El cached input tiene una tarifa inferior.

Comparativa

Precios actuales de GPT-6 y GPT-5.6

Las tarifas siguientes corresponden a texto y se expresan por un millón de tokens.

Modelo Entrada Cached input Salida
GPT-6 Astra US$10,00 US$1,00 US$50,00
GPT-5.6 Sol US$4,00 US$0,40 US$20,00
GPT-5.6 Terra US$2,00 US$0,20 US$12,00
GPT-5.6 Luna US$0,20 US$0,02 US$1,20
Importante

Estos precios corresponden a tokens de texto. Algunas herramientas y modelos especializados pueden tener cargos adicionales o métricas de facturación diferentes.

Publicidad
Facturación

Qué significa entrada, cached input y salida

El costo total de una solicitud puede dividirse en diferentes categorías.

IN

Input tokens

Son los tokens enviados al modelo: instrucciones, contexto, mensajes y datos.

CACHE

Cached input

Parte del contexto puede reutilizarse con un precio inferior cuando cumple las condiciones de caché.

OUT

Output tokens

Son los tokens generados por el modelo como respuesta.

Publicidad
Estrategia de costos

El modelo más potente no siempre es el más rentable

Una aplicación bien optimizada puede utilizar diferentes modelos según la dificultad de cada tarea y reducir considerablemente el costo total.

LUNA

Gran volumen

Ideal para tareas simples y repetitivas con precio mínimo.

TERRA

Equilibrio

Más capacidad cuando Luna no es suficiente.

SOL / ASTRA

Casos complejos

Reserva los modelos más caros para tareas donde aporten valor real.

Máxima capacidad

Precio de GPT-6 Astra

Astra es el modelo más capaz de OpenAI para los trabajos end-to-end más difíciles.

Concepto Precio por 1M tokens
Entrada US$10,00
Cached input US$1,00
Cache write US$12,50
Salida US$50,00
Cuándo vale la pena

Astra tiene sentido cuando la calidad de un trabajo complejo justifica una tarifa superior.

Ver GPT-6 Astra →
Publicidad
Flagship GPT-5.6

Precio de GPT-5.6 Sol

Sol está pensado para trabajo profesional complejo a un costo menor que GPT-6 Astra.

Concepto Precio por 1M tokens
Entrada US$4,00
Cached input US$0,40
Salida US$20,00
Buen equilibrio para trabajo difícil

Para muchos proyectos profesionales, Sol puede ofrecer mejor rendimiento por dólar que Astra.

Ver GPT-5.6 Sol →
Balanced

Precio de GPT-5.6 Terra

Terra está diseñado para equilibrar inteligencia y costo en aplicaciones de producción.

Concepto Precio por 1M tokens
Entrada US$2,00
Cached input US$0,20
Salida US$12,00
Cache writes

OpenAI indica para Terra que las escrituras de caché se cobran actualmente a 1,25× la tarifa de entrada no almacenada.

Producción general

Terra puede ser útil cuando Sol funciona bien, pero su costo resulta demasiado alto para el volumen esperado.

Ver GPT-5.6 Terra →
Cost-sensitive

Precio de GPT-5.6 Luna

Luna es el nivel optimizado específicamente para cargas de gran volumen y bajo costo.

Concepto Precio por 1M tokens
Entrada US$0,20
Cached input US$0,02
Salida US$1,20
La diferencia es grande

Luna cuesta aproximadamente una décima parte de Terra en entrada y salida, por lo que puede transformar la economía de workloads masivos.

Ver GPT-5.6 Luna →
Publicidad
Cálculo

Cómo calcular el costo de una llamada

El cálculo básico consiste en separar entrada y salida.

Fórmula básica

Costo total aproximado

Costo =
(tokens_entrada / 1.000.000 × precio_entrada)
+
(tokens_salida / 1.000.000 × precio_salida)
Cached input

Si parte del contexto califica como entrada almacenada en caché, esa porción debe calcularse con la tarifa de cached input.

Ejemplo

Ejemplo de costo con GPT-5.6 Sol

Supongamos una solicitud con 10.000 tokens de entrada y 2.000 de salida.

Concepto Cálculo Costo
Entrada 10.000 / 1M × US$4 US$0,04
Salida 2.000 / 1M × US$20 US$0,04
Total US$0,04 + US$0,04 US$0,08
Ejemplo simplificado

No incluye herramientas, cache writes, contexto largo ni otros cargos aplicables.

Escala

El volumen cambia completamente la decisión

Una diferencia pequeña por solicitud puede convertirse en cientos o miles de dólares al escalar.

Arquitectura

No uses el mismo modelo para todo

Una estrategia habitual consiste en ejecutar clasificación y extracción con Luna, análisis general con Terra y reservar Sol o Astra para problemas de mayor dificultad.

Prompt caching

La caché puede reducir el costo del contexto repetido

Los modelos actuales publican una tarifa de cached input considerablemente inferior a la entrada estándar.

Modelo Input Cached input
GPT-6 Astra US$10 US$1
GPT-5.6 Sol US$4 US$0,40
GPT-5.6 Terra US$2 US$0,20
GPT-5.6 Luna US$0,20 US$0,02
Especialmente útil con prompts repetidos

Las aplicaciones que reutilizan instrucciones, políticas o grandes bloques de contexto pueden beneficiarse especialmente del caching.

Publicidad
Long context

El contexto muy largo puede costar más

Los modelos actuales admiten ventanas enormes, pero OpenAI aplica una tarifa superior a solicitudes especialmente grandes.

Más de 272K tokens

Multiplicador de precio

En modelos como GPT-6 Astra y GPT-5.6 Luna, las solicitudes con más de 272.000 tokens de entrada se cobran actualmente a 2× en entrada y 1,5× en salida para la solicitud completa.

No envíes contexto innecesario

Tener una ventana de más de un millón de tokens no significa que debas llenarla en todas las solicitudes.

Herramientas

Las herramientas pueden tener precios propios

El costo de una aplicación no siempre se limita a tokens del modelo principal.

WEB

Web Search

Las búsquedas pueden utilizar una tarifa específica por herramienta o llamada.

PC

Computer Use

Los modelos especializados en herramientas pueden tener cargos por uso.

FILE

File Search

Determinadas operaciones de almacenamiento o recuperación pueden tener otra estructura de precio.

Consulta siempre la página oficial de pricing

Las tarifas de herramientas pueden cambiar independientemente del precio de los tokens del modelo principal.

Rendimiento

Fast Mode tiene una tarifa superior

OpenAI también ofrece opciones orientadas a mayor velocidad con precios superiores al procesamiento estándar.

Modelo Entrada Fast Cached Salida Fast
GPT-6 Astra US$20 US$2 US$100
GPT-5.6 Sol US$8 US$0,80 US$40
GPT-5.6 Terra US$4 US$0,40 US$24
GPT-5.6 Luna US$0,40 US$0,04 US$2,40
Fast Mode no es la tarifa estándar

Utilízalo únicamente cuando la mejora de latencia justifique un costo superior.

Publicidad
Importante

ChatGPT Plus y OpenAI API se cobran por separado

Tener una suscripción de ChatGPT no significa disponer automáticamente de consumo incluido en la API.

Producto Facturación
ChatGPT Suscripción o plan del producto
OpenAI API Uso de API y recursos asociados
Optimización

Cómo reducir el costo de OpenAI API

La optimización no consiste solamente en elegir un modelo barato.

01

Model routing: usa Luna para tareas simples y escala casos difíciles.

02

Reduce contexto: no envíes información que el modelo no necesita.

03

Limita output: evita respuestas innecesariamente largas.

04

Aprovecha caché: reutiliza contexto repetido cuando corresponda.

05

Batch: utiliza procesamiento asincrónico cuando no necesites respuesta inmediata.

06

Monitoriza usage: mide el costo real por endpoint y feature.

Decisión

¿Qué modelo ofrece mejor precio?

Depende de cuánto razonamiento y capacidad necesita realmente la tarea.

Necesidad Modelo recomendado
Máxima capacidad GPT-6 Astra
Trabajo profesional complejo GPT-5.6 Sol
Equilibrio capacidad / costo GPT-5.6 Terra
Alto volumen / costo mínimo GPT-5.6 Luna
El precio más bajo no siempre produce el menor costo total

Si un modelo barato obliga a realizar más reintentos, pasos o correcciones, un nivel superior puede resultar más eficiente.

Escalamiento

Precio y rate limits son problemas diferentes

Pagar más consumo no significa automáticamente que puedas enviar solicitudes sin restricciones.

Rate limits

RPM, TPM y usage tiers

Los límites de capacidad dependen del modelo, organización, proyecto y usage tier.

Ver límites de OpenAI API →
Fuente oficial

Consulta siempre los precios oficiales de OpenAI

Los precios pueden cambiar y algunos modelos pueden tener promociones, variantes o tarifas especiales.

OpenAI Developers

Models & Pricing

Revisa la documentación de cada modelo antes de realizar estimaciones de producción.

Consultar precios oficiales →
Publicidad
Sigue aprendiendo

Guías relacionadas con precios de OpenAI API

Continúa con modelos, límites y funcionamiento de la plataforma.

Publicidad
Preguntas frecuentes

FAQ sobre precios de OpenAI API

Respuestas rápidas sobre tokens, caché, modelos y costos.

Depende del modelo, los tokens utilizados y las herramientas. GPT-5.6 Luna es el modelo más económico de la familia actual, mientras GPT-6 Astra tiene una tarifa superior.

Actualmente cuesta US$10 por millón de tokens de entrada y US$50 por millón de tokens de salida.

GPT-5.6 Sol cuesta US$4 por millón de tokens de entrada y US$20 por millón de tokens de salida.

Terra cuesta actualmente US$2 por millón de tokens de entrada y US$12 por millón de tokens de salida.

Luna cuesta US$0,20 por millón de tokens de entrada y US$1,20 por millón de tokens de salida.

Es entrada que puede reutilizarse desde caché y que tiene una tarifa inferior a la entrada estándar cuando cumple los requisitos correspondientes.

No. ChatGPT y OpenAI API tienen sistemas de facturación separados.

Algunas herramientas y modelos especializados utilizan cargos adicionales o métricas diferentes a los tokens estándar.

Puedes utilizar modelos más económicos para tareas simples, reducir contexto, limitar la salida, aprovechar caché y aplicar model routing.

Publicidad
Optimiza tu integración

Revisa ahora los límites de OpenAI API

El precio es solo una parte de una integración en producción. Revisa también RPM, TPM, usage tiers y errores 429.

Ver límites de OpenAI API →
Carrito de compra
Scroll al inicio