Diez dólares de entrada, cincuenta de salida. Eso es lo que cuesta un millón de tokens de GPT-6 Astra a través de la API, y es el doble de la tarifa de lista del modelo insignia anterior. Si esperabas una mejora barata, esa cifra duele. El detalle es que GPT-6 no tiene un único precio. Es una familia de tres niveles, y el modelo más pequeño cuesta alrededor del 1 % del más grande.
Este artículo reúne todas las cifras en un solo lugar: tarifas por token de Astra, Sol y Luna, los recargos que inflan las facturas sin avisar, lo que cuestan 100.000 solicitudes reales, quién puede llamar a la API y qué opciones gratuitas funcionan de verdad. Los precios provienen de rastreadores públicos de precios a principios de octubre, así que tómalos como una foto del momento y confírmalos en la página de precios de OpenAI antes de comprometer un presupuesto.
Cuánto cuesta GPT-6 por token
Astra se presentó como vista previa limitada el 3 de septiembre y se abrió al público al día siguiente. Sol y Luna llegaron el 22 de septiembre. Los tres comparten una ventana de contexto de aproximadamente un millón de tokens, con hasta 128K tokens de salida, aunque los rastreadores no coinciden en la cifra exacta (1,05 M frente a 1,1 M).
Astra, el precio del modelo insignia
Astra está pensado para trabajos largos y agénticos: uso del equipo, automatización del navegador, tareas grandes de programación. Esa ambición tiene un precio.
| Línea de facturación | Precio por 1M de tokens |
|---|
| Entrada | $10,00 |
| Entrada en caché | $1,00 |
| Salida | $50,00 |
| Entrada por encima de 272K tokens | $20,00 |
| Salida por encima de 272K tokens | $75,00 |
| Lote o Flex (entrada / salida) | $5,00 / $25,00 |
La salida es la parte más cara. Cada token que escribe el modelo cuesta cinco veces lo que cuesta un token que lee, y los modelos con mucho razonamiento escriben bastante, incluidos los tokens de pensamiento que nunca ves en la respuesta final. Una primera prueba de terceros situó a Astra en unos $167 por tarea terminada en benchmarks agregados, lo que muestra lo rápido que se acumulan las ejecuciones agénticas.

Sol y Luna para presupuestos más ajustados
Esta es toda la familia, lado a lado.
| Modelo | Entrada | Entrada en caché | Salida | Para qué sirve |
|---|
| GPT-6 Astra | $10,00 | $1,00 | $50,00 | Agentes, programación compleja, investigaciones largas |
| GPT-6 Sol | $2,00 | $0,10 | $10,00 | Programación diaria, redacción, respuestas de soporte |
| GPT-6 Luna | $0,10 | $0,01 | $0,50 | Enrutamiento, etiquetado, respuestas cortas en volumen |
Sol cuesta una quinta parte de lo que cuesta Astra en cada línea. Luna cuesta una centésima. Piensa en tres tazas de café: la misma bebida, una factura muy distinta.
Las tarifas por token son abstractas, así que aquí va una traducción aproximada. Un token equivale a unas tres cuartas partes de una palabra en inglés. Un solo dólar de salida de Astra compra unas 15.000 palabras, cerca de un informe de 30 páginas. Ese mismo dólar compra unas 75.000 palabras en Sol y alrededor de 1,5 millones de palabras en Luna. Leer es más barato que escribir en todos los niveles, por eso resumir un documento largo cuesta mucho menos que redactarlo.

La generación anterior no es automáticamente más barata. Según un rastreador de precios, GPT 5.6 Sol cuesta $4 de entrada y $20 de salida durante una promoción que dura hasta el 21 de noviembre, lo que hace que GPT-6 Sol sea la línea más barata dentro del mismo nivel con ese nombre. GPT 5.6 Terra figura en $2 y $12, y GPT 5.6 Luna en $0,20 y $1,20, el doble de la tarifa de GPT-6 Luna.
💡 Lectura rápida: si tu carga de trabajo no necesita agentes ni razonamiento profundo, el nivel Sol es el nuevo punto de partida para calcular precios. Astra es la excepción, no la base.
Entonces, ¿cuándo vale la pena pagar cinco veces el precio de Sol por Astra? Cuando una ejecución fallida cuesta más que la diferencia de precio: un agente que consume una hora de tiempo de un ingeniero, o un borrador legal que, de otro modo, necesitaría tres rondas de revisión. El punto de equilibrio es sencillo. Si Sol necesita más de cinco intentos para igualar un buen resultado de Astra, Astra gana solo por precio. Si Sol llega ahí en dos o tres, estás pagando de más.
Recargos que inflan la factura
Los prompts largos duplican la tarifa
Al superar los 272K tokens de entrada, se recalcula toda la solicitud, no solo los tokens extra. La entrada salta de $10 a $20 por millón, y la salida, de $50 a $75.
Imagina un paquete de contratos de 300K tokens con un resumen de 2K tokens como respuesta:
- A la tarifa de contexto largo: $6,00 de entrada más $0,15 de salida, o sea, $6,15.
- Recortado a 270K tokens a la tarifa estándar: $2,70 más $0,10, o sea, $2,80.
Treinta mil tokens extra duplicaron con creces el precio de la misma solicitud.

💡 Consejo: mantén un contador de tokens en tu pipeline y divide los documentos grandes justo por debajo del umbral en lugar de enviar un único prompt gigante.
Modo rápido y sobrecargo regional
Otros dos multiplicadores se esconden en la letra pequeña:
- El modo rápido cuesta aproximadamente el doble de la tarifa estándar ($20 de entrada y $100 de salida en Astra) a cambio de unas 2,5 veces más velocidad. No está disponible con residencia de datos en la UE.
- Los endpoints con residencia de datos añaden un 10 % sobre el nivel que hayas elegido.
Súmalos y una llamada a Astra aparentemente inocente puede costar más del doble de su precio de lista. Decide con intención, no por defecto.
El modo rápido justifica su sobreprecio cuando una persona espera la respuesta, como un asistente de programación interactivo o un chat de soporte en vivo. Es un desperdicio en trabajos nocturnos donde nadie mira el reloj. Esos deben ir a la cola de lotes, a mitad de precio.
Costos mensuales reales en dólares
Un ticket de soporte, calculado
Toma un bot de soporte en el que cada ticket usa 2.000 tokens de entrada y 500 de salida. En Astra, eso son $0,02 por el prompt más $0,025 por la respuesta, o sea, $0,045 por ticket. Un número pequeño, hasta que lo multiplicas.

La misma carga de trabajo en tres niveles
Aquí tienes ese ticket exacto a 100.000 tickets al mes:
| Modelo | Por ticket | 100.000 tickets | Con descuento por lote |
|---|
| GPT-6 Astra | $0,045 | $4.500 | $2.250 |
| GPT-6 Sol | $0,009 | $900 | $450 |
| GPT-6 Luna | $0,00045 | $45 | $22,50 |
El caché añade otra palanca. Si 1.500 de esos 2.000 tokens de entrada son siempre el mismo prompt de sistema y los mismos ejemplos, Astra baja a $0,0315 por ticket, o sea, $3.150 al mes. Eso ahorra $1.350 sin tocar la calidad.
💡 Regla práctica: en Astra, una respuesta de 500 tokens ($0,025) cuesta más que un prompt de 2.000 tokens ($0,02). La longitud de la salida decide la factura.
Los tickets de soporte son solo una forma de carga de trabajo. Aquí tienes tres más, calculadas a tarifa estándar y sin descuentos, para que encuentres la que más se parezca a tu proyecto:
| Carga de trabajo | Tokens por solicitud | Solicitudes al mes | Luna | Sol | Astra |
|---|
| App de chat de un desarrollador en solitario | 1.000 de entrada, 400 de salida | 5.000 | $1,50 | $30 | $150 |
| Equipo de contenidos con borradores | 3.000 de entrada, 2.500 de salida | 300 | $0,47 | $9,30 | $46,50 |
| Ejecuciones de agentes de programación | 200.000 de entrada, 30.000 de salida | 440 | $15,40 | $308 | $1.540 |
La tabla calcula tokens, no calidad. Un agente con Luna no igualará a uno con Astra, así que lee la última fila como un techo y un suelo, no como una recomendación. Fíjate en cómo el agente de programación eclipsa todo lo demás: solo 440 ejecuciones, pero $1.540 en Astra. Guardar en caché 150K de cada 200K del prompt reduce eso a unos $946.
Quién puede llamar a la API
Por dónde empieza la API
Astra no está disponible en el nivel gratuito de la API. Necesitas al menos una cuenta de desarrollador Tier 1, es decir, una cuenta de pago con facturación configurada. OpenAI no había publicado límites de uso detallados ni garantías de rendimiento para Astra en el lanzamiento, así que revisa la página de límites en tu panel una vez que te concedan el acceso.

Los planes de ChatGPT son independientes
Una suscripción a ChatGPT no te da créditos de API. Ambas se facturan por separado, y la opción correcta depende de cómo trabajes. Si sobre todo chateas, un plan Plus a $20 suele ser más sencillo que pagar por token. Si estás construyendo un producto, necesitas la API sin importar qué plan tengas, porque tus clientes no pueden usar tu suscripción personal. Dentro de la aplicación, el acceso a Astra funciona así:
| Plan | Precio mensual | Acceso a Astra |
|---|
| Free | $0 | No |
| Go | $8 | No |
| Plus | $20 | Sí |
| Pro | Desde $100 | Sí, con límites ampliados |
| Enterprise | Por asiento | Sí, desactivado por defecto |
Luna todavía no había llegado a los usuarios gratuitos de ChatGPT cuando se escribió esto, así que incluso el nivel más barato no es gratis dentro de la aplicación.
Antes de tu primera llamada a la API, repasa esta breve lista:
- Añade un método de pago y un pequeño saldo prepagado.
- Configura un límite mensual de gasto en el panel antes de escribir código.
- Crea una credencial de API con alcance de proyecto y guárdala en una variable de entorno, nunca en el repositorio.
- Desarrolla con Luna y luego cambia el nombre del modelo cuando el pipeline funcione.
- Registra los recuentos de tokens de entrada, de caché y de salida en cada solicitud para que la factura nunca te sorprenda.
Opciones gratuitas que realmente funcionan
Por qué Astra no tiene nivel gratuito
No se ha publicado ninguna asignación de prueba para Astra, y con $50 por millón de tokens de salida eso no sorprende. Una sola ejecución agéntica larga consumiría cualquier crédito gratuito realista en cuestión de minutos.

Dónde todavía existe el uso gratuito
Aún tienes rutas reales para probar ideas sin una factura grande:
- Luna como punto de entrada económico. Cinco dólares de crédito compran unos 50 millones de tokens de entrada o 10 millones de salida. Eso son miles de conversaciones cortas.
- Modelos de pesos abiertos. GPT OSS 120B y GPT OSS 20B son las versiones de pesos abiertos de OpenAI. Si tienes el hardware, ejecutarlos tú mismo no tiene ningún cargo por token.
- Modelos rivales en el navegador. Prueba Claude Sonnet 5, Gemini 3.5 Flash o GPT 5.4 con tus prompts reales antes de decidir dónde gastar.
Un flujo de trabajo gratuito y práctico es este. Prototipa el prompt en el navegador hasta que las respuestas sean buenas, fíjalo y luego cuenta los tokens de una solicitud típica. Calcula el precio tú mismo con una sola fórmula: (tokens de entrada x tarifa de entrada + tokens de salida x tarifa de salida) / 1.000.000. Haz eso para Luna, Sol y Astra, y conocerás tu rango mensual real antes de que salga una sola llamada de pago.
Prueba GPT 5.6 Sol en PicassoIA
Una nota sincera: GPT-6 todavía no está en la lista de modelos de PicassoIA. Los parientes más cercanos son la familia GPT 5.6: GPT 5.6 Sol, GPT 5.6 Terra y GPT 5.6 Luna. Sol se puede probar en línea sin configuración, lo que lo convierte en un ensayo barato antes de comprometer presupuesto de API.
Paso a paso en PicassoIA
- Abre la página de GPT 5.6 Sol.
- Pega en Prompt una tarea real de tu producto, no un "hola".
- Añade un System Prompt para definir el rol y el tono.
- Elige un Reasoning effort entre none y xhigh. Empieza en none y súbelo solo cuando las respuestas parezcan superficiales.
- Ajusta Verbosity a low, medium o high.
- Sube Max Completion Tokens si eliges un nivel de razonamiento alto; si no, el pensamiento puede usar todo el presupuesto y dejarte una respuesta vacía.
- Sube una captura de pantalla o un diagrama en Image Input si la tarea lo necesita.
- Ejecútalo y luego repite el mismo prompt en GPT 5.6 Luna y compara calidad frente a precio.

Ajustes que mueven tu costo
Los tokens de razonamiento se facturan como tokens de salida en los modelos de razonamiento, así que los controles de esa página se traducen directamente en una factura:
| Ajuste | Qué hace | Efecto en el costo |
|---|
| Reasoning effort: none o low | Respuestas rápidas, poco pensamiento | El más bajo |
| Reasoning effort: high o xhigh | Respuestas más profundas y lentas | Más tokens de salida |
| Verbosity: low | Respuestas cortas y directas | Menos tokens de salida |
| Max Completion Tokens | Límite fijo de la longitud de la respuesta | Límite máximo por solicitud |

Enrutar según la dificultad
Envía el trabajo fácil a Luna, el intermedio a Sol y solo el 5 % más difícil a Astra. Con una división inventada de 80 % Luna, 15 % Sol y 5 % Astra, la carga de 100.000 tickets cuesta unos $396 en lugar de $4.500.
Caché y lotes
La entrada en caché es un 90 % más barata en Astra y Luna, y un 95 % más barata en Sol. El procesamiento por lotes y Flex reduce a la mitad la tarifa estándar para todo lo que pueda esperar.

Limita la salida
Establece un límite máximo de tokens y pide formatos cortos, como viñetas o JSON compacto. Con la salida a cinco veces el precio de la entrada, cada frase que te ahorras es dinero que conservas.
Tres errores que inflan las facturas:
- Reenviar todo el chat en cada turno. Una conversación de 10 turnos que añade 300 tokens por turno envía 16.500 tokens de entrada en total, no 3.000. Resume los turnos antiguos o guarda en caché el prefijo compartido.
- Dejar el razonamiento alto en tareas fáciles. Los tokens de pensamiento se cobran como salida, el lado caro de la tarifa.
- Probar con el modelo insignia. Construye y depura en Luna, y luego cambia el nombre del modelo para la ejecución final.
💡 Lista de verificación: enruta según la dificultad, guarda en caché el prefijo repetido, agrupa en lotes lo que pueda esperar, limita la longitud de la respuesta y revisa los precios cada mes, porque los niveles y las promociones cambian.
Tu turno para crear
El texto es solo la mitad del presupuesto de un producto. La mayoría de los lanzamientos también necesitan imágenes: fotos principales, miniaturas, maquetas de producto. Prueba a crear tus propias imágenes con Picasso IA y mira hasta dónde puede llegar un prompt. Seedream 4.5 es ideal para detalle nítido en 4K, P-Image es rápido para borradores, y GPT Image 2 sigue de cerca los prompts largos.
Elige una escena de tu propio proyecto, escribe tres prompts con distintos ángulos de cámara y ejecútalos uno al lado del otro. Explora el catálogo completo en picassoia.com/en/all-models y empieza a experimentar hoy.