Costo de la API de GPT-6: precios, acceso y opciones gratuitas

GPT-6 Astra cuesta $10 por millón de tokens de entrada y $50 por millón de salida, mientras que Sol y Luna cuestan mucho menos. Consulta cada recargo, una factura mensual para 100.000 solicitudes, quién tiene acceso a la API y qué opciones gratuitas funcionan de verdad.

Costo de la API de GPT-6: precios, acceso y opciones gratuitas
Cristian Da Conceicao
Fundador de Picasso IA

Diez dólares de entrada, cincuenta de salida. Eso es lo que cuesta un millón de tokens de GPT-6 Astra a través de la API, y es el doble de la tarifa de lista del modelo insignia anterior. Si esperabas una mejora barata, esa cifra duele. El detalle es que GPT-6 no tiene un único precio. Es una familia de tres niveles, y el modelo más pequeño cuesta alrededor del 1 % del más grande.

Este artículo reúne todas las cifras en un solo lugar: tarifas por token de Astra, Sol y Luna, los recargos que inflan las facturas sin avisar, lo que cuestan 100.000 solicitudes reales, quién puede llamar a la API y qué opciones gratuitas funcionan de verdad. Los precios provienen de rastreadores públicos de precios a principios de octubre, así que tómalos como una foto del momento y confírmalos en la página de precios de OpenAI antes de comprometer un presupuesto.

Cuánto cuesta GPT-6 por token

Astra se presentó como vista previa limitada el 3 de septiembre y se abrió al público al día siguiente. Sol y Luna llegaron el 22 de septiembre. Los tres comparten una ventana de contexto de aproximadamente un millón de tokens, con hasta 128K tokens de salida, aunque los rastreadores no coinciden en la cifra exacta (1,05 M frente a 1,1 M).

Astra, el precio del modelo insignia

Astra está pensado para trabajos largos y agénticos: uso del equipo, automatización del navegador, tareas grandes de programación. Esa ambición tiene un precio.

Línea de facturaciónPrecio por 1M de tokens
Entrada$10,00
Entrada en caché$1,00
Salida$50,00
Entrada por encima de 272K tokens$20,00
Salida por encima de 272K tokens$75,00
Lote o Flex (entrada / salida)$5,00 / $25,00

La salida es la parte más cara. Cada token que escribe el modelo cuesta cinco veces lo que cuesta un token que lee, y los modelos con mucho razonamiento escriben bastante, incluidos los tokens de pensamiento que nunca ves en la respuesta final. Una primera prueba de terceros situó a Astra en unos $167 por tarea terminada en benchmarks agregados, lo que muestra lo rápido que se acumulan las ejecuciones agénticas.

Manos de una mujer pulsando botones de una calculadora junto a un fajo de facturas impresas en abanico sobre un escritorio de roble

Sol y Luna para presupuestos más ajustados

Esta es toda la familia, lado a lado.

ModeloEntradaEntrada en cachéSalidaPara qué sirve
GPT-6 Astra$10,00$1,00$50,00Agentes, programación compleja, investigaciones largas
GPT-6 Sol$2,00$0,10$10,00Programación diaria, redacción, respuestas de soporte
GPT-6 Luna$0,10$0,01$0,50Enrutamiento, etiquetado, respuestas cortas en volumen

Sol cuesta una quinta parte de lo que cuesta Astra en cada línea. Luna cuesta una centésima. Piensa en tres tazas de café: la misma bebida, una factura muy distinta.

Las tarifas por token son abstractas, así que aquí va una traducción aproximada. Un token equivale a unas tres cuartas partes de una palabra en inglés. Un solo dólar de salida de Astra compra unas 15.000 palabras, cerca de un informe de 30 páginas. Ese mismo dólar compra unas 75.000 palabras en Sol y alrededor de 1,5 millones de palabras en Luna. Leer es más barato que escribir en todos los niveles, por eso resumir un documento largo cuesta mucho menos que redactarlo.

Tres tazas de cerámica de tamaño pequeño, mediano y extragrande sobre la barra de una cafetería

La generación anterior no es automáticamente más barata. Según un rastreador de precios, GPT 5.6 Sol cuesta $4 de entrada y $20 de salida durante una promoción que dura hasta el 21 de noviembre, lo que hace que GPT-6 Sol sea la línea más barata dentro del mismo nivel con ese nombre. GPT 5.6 Terra figura en $2 y $12, y GPT 5.6 Luna en $0,20 y $1,20, el doble de la tarifa de GPT-6 Luna.

💡 Lectura rápida: si tu carga de trabajo no necesita agentes ni razonamiento profundo, el nivel Sol es el nuevo punto de partida para calcular precios. Astra es la excepción, no la base.

Entonces, ¿cuándo vale la pena pagar cinco veces el precio de Sol por Astra? Cuando una ejecución fallida cuesta más que la diferencia de precio: un agente que consume una hora de tiempo de un ingeniero, o un borrador legal que, de otro modo, necesitaría tres rondas de revisión. El punto de equilibrio es sencillo. Si Sol necesita más de cinco intentos para igualar un buen resultado de Astra, Astra gana solo por precio. Si Sol llega ahí en dos o tres, estás pagando de más.

Recargos que inflan la factura

Los prompts largos duplican la tarifa

Al superar los 272K tokens de entrada, se recalcula toda la solicitud, no solo los tokens extra. La entrada salta de $10 a $20 por millón, y la salida, de $50 a $75.

Imagina un paquete de contratos de 300K tokens con un resumen de 2K tokens como respuesta:

  • A la tarifa de contexto largo: $6,00 de entrada más $0,15 de salida, o sea, $6,15.
  • Recortado a 270K tokens a la tarifa estándar: $2,70 más $0,10, o sea, $2,80.

Treinta mil tokens extra duplicaron con creces el precio de la misma solicitud.

Hombre sosteniendo un montón enormemente grueso de páginas impresas en un pasillo tranquilo de una biblioteca

💡 Consejo: mantén un contador de tokens en tu pipeline y divide los documentos grandes justo por debajo del umbral en lugar de enviar un único prompt gigante.

Modo rápido y sobrecargo regional

Otros dos multiplicadores se esconden en la letra pequeña:

  • El modo rápido cuesta aproximadamente el doble de la tarifa estándar ($20 de entrada y $100 de salida en Astra) a cambio de unas 2,5 veces más velocidad. No está disponible con residencia de datos en la UE.
  • Los endpoints con residencia de datos añaden un 10 % sobre el nivel que hayas elegido.

Súmalos y una llamada a Astra aparentemente inocente puede costar más del doble de su precio de lista. Decide con intención, no por defecto.

El modo rápido justifica su sobreprecio cuando una persona espera la respuesta, como un asistente de programación interactivo o un chat de soporte en vivo. Es un desperdicio en trabajos nocturnos donde nadie mira el reloj. Esos deben ir a la cola de lotes, a mitad de precio.

Costos mensuales reales en dólares

Un ticket de soporte, calculado

Toma un bot de soporte en el que cada ticket usa 2.000 tokens de entrada y 500 de salida. En Astra, eso son $0,02 por el prompt más $0,025 por la respuesta, o sea, $0,045 por ticket. Un número pequeño, hasta que lo multiplicas.

Fundador con barba y chaqueta vaquera revisando un extracto mensual impreso junto a una ventana de cafetería

La misma carga de trabajo en tres niveles

Aquí tienes ese ticket exacto a 100.000 tickets al mes:

ModeloPor ticket100.000 ticketsCon descuento por lote
GPT-6 Astra$0,045$4.500$2.250
GPT-6 Sol$0,009$900$450
GPT-6 Luna$0,00045$45$22,50

El caché añade otra palanca. Si 1.500 de esos 2.000 tokens de entrada son siempre el mismo prompt de sistema y los mismos ejemplos, Astra baja a $0,0315 por ticket, o sea, $3.150 al mes. Eso ahorra $1.350 sin tocar la calidad.

💡 Regla práctica: en Astra, una respuesta de 500 tokens ($0,025) cuesta más que un prompt de 2.000 tokens ($0,02). La longitud de la salida decide la factura.

Los tickets de soporte son solo una forma de carga de trabajo. Aquí tienes tres más, calculadas a tarifa estándar y sin descuentos, para que encuentres la que más se parezca a tu proyecto:

Carga de trabajoTokens por solicitudSolicitudes al mesLunaSolAstra
App de chat de un desarrollador en solitario1.000 de entrada, 400 de salida5.000$1,50$30$150
Equipo de contenidos con borradores3.000 de entrada, 2.500 de salida300$0,47$9,30$46,50
Ejecuciones de agentes de programación200.000 de entrada, 30.000 de salida440$15,40$308$1.540

La tabla calcula tokens, no calidad. Un agente con Luna no igualará a uno con Astra, así que lee la última fila como un techo y un suelo, no como una recomendación. Fíjate en cómo el agente de programación eclipsa todo lo demás: solo 440 ejecuciones, pero $1.540 en Astra. Guardar en caché 150K de cada 200K del prompt reduce eso a unos $946.

Quién puede llamar a la API

Por dónde empieza la API

Astra no está disponible en el nivel gratuito de la API. Necesitas al menos una cuenta de desarrollador Tier 1, es decir, una cuenta de pago con facturación configurada. OpenAI no había publicado límites de uso detallados ni garantías de rendimiento para Astra en el lanzamiento, así que revisa la página de límites en tu panel una vez que te concedan el acceso.

Mano deslizando una tarjeta de acceso blanca sobre un mostrador de recepción de madera hasta otra mano

Los planes de ChatGPT son independientes

Una suscripción a ChatGPT no te da créditos de API. Ambas se facturan por separado, y la opción correcta depende de cómo trabajes. Si sobre todo chateas, un plan Plus a $20 suele ser más sencillo que pagar por token. Si estás construyendo un producto, necesitas la API sin importar qué plan tengas, porque tus clientes no pueden usar tu suscripción personal. Dentro de la aplicación, el acceso a Astra funciona así:

PlanPrecio mensualAcceso a Astra
Free$0No
Go$8No
Plus$20Sí
ProDesde $100Sí, con límites ampliados
EnterprisePor asientoSí, desactivado por defecto

Luna todavía no había llegado a los usuarios gratuitos de ChatGPT cuando se escribió esto, así que incluso el nivel más barato no es gratis dentro de la aplicación.

Antes de tu primera llamada a la API, repasa esta breve lista:

  1. Añade un método de pago y un pequeño saldo prepagado.
  2. Configura un límite mensual de gasto en el panel antes de escribir código.
  3. Crea una credencial de API con alcance de proyecto y guárdala en una variable de entorno, nunca en el repositorio.
  4. Desarrolla con Luna y luego cambia el nombre del modelo cuando el pipeline funcione.
  5. Registra los recuentos de tokens de entrada, de caché y de salida en cada solicitud para que la factura nunca te sorprenda.

Opciones gratuitas que realmente funcionan

Por qué Astra no tiene nivel gratuito

No se ha publicado ninguna asignación de prueba para Astra, y con $50 por millón de tokens de salida eso no sorprende. Una sola ejecución agéntica larga consumiría cualquier crédito gratuito realista en cuestión de minutos.

Estudiante universitario estudiando con un equipo portátil y un cuaderno en una larga mesa de biblioteca

Dónde todavía existe el uso gratuito

Aún tienes rutas reales para probar ideas sin una factura grande:

  • Luna como punto de entrada económico. Cinco dólares de crédito compran unos 50 millones de tokens de entrada o 10 millones de salida. Eso son miles de conversaciones cortas.
  • Modelos de pesos abiertos. GPT OSS 120B y GPT OSS 20B son las versiones de pesos abiertos de OpenAI. Si tienes el hardware, ejecutarlos tú mismo no tiene ningún cargo por token.
  • Modelos rivales en el navegador. Prueba Claude Sonnet 5, Gemini 3.5 Flash o GPT 5.4 con tus prompts reales antes de decidir dónde gastar.

Un flujo de trabajo gratuito y práctico es este. Prototipa el prompt en el navegador hasta que las respuestas sean buenas, fíjalo y luego cuenta los tokens de una solicitud típica. Calcula el precio tú mismo con una sola fórmula: (tokens de entrada x tarifa de entrada + tokens de salida x tarifa de salida) / 1.000.000. Haz eso para Luna, Sol y Astra, y conocerás tu rango mensual real antes de que salga una sola llamada de pago.

Prueba GPT 5.6 Sol en PicassoIA

Una nota sincera: GPT-6 todavía no está en la lista de modelos de PicassoIA. Los parientes más cercanos son la familia GPT 5.6: GPT 5.6 Sol, GPT 5.6 Terra y GPT 5.6 Luna. Sol se puede probar en línea sin configuración, lo que lo convierte en un ensayo barato antes de comprometer presupuesto de API.

Paso a paso en PicassoIA

  1. Abre la página de GPT 5.6 Sol.
  2. Pega en Prompt una tarea real de tu producto, no un "hola".
  3. Añade un System Prompt para definir el rol y el tono.
  4. Elige un Reasoning effort entre none y xhigh. Empieza en none y súbelo solo cuando las respuestas parezcan superficiales.
  5. Ajusta Verbosity a low, medium o high.
  6. Sube Max Completion Tokens si eliges un nivel de razonamiento alto; si no, el pensamiento puede usar todo el presupuesto y dejarte una respuesta vacía.
  7. Sube una captura de pantalla o un diagrama en Image Input si la tarea lo necesita.
  8. Ejecútalo y luego repite el mismo prompt en GPT 5.6 Luna y compara calidad frente a precio.

Vista por encima del hombro de un joven creador navegando en un equipo portátil en un espacio de trabajo compartido y luminoso

Ajustes que mueven tu costo

Los tokens de razonamiento se facturan como tokens de salida en los modelos de razonamiento, así que los controles de esa página se traducen directamente en una factura:

AjusteQué haceEfecto en el costo
Reasoning effort: none o lowRespuestas rápidas, poco pensamientoEl más bajo
Reasoning effort: high o xhighRespuestas más profundas y lentasMás tokens de salida
Verbosity: lowRespuestas cortas y directasMenos tokens de salida
Max Completion TokensLímite fijo de la longitud de la respuestaLímite máximo por solicitud

Formas de reducir la factura

Mano dejando caer una moneda de oro en un frasco de vidrio medio lleno de monedas sobre una mesa de cocina

Enrutar según la dificultad

Envía el trabajo fácil a Luna, el intermedio a Sol y solo el 5 % más difícil a Astra. Con una división inventada de 80 % Luna, 15 % Sol y 5 % Astra, la carga de 100.000 tickets cuesta unos $396 en lugar de $4.500.

Caché y lotes

La entrada en caché es un 90 % más barata en Astra y Luna, y un 95 % más barata en Sol. El procesamiento por lotes y Flex reduce a la mitad la tarifa estándar para todo lo que pueda esperar.

Trabajador de logística escaneando filas de paquetes de cartón idénticos en un almacén luminoso

Limita la salida

Establece un límite máximo de tokens y pide formatos cortos, como viñetas o JSON compacto. Con la salida a cinco veces el precio de la entrada, cada frase que te ahorras es dinero que conservas.

Tres errores que inflan las facturas:

  • Reenviar todo el chat en cada turno. Una conversación de 10 turnos que añade 300 tokens por turno envía 16.500 tokens de entrada en total, no 3.000. Resume los turnos antiguos o guarda en caché el prefijo compartido.
  • Dejar el razonamiento alto en tareas fáciles. Los tokens de pensamiento se cobran como salida, el lado caro de la tarifa.
  • Probar con el modelo insignia. Construye y depura en Luna, y luego cambia el nombre del modelo para la ejecución final.

💡 Lista de verificación: enruta según la dificultad, guarda en caché el prefijo repetido, agrupa en lotes lo que pueda esperar, limita la longitud de la respuesta y revisa los precios cada mes, porque los niveles y las promociones cambian.

Tu turno para crear

El texto es solo la mitad del presupuesto de un producto. La mayoría de los lanzamientos también necesitan imágenes: fotos principales, miniaturas, maquetas de producto. Prueba a crear tus propias imágenes con Picasso IA y mira hasta dónde puede llegar un prompt. Seedream 4.5 es ideal para detalle nítido en 4K, P-Image es rápido para borradores, y GPT Image 2 sigue de cerca los prompts largos.

Elige una escena de tu propio proyecto, escribe tres prompts con distintos ángulos de cámara y ejecútalos uno al lado del otro. Explora el catálogo completo en picassoia.com/en/all-models y empieza a experimentar hoy.

Compartir este artículo

Elige tu idioma