Precios de la API de Claude frente a suscripción: costos por token explicados

La API de Claude cobra por cada token de entrada y de salida, mientras que Claude Pro y Max cobran una tarifa mensual fija. Este artículo compara las tarifas por token de Haiku, Sonnet, Opus y Fable, muestra el costo real por solicitud y calcula el punto de equilibrio para el chat ligero, los agentes de programación y los equipos.

Precios de la API de Claude frente a suscripción: costos por token explicados
Cristian Da Conceicao
Fundador de Picasso IA

Claude tiene dos sistemas de precios, y no miden lo mismo. La API cobra por cada token que envías y recibes. Una suscripción a Claude cobra una tarifa mensual fija por una cantidad limitada de tiempo de chat y programación. Si eliges mal, pagarás por tokens que apenas usas o chocarás con el límite de uso en plena fecha límite. Este artículo pone cifras reales a ambos lados, con las tarifas publicadas por Anthropic a octubre de 2026, para que veas dónde gana el medidor por token y dónde sale mejor un plan fijo.

Un desarrollador escribiendo en un equipo portátil junto a la ventana de una cafetería, con un café con leche y una libreta

Cómo funciona la facturación por token

Cada solicitud a la API se mide. Pagas por el texto que entra, por el texto que sale y por algunos extras opcionales, todo medido en tokens. Los precios se expresan por millón de tokens, escritos MTok, así que 2 $ / MTok significa 2 $ por cada millón de tokens. No hay cuota mensual, ni número de puestos, ni límite: la factura sigue al tráfico.

Qué cuenta como token

Un token es un fragmento de texto, normalmente una palabra corta o una parte de una más larga. La regla orientativa de Anthropic es de unos 4 caracteres o 0,75 palabras en inglés por token, así que un artículo de 2.500 palabras equivale a unos 3.300 tokens. El código, los textos en otros idiomas y el formato abundante suelen ocupar más.

Cubos de madera lisa ordenados en pequeños grupos sobre una mesa de nogal oscuro

Hay un detalle importante al comparar las tarifas antiguas con las nuevas. Claude 4.7 y los modelos posteriores usan un tokenizador más reciente que genera alrededor de un 30 % más de tokens para el mismo texto que Sonnet 4.6 y los modelos anteriores. Un precio más bajo por token no siempre significa una factura más baja si tu prompt ahora se divide en más tokens.

Por qué la salida cuesta más

Los tokens de salida cuestan cinco veces más que los de entrada en la gama actual. Sonnet 5.5 cobra 2 $ por millón de tokens de entrada y 10 $ por millón de tokens de salida. Opus 5.5 cobra 4 $ y 20 $. Generar texto es el paso caro, mientras que leer un prompt es barato.

Esa proporción decide cómo ahorras. Los documentos largos que envías cuestan poco. Las respuestas largas que vuelven cuestan mucho. Un prompt que pide tres viñetas sale más barato que uno que invita a un ensayo de 2.000 palabras.

Cómo el historial del chat infla la factura

La API no guarda estado, así que cada nuevo turno reenvía toda la conversación y pagas otra vez por todo como entrada. Imagina un chat en el que escribes 500 tokens y el modelo responde con 500 tokens, durante diez turnos. Solo escribiste 5.000 tokens de texto nuevo, pero el medidor de entrada suma 50.000 tokens en las diez llamadas, porque el turno 10 reenvía todo lo de los turnos del 1 al 9.

En Sonnet 5.5, esa conversación cuesta 0,10 $ de entrada más 0,05 $ por los 5.000 tokens de salida, es decir, 0,15 $ en total. Poca cosa por sí sola. Multiplícala por cien conversaciones al día y el historial se convierte en la partida más grande de la factura, que es justo donde ayuda la caché.

Un largo ticket de papel saliendo de una caja registradora de latón y cayendo sobre un mostrador de madera

Precios de la API de Claude por modelo

Tarifas actuales por millón de tokens

Estas son las tarifas de la página de precios de Anthropic, en dólares estadounidenses por millón de tokens. La última columna es el precio de una lectura de la caché de prompts, la forma más barata de reenviar texto que ya has enviado.

Vista cenital de un escritorio con un libro de contabilidad abierto, una calculadora y recibos de papel

ModeloEntradaSalidaLectura de caché
Claude Haiku 5.5 (prompts de hasta 100K tokens)$0.10$0.50$0.01
Claude Haiku 4.5$1$5$0.10
Claude Sonnet 5.5$2$10$0.10
Claude Sonnet 4.6$3$15$0.30
Claude Opus 5.5$4$20$0.20
Claude Fable 5.1$10$50$0.25

Haiku 5.5 se cobra según la longitud del prompt: los prompts de más de 100.000 tokens pagan 0,50 $ de entrada y 2,50 $ de salida.

💡 Lo más nuevo no siempre es más caro. Opus 5.5 a 4 $ / 20 $ queda por debajo de la generación Opus 5 y Opus 4.8, que cuesta 5 $ / 25 $, y Sonnet 5.5 a 2 $ / 10 $ queda por debajo de Claude Sonnet 4.6 a 3 $ / 15 $. Revisa la tabla de tarifas antes de suponer que la cifra más alta corresponde al modelo más nuevo.

Cuánto cuesta realmente una solicitud

Toma una solicitud típica: 3.000 tokens de entrada (un prompt de sistema más un documento pegado) y 800 tokens de salida (una respuesta sólida). Aquí tienes el cálculo por solicitud y por cada mil solicitudes, usando los mismos recuentos de tokens en cada fila para que la comparación sea sencilla.

ModeloCosto por solicitudCosto por 1.000 solicitudes
Claude Haiku 5.5$0.0007$0.70
Claude Haiku 4.5$0.007$7.00
Claude Sonnet 5.5$0.014$14.00
Claude Sonnet 4.6$0.021$21.00
Claude Opus 5.5$0.028$28.00
Claude Fable 5.1$0.070$70.00

La diferencia entre la fila más barata y la más cara es de 100 veces. La elección del modelo mueve la factura más que cualquier decisión sobre el plan. Como los modelos nuevos convierten el mismo texto en más tokens, suma hasta un 30 % a las filas de 4.7 y posteriores en el uso real.

Descuentos por caché y por lotes

Una mujer empujando un carro con cajas idénticas por un pasillo de almacén

Dos descuentos hacen la mayor parte del ahorro, y se acumulan:

  • Caché de prompts. Escribir un prefijo de prompt en la caché de 5 minutos cuesta 1,25 veces el precio base de entrada, y la caché de 1 hora cuesta 2 veces. Cada lectura posterior cuesta 0,1 veces. En Opus 5.5 y Sonnet 5.5 una lectura cuesta solo 0,05 veces, y en Fable 5.1 cuesta 0,025 veces. La caché de 5 minutos se amortiza con una sola lectura.
  • API por lotes. Los trabajos asíncronos tienen un 50 % de descuento tanto en tokens de entrada como de salida. Sonnet 5.5 baja a 1 $ / 5 $ y Opus 5.5 baja a 2 $ / 10 $.

La caché ayuda menos de lo que la gente espera cuando las respuestas son largas, porque la salida no tiene descuento. Una sesión de programación con 50.000 tokens de entrada y 15.000 de salida cuesta 0,50 $ en Opus 5.5. Si sirves 40.000 de esos tokens de entrada desde la caché, baja a unos 0,35 $, un ahorro del 30 %, porque los 0,30 $ de la salida se mantienen igual.

Cuánto cuestan las suscripciones

Gratis, Pro y Max

Una suscripción cambia el medidor por un techo. Pagas un precio fijo y Claude limita cuánto puedes usar dentro de ventanas móviles de cinco horas, con el número exacto de mensajes según lo largo y complejo que sea cada uno.

Un viajero sosteniendo un abono mensual de transporte frente al lector de torniquetes de una estación de tren

PlanPrecioQué incluye
Free$0Chat en la web, en escritorio y en dispositivos móviles, con búsqueda web, creación de archivos, ejecución de código y memoria
Pro$20 al mes, o $17 al mes con facturación anualMás uso que Free, además de Claude Code, Projects y modelos adicionales
Max 5x$100 al mesCinco veces el uso de Pro, límites de salida más altos y acceso anticipado a nuevas funciones
Max 20x$200 al mesVeinte veces el uso de Pro

Puestos para equipos y empresas

Cuatro colegas revisando una hoja de cálculo impresa alrededor de una mesa de reuniones

Los puestos Team estándar cuestan 20 $ por puesto al mes con facturación anual, o 25 $ con facturación mensual. Los puestos Premium cuestan 100 $ por puesto al mes con facturación anual (125 $ mensuales) y dan cinco veces el uso de un puesto estándar. Enterprise empieza en 20 $ por puesto al mes con facturación anual, con el uso cobrado a tarifas de API, y añade SCIM, registros de auditoría, retención de datos personalizada y acceso basado en roles.

Por qué la API se factura por separado

Una suscripción a Claude no incluye créditos de API. Anthropic factura la API por separado de sus planes, así que una suscripción Pro de 20 $ no cubrirá el costo de una aplicación que lances a tus clientes. Eso requiere acceso a la API con su propia facturación. Los suscriptores individuales y de Team pueden comprar créditos de uso adicionales a tarifas estándar de API cuando se agotan los límites del plan, lo que funciona como válvula de seguridad para las semanas de mucho trabajo.

Dónde está el punto de equilibrio

La prueba más sencilla es dividir el precio del plan entre tu costo por solicitud. Con 20 $ de Pro y la solicitud de 3.000 tokens de entrada y 800 de salida de antes, el punto de equilibrio queda así:

Una balanza de latón con monedas en un platillo y un pase de papel doblado en el otro

ModeloCosto por solicitudSolicitudes para llegar a 20 $Por día durante 30 días
Claude Haiku 5.5$0.000728.571unas 952
Claude Sonnet 5.5$0.0141.429unas 48
Claude Opus 5.5$0.028714unas 24
Claude Fable 5.1$0.070286unas 10

Esto compara solo costos. Un plan también incluye una interfaz de chat, Projects y conexiones con aplicaciones, mientras que la API te da acceso directo y nada más. Necesitas una aplicación o herramienta que la llame.

Usuarios de chat ligero

Si haces unas pocas preguntas al día, pagar por token casi siempre sale más barato. Treinta solicitudes diarias a Sonnet 5.5 durante un mes suman unos 12,60 $, y el mismo hábito en Haiku 5.5 cuesta centavos. El plan fijo solo gana en precio cuando tu volumen supera el punto de equilibrio, o cuando te importan más la interfaz y los extras que la factura más baja.

Agentes de programación intensivos

Un desarrollador con barba en un escritorio de pie con dos monitores, con la luz del final de la tarde

La programación con agentes cambia la respuesta. Usa los recuentos de tokens del ejemplo de sesión de una hora de la propia Anthropic: 50.000 tokens de entrada y 15.000 de salida. En Opus 5.5 eso son 0,50 $ por sesión sin caché. Veinte sesiones en una jornada laboral suman 10 $, o unos 220 $ en 22 días laborables, más que el plan Max 20x de 200 $.

La caché reduce la diferencia. Con unos 0,35 $ por sesión, las mismas veinte sesiones diarias cuestan unos 153 $ al mes. En cualquier caso, un usuario avanzado queda muy por encima del plan Max 5x de 100 $, que es la carga de trabajo para la que se diseñaron los planes fijos. La contrapartida es que los límites de uso del plan siguen aplicándose.

Costos ocultos que conviene presupuestar

Las cuentas de tokens no son toda la factura. Estos extras son fáciles de pasar por alto:

  • Búsqueda web: 10 $ por cada 1.000 búsquedas, más los tokens que los resultados añaden a tu prompt. La obtención web no tiene ningún cargo adicional aparte de los tokens.
  • Inferencia solo en EE. UU.: Configurar inference_geo como "us" aplica un multiplicador de 1,1 veces a cada categoría de tokens en los modelos Claude 4.6 y posteriores.
  • Modo rápido: Opus 5.5 en modo rápido cuesta 8 $ de entrada y 40 $ de salida por MTok, el doble de la tarifa estándar.
  • Managed Agents: Los tokens se cobran a tarifas normales, más 0,08 $ por hora de sesión mientras la sesión está en marcha.
  • Sobrecarga de herramientas: Cualquier solicitud con herramientas añade un prompt de herramientas integrado, unos 286 tokens en la generación 5.5, antes de tus propias definiciones de herramientas.
  • Cambio de tokenizador: Hasta un 30 % más de tokens para el mismo texto en los modelos Claude 4.7 y posteriores.

💡 Consejo de presupuesto: Vigila cache_read_input_tokens en las respuestas de la API. Si se queda en cero en solicitudes repetidas, algo en el prefijo de tu prompt cambia en cada llamada y estás pagando precio completo por texto que podrías leer desde la caché.

Usa Claude Sonnet 5 en PicassoIA

Si quieres probar Claude sin abrir una cuenta de API ni vigilar un medidor de tokens, Claude Sonnet 5 está disponible en Picasso IA. Es la generación Sonnet anterior, con un precio en la API de 2 $ / 10 $, igual que Sonnet 5.5, y su página enumera entre sus funciones la programación de varios pasos, el uso de herramientas y la entrada de imágenes.

Configuración paso a paso

  1. Abre la página del modelo. Ve a Claude Sonnet 5 en PicassoIA.
  2. Escribe tu prompt. El campo Prompt es la única entrada obligatoria. Pega el stack trace, el documento o la pregunta.
  3. Define el nivel de esfuerzo. El valor predeterminado es low, que desactiva el razonamiento para obtener respuestas más rápidas y baratas. Cambia a medium o high para trabajos de programación más difíciles, y a xhigh o max para errores que afectan a varios archivos.
  4. Limita la salida. Max Tokens tiene 8.192 por defecto. Redúcelo cuando quieras respuestas cortas, ya que la salida es el lado caro de cualquier lista de precios de Claude.
  5. Añade un prompt de sistema. Es opcional. Fija un rol o un estilo de programación una vez y reutilízalo en todo un proyecto.
  6. Adjunta una imagen. También es opcional. Una captura de pantalla de un error o un boceto de wireframe sirve como contexto.
  7. Ejecútalo y refina. Lee la respuesta, ajusta el prompt y vuelve a ejecutarlo.

Consejos sobre los parámetros

ParámetroPredeterminadoCámbialo cuando
EffortlowLa respuesta omite detalles o el error abarca varios archivos
Max Tokens8192Quieres respuestas más cortas o bloques de código más largos
System PromptvacíoNecesitas un rol, un tono o un estilo de programación fijos
Max Image Resolution0,5 megapíxelesEl texto pequeño de una captura se pierde al escalarla

💡 Ejecuta el mismo prompt en Claude Sonnet 4.6 y en Claude 4.5 Haiku para ver la diferencia de calidad antes de elegir un modelo para tu presupuesto de API. Para los problemas de programación más difíciles, prueba Claude Fable 5.

Elige la configuración adecuada

Ajusta la opción a la carga de trabajo:

  • Chat, escritura e investigación para uso propio: empieza con Free. Pasa a Pro por 20 $ cuando llegues a los límites.
  • Agentes de programación a diario: Max 5x o Max 20x, porque las sesiones intensas cuestan más en el medidor que la tarifa fija.
  • Un producto o una automatización: la API, con Haiku 5.5 o Sonnet 5.5, con caché de prompts y trabajos por lotes siempre que la latencia lo permita.
  • Un equipo: puestos Team para las personas, más la API para todo lo que lances.
  • Ambos: muchas personas tienen un plan para uso personal y acceso a la API para automatizar, ya que se facturan por separado.

La opción más barata es la que se ajusta a cómo trabajas de verdad, así que dedica una semana a contar tus solicitudes antes de comprometerte.

Tu siguiente paso en PicassoIA

Los cálculos de precios son más fáciles cuando tienes algo que construir, y Picasso IA es un lugar rápido para probar texto e imágenes. Abre Claude Sonnet 5 para redactar prompts y luego convierte esos prompts en imágenes con un modelo de imagen como GPT Image 2, Flux 2 Pro o P-Image, el modelo detrás de las fotos de este artículo.

Elige una escena, describe la luz y el objetivo, y pulsa generar. Después cambia un detalle y vuelve a ejecutarlo. Experimentar cuesta unos minutos y te muestra cuánto cambia el resultado un buen prompt. Explora el catálogo completo en picassoia.com/en/all-models y crea tu primera imagen hoy.

Compartir este artículo

Elige tu idioma