Claude tiene dos sistemas de precios, y no miden lo mismo. La API cobra por cada token que envías y recibes. Una suscripción a Claude cobra una tarifa mensual fija por una cantidad limitada de tiempo de chat y programación. Si eliges mal, pagarás por tokens que apenas usas o chocarás con el límite de uso en plena fecha límite. Este artículo pone cifras reales a ambos lados, con las tarifas publicadas por Anthropic a octubre de 2026, para que veas dónde gana el medidor por token y dónde sale mejor un plan fijo.

Cómo funciona la facturación por token
Cada solicitud a la API se mide. Pagas por el texto que entra, por el texto que sale y por algunos extras opcionales, todo medido en tokens. Los precios se expresan por millón de tokens, escritos MTok, así que 2 $ / MTok significa 2 $ por cada millón de tokens. No hay cuota mensual, ni número de puestos, ni límite: la factura sigue al tráfico.
Qué cuenta como token
Un token es un fragmento de texto, normalmente una palabra corta o una parte de una más larga. La regla orientativa de Anthropic es de unos 4 caracteres o 0,75 palabras en inglés por token, así que un artículo de 2.500 palabras equivale a unos 3.300 tokens. El código, los textos en otros idiomas y el formato abundante suelen ocupar más.

Hay un detalle importante al comparar las tarifas antiguas con las nuevas. Claude 4.7 y los modelos posteriores usan un tokenizador más reciente que genera alrededor de un 30 % más de tokens para el mismo texto que Sonnet 4.6 y los modelos anteriores. Un precio más bajo por token no siempre significa una factura más baja si tu prompt ahora se divide en más tokens.
Por qué la salida cuesta más
Los tokens de salida cuestan cinco veces más que los de entrada en la gama actual. Sonnet 5.5 cobra 2 $ por millón de tokens de entrada y 10 $ por millón de tokens de salida. Opus 5.5 cobra 4 $ y 20 $. Generar texto es el paso caro, mientras que leer un prompt es barato.
Esa proporción decide cómo ahorras. Los documentos largos que envías cuestan poco. Las respuestas largas que vuelven cuestan mucho. Un prompt que pide tres viñetas sale más barato que uno que invita a un ensayo de 2.000 palabras.
Cómo el historial del chat infla la factura
La API no guarda estado, así que cada nuevo turno reenvía toda la conversación y pagas otra vez por todo como entrada. Imagina un chat en el que escribes 500 tokens y el modelo responde con 500 tokens, durante diez turnos. Solo escribiste 5.000 tokens de texto nuevo, pero el medidor de entrada suma 50.000 tokens en las diez llamadas, porque el turno 10 reenvía todo lo de los turnos del 1 al 9.
En Sonnet 5.5, esa conversación cuesta 0,10 $ de entrada más 0,05 $ por los 5.000 tokens de salida, es decir, 0,15 $ en total. Poca cosa por sí sola. Multiplícala por cien conversaciones al día y el historial se convierte en la partida más grande de la factura, que es justo donde ayuda la caché.

Precios de la API de Claude por modelo
Tarifas actuales por millón de tokens
Estas son las tarifas de la página de precios de Anthropic, en dólares estadounidenses por millón de tokens. La última columna es el precio de una lectura de la caché de prompts, la forma más barata de reenviar texto que ya has enviado.

| Modelo | Entrada | Salida | Lectura de caché |
|---|
| Claude Haiku 5.5 (prompts de hasta 100K tokens) | $0.10 | $0.50 | $0.01 |
| Claude Haiku 4.5 | $1 | $5 | $0.10 |
| Claude Sonnet 5.5 | $2 | $10 | $0.10 |
| Claude Sonnet 4.6 | $3 | $15 | $0.30 |
| Claude Opus 5.5 | $4 | $20 | $0.20 |
| Claude Fable 5.1 | $10 | $50 | $0.25 |
Haiku 5.5 se cobra según la longitud del prompt: los prompts de más de 100.000 tokens pagan 0,50 $ de entrada y 2,50 $ de salida.
💡 Lo más nuevo no siempre es más caro. Opus 5.5 a 4 $ / 20 $ queda por debajo de la generación Opus 5 y Opus 4.8, que cuesta 5 $ / 25 $, y Sonnet 5.5 a 2 $ / 10 $ queda por debajo de Claude Sonnet 4.6 a 3 $ / 15 $. Revisa la tabla de tarifas antes de suponer que la cifra más alta corresponde al modelo más nuevo.
Cuánto cuesta realmente una solicitud
Toma una solicitud típica: 3.000 tokens de entrada (un prompt de sistema más un documento pegado) y 800 tokens de salida (una respuesta sólida). Aquí tienes el cálculo por solicitud y por cada mil solicitudes, usando los mismos recuentos de tokens en cada fila para que la comparación sea sencilla.
| Modelo | Costo por solicitud | Costo por 1.000 solicitudes |
|---|
| Claude Haiku 5.5 | $0.0007 | $0.70 |
| Claude Haiku 4.5 | $0.007 | $7.00 |
| Claude Sonnet 5.5 | $0.014 | $14.00 |
| Claude Sonnet 4.6 | $0.021 | $21.00 |
| Claude Opus 5.5 | $0.028 | $28.00 |
| Claude Fable 5.1 | $0.070 | $70.00 |
La diferencia entre la fila más barata y la más cara es de 100 veces. La elección del modelo mueve la factura más que cualquier decisión sobre el plan. Como los modelos nuevos convierten el mismo texto en más tokens, suma hasta un 30 % a las filas de 4.7 y posteriores en el uso real.
Descuentos por caché y por lotes

Dos descuentos hacen la mayor parte del ahorro, y se acumulan:
- Caché de prompts. Escribir un prefijo de prompt en la caché de 5 minutos cuesta 1,25 veces el precio base de entrada, y la caché de 1 hora cuesta 2 veces. Cada lectura posterior cuesta 0,1 veces. En Opus 5.5 y Sonnet 5.5 una lectura cuesta solo 0,05 veces, y en Fable 5.1 cuesta 0,025 veces. La caché de 5 minutos se amortiza con una sola lectura.
- API por lotes. Los trabajos asíncronos tienen un 50 % de descuento tanto en tokens de entrada como de salida. Sonnet 5.5 baja a 1 $ / 5 $ y Opus 5.5 baja a 2 $ / 10 $.
La caché ayuda menos de lo que la gente espera cuando las respuestas son largas, porque la salida no tiene descuento. Una sesión de programación con 50.000 tokens de entrada y 15.000 de salida cuesta 0,50 $ en Opus 5.5. Si sirves 40.000 de esos tokens de entrada desde la caché, baja a unos 0,35 $, un ahorro del 30 %, porque los 0,30 $ de la salida se mantienen igual.
Cuánto cuestan las suscripciones
Gratis, Pro y Max
Una suscripción cambia el medidor por un techo. Pagas un precio fijo y Claude limita cuánto puedes usar dentro de ventanas móviles de cinco horas, con el número exacto de mensajes según lo largo y complejo que sea cada uno.

| Plan | Precio | Qué incluye |
|---|
| Free | $0 | Chat en la web, en escritorio y en dispositivos móviles, con búsqueda web, creación de archivos, ejecución de código y memoria |
| Pro | $20 al mes, o $17 al mes con facturación anual | Más uso que Free, además de Claude Code, Projects y modelos adicionales |
| Max 5x | $100 al mes | Cinco veces el uso de Pro, límites de salida más altos y acceso anticipado a nuevas funciones |
| Max 20x | $200 al mes | Veinte veces el uso de Pro |
Puestos para equipos y empresas

Los puestos Team estándar cuestan 20 $ por puesto al mes con facturación anual, o 25 $ con facturación mensual. Los puestos Premium cuestan 100 $ por puesto al mes con facturación anual (125 $ mensuales) y dan cinco veces el uso de un puesto estándar. Enterprise empieza en 20 $ por puesto al mes con facturación anual, con el uso cobrado a tarifas de API, y añade SCIM, registros de auditoría, retención de datos personalizada y acceso basado en roles.
Por qué la API se factura por separado
Una suscripción a Claude no incluye créditos de API. Anthropic factura la API por separado de sus planes, así que una suscripción Pro de 20 $ no cubrirá el costo de una aplicación que lances a tus clientes. Eso requiere acceso a la API con su propia facturación. Los suscriptores individuales y de Team pueden comprar créditos de uso adicionales a tarifas estándar de API cuando se agotan los límites del plan, lo que funciona como válvula de seguridad para las semanas de mucho trabajo.
Dónde está el punto de equilibrio
La prueba más sencilla es dividir el precio del plan entre tu costo por solicitud. Con 20 $ de Pro y la solicitud de 3.000 tokens de entrada y 800 de salida de antes, el punto de equilibrio queda así:

| Modelo | Costo por solicitud | Solicitudes para llegar a 20 $ | Por día durante 30 días |
|---|
| Claude Haiku 5.5 | $0.0007 | 28.571 | unas 952 |
| Claude Sonnet 5.5 | $0.014 | 1.429 | unas 48 |
| Claude Opus 5.5 | $0.028 | 714 | unas 24 |
| Claude Fable 5.1 | $0.070 | 286 | unas 10 |
Esto compara solo costos. Un plan también incluye una interfaz de chat, Projects y conexiones con aplicaciones, mientras que la API te da acceso directo y nada más. Necesitas una aplicación o herramienta que la llame.
Usuarios de chat ligero
Si haces unas pocas preguntas al día, pagar por token casi siempre sale más barato. Treinta solicitudes diarias a Sonnet 5.5 durante un mes suman unos 12,60 $, y el mismo hábito en Haiku 5.5 cuesta centavos. El plan fijo solo gana en precio cuando tu volumen supera el punto de equilibrio, o cuando te importan más la interfaz y los extras que la factura más baja.
Agentes de programación intensivos

La programación con agentes cambia la respuesta. Usa los recuentos de tokens del ejemplo de sesión de una hora de la propia Anthropic: 50.000 tokens de entrada y 15.000 de salida. En Opus 5.5 eso son 0,50 $ por sesión sin caché. Veinte sesiones en una jornada laboral suman 10 $, o unos 220 $ en 22 días laborables, más que el plan Max 20x de 200 $.
La caché reduce la diferencia. Con unos 0,35 $ por sesión, las mismas veinte sesiones diarias cuestan unos 153 $ al mes. En cualquier caso, un usuario avanzado queda muy por encima del plan Max 5x de 100 $, que es la carga de trabajo para la que se diseñaron los planes fijos. La contrapartida es que los límites de uso del plan siguen aplicándose.
Costos ocultos que conviene presupuestar
Las cuentas de tokens no son toda la factura. Estos extras son fáciles de pasar por alto:
- Búsqueda web: 10 $ por cada 1.000 búsquedas, más los tokens que los resultados añaden a tu prompt. La obtención web no tiene ningún cargo adicional aparte de los tokens.
- Inferencia solo en EE. UU.: Configurar
inference_geo como "us" aplica un multiplicador de 1,1 veces a cada categoría de tokens en los modelos Claude 4.6 y posteriores.
- Modo rápido: Opus 5.5 en modo rápido cuesta 8 $ de entrada y 40 $ de salida por MTok, el doble de la tarifa estándar.
- Managed Agents: Los tokens se cobran a tarifas normales, más 0,08 $ por hora de sesión mientras la sesión está en marcha.
- Sobrecarga de herramientas: Cualquier solicitud con herramientas añade un prompt de herramientas integrado, unos 286 tokens en la generación 5.5, antes de tus propias definiciones de herramientas.
- Cambio de tokenizador: Hasta un 30 % más de tokens para el mismo texto en los modelos Claude 4.7 y posteriores.
💡 Consejo de presupuesto: Vigila cache_read_input_tokens en las respuestas de la API. Si se queda en cero en solicitudes repetidas, algo en el prefijo de tu prompt cambia en cada llamada y estás pagando precio completo por texto que podrías leer desde la caché.
Usa Claude Sonnet 5 en PicassoIA
Si quieres probar Claude sin abrir una cuenta de API ni vigilar un medidor de tokens, Claude Sonnet 5 está disponible en Picasso IA. Es la generación Sonnet anterior, con un precio en la API de 2 $ / 10 $, igual que Sonnet 5.5, y su página enumera entre sus funciones la programación de varios pasos, el uso de herramientas y la entrada de imágenes.
Configuración paso a paso
- Abre la página del modelo. Ve a Claude Sonnet 5 en PicassoIA.
- Escribe tu prompt. El campo Prompt es la única entrada obligatoria. Pega el stack trace, el documento o la pregunta.
- Define el nivel de esfuerzo. El valor predeterminado es
low, que desactiva el razonamiento para obtener respuestas más rápidas y baratas. Cambia a medium o high para trabajos de programación más difíciles, y a xhigh o max para errores que afectan a varios archivos.
- Limita la salida. Max Tokens tiene 8.192 por defecto. Redúcelo cuando quieras respuestas cortas, ya que la salida es el lado caro de cualquier lista de precios de Claude.
- Añade un prompt de sistema. Es opcional. Fija un rol o un estilo de programación una vez y reutilízalo en todo un proyecto.
- Adjunta una imagen. También es opcional. Una captura de pantalla de un error o un boceto de wireframe sirve como contexto.
- Ejecútalo y refina. Lee la respuesta, ajusta el prompt y vuelve a ejecutarlo.
Consejos sobre los parámetros
| Parámetro | Predeterminado | Cámbialo cuando |
|---|
| Effort | low | La respuesta omite detalles o el error abarca varios archivos |
| Max Tokens | 8192 | Quieres respuestas más cortas o bloques de código más largos |
| System Prompt | vacío | Necesitas un rol, un tono o un estilo de programación fijos |
| Max Image Resolution | 0,5 megapíxeles | El texto pequeño de una captura se pierde al escalarla |
💡 Ejecuta el mismo prompt en Claude Sonnet 4.6 y en Claude 4.5 Haiku para ver la diferencia de calidad antes de elegir un modelo para tu presupuesto de API. Para los problemas de programación más difíciles, prueba Claude Fable 5.
Elige la configuración adecuada
Ajusta la opción a la carga de trabajo:
- Chat, escritura e investigación para uso propio: empieza con Free. Pasa a Pro por 20 $ cuando llegues a los límites.
- Agentes de programación a diario: Max 5x o Max 20x, porque las sesiones intensas cuestan más en el medidor que la tarifa fija.
- Un producto o una automatización: la API, con Haiku 5.5 o Sonnet 5.5, con caché de prompts y trabajos por lotes siempre que la latencia lo permita.
- Un equipo: puestos Team para las personas, más la API para todo lo que lances.
- Ambos: muchas personas tienen un plan para uso personal y acceso a la API para automatizar, ya que se facturan por separado.
La opción más barata es la que se ajusta a cómo trabajas de verdad, así que dedica una semana a contar tus solicitudes antes de comprometerte.
Tu siguiente paso en PicassoIA
Los cálculos de precios son más fáciles cuando tienes algo que construir, y Picasso IA es un lugar rápido para probar texto e imágenes. Abre Claude Sonnet 5 para redactar prompts y luego convierte esos prompts en imágenes con un modelo de imagen como GPT Image 2, Flux 2 Pro o P-Image, el modelo detrás de las fotos de este artículo.
Elige una escena, describe la luz y el objetivo, y pulsa generar. Después cambia un detalle y vuelve a ejecutarlo. Experimentar cuesta unos minutos y te muestra cuánto cambia el resultado un buen prompt. Explora el catálogo completo en picassoia.com/en/all-models y crea tu primera imagen hoy.