Precios de Claude Agent SDK: suscripción, créditos y costos

El uso de Claude Agent SDK puede consumir los límites del plan, los créditos mensuales de API que se añadieron a los planes Max y Team el 7 de octubre o la facturación por token. Este artículo detalla cada precio, los importes de los créditos, el ahorro por caché y un cálculo de costo para una ejecución de agente.

Precios de Claude Agent SDK: suscripción, créditos y costos
Cristian Da Conceicao
Fundador de Picasso IA

El Claude Agent SDK no tiene precio propio. La factura viene del modelo que hay detrás, y a partir del 8 de octubre de 2026 puede llegarte de tres formas distintas: a través de tus límites de suscripción, a través de los nuevos créditos mensuales de API de los planes Max y Team, o mediante la facturación por token tradicional. Si eliges mal la vía, te topas con un límite a mitad de una ejecución o pagas más de lo necesario. Este artículo explica cada opción con las cifras de las páginas de precios y de ayuda de Anthropic, y después calcula lo que cuesta una sola ejecución de agente con tres modelos distintos.

Un desarrollador con sudadera gris trabajando en un escritorio de pie en un despacho doméstico tranquilo

Cómo se factura el SDK

El Agent SDK es una biblioteca de Python y TypeScript que lleva el bucle de agente de Claude Code, sus herramientas integradas, las sesiones y los hooks dentro de tu propio programa. La documentación de Anthropic lo describe como una biblioteca que ejecuta el binario de Claude Code en un proceso que tú gestionas. Su página de precios no incluye ninguna tarifa del SDK, así que lo que pagas es el uso del modelo: tokens de entrada, tokens de salida y actividad de caché.

Tres formas de pagar

Dónde se cobran esos tokens depende de cómo se autentique el SDK:

  • Límites de suscripción. El SDK usa tu inicio de sesión de Claude y consume la misma cuota que tus chats y tu programación interactiva. No hay un contador en dólares, solo límites que se reinician.
  • Créditos mensuales de API. Los planes Max y Team incluyen ahora un importe en dólares en cada ciclo de facturación que el SDK gasta a precios normales de API.
  • API por token. Compras créditos en la Claude Console, creas una credencial de API y cada token se factura a precio de lista.
VíaSe factura enIdeal paraOjo con
Límites de suscripciónCuota del planScripts personales y tareas nocturnasCompartir un solo grupo con tus chats
Créditos mensualesDólares que caducanPrototipos y proyectos secundariosSin acumulación al final del ciclo
Por tokenDólares que comprasProductos con usuarios realesSin tope salvo que lo definas

💡 Los proveedores de nube son una cuarta vía. El SDK puede ejecutarse en Amazon Bedrock, Google Cloud o Microsoft Foundry. Esas facturas llegan del proveedor de nube, y los créditos de Max y Team no se aplican allí.

Por qué los artículos antiguos no coinciden

Los resultados de búsqueda están llenos de afirmaciones contradictorias porque las reglas cambiaron tres veces este año:

  • 13 de mayo: Anthropic anunció que, a partir del 15 de junio, el Agent SDK, claude -p, las GitHub Actions de Claude Code y las apps de terceros creadas con el SDK pasarían a un crédito mensual independiente facturado a tarifas completas de API: 20 $ en Pro, 100 $ en Max 5x y 200 $ en Max 20x.
  • 15 de junio: Anthropic pausó ese cambio el mismo día en que debía entrar en vigor. El uso del Agent SDK siguió consumiendo los límites de suscripción y no había ningún crédito que reclamar.
  • 7 de octubre: los planes Max y Team recibieron créditos mensuales de API que incluyen el SDK. Pro no recibió ninguno.

Si un artículo dice que los suscriptores Pro reciben un crédito de 20 $ para el SDK, está describiendo el plan que se pausó.

Límites del plan o créditos mensuales

Uso con los límites del plan

La ayuda de Anthropic para el SDK indica que el uso que pasa por tu inicio de sesión de Claude sigue contando contra los límites de tu suscripción, igual que claude -p. Esa es la vía adecuada para la automatización personal: un script en tu equipo portátil o una tarea nocturna en tu propia máquina. Una suscripción cuesta 20 $ al mes en Pro, 100 $ en Max 5x y 200 $ en Max 20x, y no pagas nada por token.

La trampa está en compartir. El SDK usa el mismo grupo que cada chat y cada sesión de programación interactiva que abres, así que un bucle de agente largo puede dejarte sin cuota para el resto del día.

Tres tarjetas de papel crema en blanco de alturas crecientes sobre una mesa de nogal

Los créditos de Max y Team

El 7 de octubre de 2026, Anthropic añadió créditos mensuales de API a los planes Max y Team. Se aplican a la API de Claude, a Claude Managed Agents, al Claude Agent SDK y al playground de la Console.

PlanCrédito mensual
Max 5x100 $
Max 20x200 $
Team, puesto Standard20 $ por puesto
Team, puesto Premium100 $ por puesto
Free, Pro y EnterpriseNo elegibles

Un crédito se gasta a los precios de API de la sección siguiente, así que 100 $ equivalen a 100 $ en tokens. La programación interactiva con Claude Code y el uso extra dentro de las apps de Claude quedan excluidos, y los créditos no modifican tus límites del plan.

Un reloj de arena de latón con los últimos granos cayendo junto a un calendario de papel en blanco

Cómo reclamar y gastar los créditos

Los créditos no se activan solos. Sigue estos pasos:

  1. En claude.ai, abre Settings > Billing si tienes un plan Max, o Organization settings > Billing si tienes un plan Team.
  2. En la sección API credits, elige la organización de Claude Console que debe recibirlos y acepta las condiciones del programa.
  3. Consulta el saldo en la Console, en Settings > Billing, en la sección Promotional credits.
  4. Crea una credencial de API en esa organización y apunta el SDK a ella.

Unas cuantas reglas determinan hasta dónde llega el dinero:

  • Los nuevos suscriptores pueden reclamarlos a los 7 días en un plan elegible.
  • Cada plan se vincula a una organización de Console, y después no puedes cambiar el vínculo tú mismo, así que elige la organización en la que vas a construir.
  • Los créditos incluidos se gastan antes que los que hayas comprado, y no se necesita método de pago en Claude Platform.
  • Los créditos no usados caducan al final de cada ciclo de facturación (mensual en los planes anuales) y nunca se acumulan.
  • Cuando el saldo llega a cero y no hay nada más disponible, las peticiones se detienen hasta que llegue el siguiente lote. El uso nunca se carga a tu plan de Claude. El error dice Your credit balance is too low to access the Anthropic API.

Precios de tokens modelo por modelo

La tabla de precios actual

Estos son los precios de lista por millón de tokens de la página de precios de Anthropic, consultados el 8 de octubre de 2026.

ModeloEntradaSalidaLectura de caché
Claude Fable 5.110 $50 $0,25 $
Claude Opus 5.54 $20 $0,20 $
Claude Sonnet 5.52 $10 $0,10 $
Claude Sonnet 52 $10 $0,20 $
Claude Haiku 5.5 (prompts de hasta 100.000 tokens)0,10 $0,50 $0,01 $
Claude Haiku 4.51 $5 $0,10 $

Claude Haiku 5.5 cuesta más cuando un prompt supera los 100.000 tokens: 0,50 $ de entrada y 2,50 $ de salida.

💡 Claude Sonnet 5 se lanzó con 2 $ y 10 $ como precio de introducción hasta el 31 de agosto de 2026. La página de Anthropic indica ahora que ese es el precio estándar y que la subida prevista al 1 de septiembre, a 3 $ y 15 $, no se producirá. Cualquier página que siga mostrando esa subida está desactualizada.

Los modelos desde la versión 4.7 usan un tokenizador más reciente que genera alrededor de un 30 % más de tokens para el mismo texto que la generación 4.6 y anteriores. Compara el costo de una tarea terminada, no solo el precio por token.

Tres piezas de ajedrez de madera de tamaño creciente sobre un escritorio de nogal oscuro junto a un equipo portátil

Las lecturas de caché cuestan menos

El SDK usa el caché de prompts por su cuenta. Una escritura de caché de 5 minutos cuesta 1,25 veces el precio base de entrada, una escritura de 1 hora cuesta 2 veces, y una lectura de caché cuesta 0,1 veces. Opus 5.5 y Sonnet 5.5 se leen a 0,05 veces, y Fable 5.1 a 0,025 veces. Un bucle de agente reenvía un prefijo largo y estable en cada paso, así que la mayoría de sus tokens de entrada acaban siendo lecturas baratas.

Con una credencial de API, el caché dura 5 minutos por defecto. Si tus ejecuciones están más separadas que eso, define la variable de entorno ENABLE_PROMPT_CACHING_1H. La opción de 1 hora cuesta más escribirla y compensa cuando las ejecuciones posteriores leen el mismo prefijo.

Una mano abriendo un cajón de madera de un fichero de tarjetas de biblioteca

Multiplicadores ocultos a vigilar

Los tokens no son toda la factura. Revisa estos puntos antes de presupuestar:

  • Búsqueda web: 10 $ por cada 1.000 búsquedas en la API de Claude, además de los tokens. La obtención de páginas web no añade nada más allá de los tokens que genera.
  • Inferencia solo en EE. UU.: un multiplicador de 1,1x en todas las categorías de tokens cuando defines inference_geo: "us" en los modelos Claude 4.6 y posteriores.
  • Endpoints regionales en la nube: en Bedrock y Google Cloud, los endpoints regionales y multirregionales tienen un recargo del 10 % sobre los globales.
  • Modo rápido: Opus 5.5 funciona a 8 $ de entrada y 40 $ de salida por millón de tokens en vista previa de investigación, el doble de la tarifa estándar.
  • API de lotes: 50 % de descuento en entrada y salida, pero encaja con tareas offline enviadas directamente a la API, no con un bucle interactivo del SDK.

Cuánto cuesta una ejecución de agente

La configuración

Imagina una ejecución de corrección de errores: el agente lee algunos archivos, edita código, ejecuta las pruebas y repite unos 30 pasos. Supongamos 600.000 tokens de entrada en esos pasos, formados por 20.000 tokens sin caché, 40.000 escritos en el caché de 5 minutos y 540.000 leídos de él, más 30.000 tokens de salida. Son cifras ilustrativas, no una medición, pero tienen la forma de un bucle de agente con caché.

Vista cenital de una mano dibujando barras en papel cuadriculado junto a una calculadora desgastada

El resultado

En Sonnet 5.5, el cálculo es:

  • 20.000 tokens de entrada sin caché × 2 $ por millón = 0,04 $
  • 40.000 tokens de escritura en caché × 2,50 $ por millón = 0,10 $
  • 540.000 tokens de lectura de caché × 0,10 $ por millón = 0,054 $
  • 30.000 tokens de salida × 10 $ por millón = 0,30 $

En total, 0,494 $. Si aplicas la misma forma a tres modelos, un crédito de 100 $ compra cantidades de trabajo muy distintas:

ModeloCosto por ejecuciónEjecuciones con un crédito de 100 $
Claude Haiku 5.5unos 0,03 $más de 3.600
Claude Sonnet 5.5unos 0,49 $unas 200
Claude Opus 5.5unos 0,99 $unas 100

Hay dos lecciones claras. Primero, el caché ahorra aproximadamente dos tercios: la misma ejecución en Sonnet 5.5 sin caché costaría 1,50 $. Segundo, la salida es la parte cara. Esos 30.000 tokens de salida son alrededor del 5 % del volumen y el 61 % del costo. Un crédito de Max 20x simplemente duplica cada cifra de la última columna.

Seguir el gasto dentro del SDK

Leer la estimación de costo

Cada llamada a query() termina con un mensaje de resultado que incluye total_cost_usd, el costo estimado de esa llamada. El campo modelUsage lo desglosa por modelo, incluidas las lecturas y escrituras de caché. Hay tres detalles que confunden a la gente:

  • total_cost_usd y modelUsage incluyen el trabajo de los subagentes, pero usage no, así que usage subcuenta en cuanto se ejecutan subagentes.
  • Las llamadas paralelas a herramientas generan varios mensajes del asistente que comparten un mismo ID. Cuenta cada ID una sola vez.
  • El output_tokens de cada paso es un valor provisional. Lee el recuento real de salida en el mensaje de resultado.

💡 total_cost_usd es una estimación del lado del cliente basada en una tabla de precios incluida en el SDK. Anthropic indica que, para una facturación oficial, uses la Usage and Cost API o la página de uso de la Console, y que nunca factures a tus propios clientes a partir de la estimación.

import { query } from "@anthropic-ai/claude-agent-sdk";

for await (const message of query({
  prompt: "Fix the failing test in src/auth.ts",
  options: { maxBudgetUsd: 2 },
})) {
  if (message.type === "result") {
    console.log(message.subtype, message.total_cost_usd);
  }
}

Un contador de electricidad analógico desgastado sobre una pared de ladrillo rojo

Limitar una ejecución

La opción maxBudgetUsd en TypeScript, o max_budget_usd en Python, detiene una llamada cuando su propio gasto supera el límite. Solo cuenta esa llamada: el gasto recuperado de una sesión reanudada no le suma, y un /clear reinicia el presupuesto. El resultado llega entonces con el subtipo error_max_budget_usd.

Para fijar un techo en todo un proyecto, asígnale su propio workspace de la Console y define el límite de gasto de ese workspace. Cada credencial y workspace de una organización vinculada consume del mismo saldo de créditos, así que un límite por workspace evita que una tarea descontrolada se coma la cuota del mes.

Equipos, productos y Managed Agents

Cómo funcionan los grupos de equipo

Los créditos de Team son 20 $ por puesto Standard y 100 $ por puesto Premium, agrupados en un saldo único con un tope de 500 $ al mes. Un equipo con tres puestos Standard y dos Premium recibe 260 $ al mes, y añadir un puesto Premium eleva el crédito del mes siguiente a 360 $. El importe lo determinan los puestos del plan al inicio de cada mes de facturación. Vincular una organización también la sitúa en al menos el nivel de uso Start, o en el nivel Build si el crédito mensual supera los 200 $.

Cuatro compañeros alrededor de una mesa de madera en un estudio de coworking luminoso

Crear para clientes

Si lanzas un producto, cuenta con la facturación por API. Anthropic no permite que los desarrolladores externos ofrezcan en sus productos el inicio de sesión de claude.ai ni sus límites de uso, incluidos los agentes creados con el SDK, salvo que Anthropic lo haya aprobado de antemano. Los créditos mensuales están pensados para crear y ejecutar tus propias aplicaciones y agentes, así que mantén el tráfico de clientes en la facturación por token, donde controlas los límites de gasto por workspace.

Comparación con Managed Agents

Claude Managed Agents es la alternativa alojada: Anthropic ejecuta el bucle de agente en un entorno sandbox en la nube que gestiona. Factura las mismas tarifas de tokens más 0,08 $ por hora de sesión, contadas solo mientras la sesión está en marcha. El tiempo inactivo no cuenta. Una sesión de una hora en Sonnet 5.5 con 50.000 tokens de entrada y 15.000 de salida cuesta 0,10 $ + 0,15 $ + 0,08 $, es decir, 0,33 $. Con el SDK no hay cargo por tiempo de ejecución, pero la máquina en la que corre la pagas tú. Los créditos de Max y Team funcionan en ambos casos.

Usa Claude Sonnet 5 en PicassoIA

Antes de gastar créditos ajustando un agente, redacta y prueba su prompt de sistema en un modelo de chat. Claude Sonnet 5 está disponible en PicassoIA, pensado para programación en varios pasos y tareas de uso de herramientas, lo que lo convierte en un lugar práctico para probar un prompt antes de conectarlo al SDK.

Una joven escribiendo en un equipo portátil junto a una ventana en una cafetería tranquila

  1. Abre la página de Claude Sonnet 5 en la colección Large Language Models.
  2. Pega la tarea en Prompt y luego escribe el rol y las reglas en System Prompt.
  3. Ajusta Effort. El valor por defecto, low, desactiva el razonamiento para obtener respuestas más rápidas y baratas. Sube por medium, high, xhigh y max para un error que afecta a varios archivos.
  4. Deja Max Tokens en 8.192 salvo que esperes una respuesta más larga.
  5. Adjunta una captura en Image si la tarea parte de una pantalla de error. Max Image Resolution tiene por defecto 0,5 megapíxeles, y una imagen cuenta como ancho × alto ÷ 750 tokens de entrada.
  6. Ejecútalo, ajusta la redacción y copia la versión que funcione en las opciones de tu SDK.

💡 La escala de effort también mueve la factura del SDK. Más effort significa más tokens de salida, y la salida es el lado caro de cada tabla de precios de arriba.

Para comparar cómo responde un modelo más ligero o más pesado al mismo prompt, Claude Haiku 4.5, Claude Opus 4.7 y Claude Fable 5 están en la misma colección.

Crea tus propias imágenes en PicassoIA

Todas las fotos de este artículo salieron de P Image, un modelo de texto a imagen de PicassoIA que devuelve una imagen terminada en menos de un segundo. Admite 16:9, 1:1, 9:16 y tamaños personalizados, ofrece upsampling de prompts para ideas breves y acepta una semilla para que un resultado que te guste pueda reproducirse exactamente.

Pruébalo ahora. Describe una escena en una sola frase, por ejemplo una mesa, una ventana y la luz de última hora de la tarde. Ejecútalo, cambia un solo detalle y vuelve a ejecutarlo. Diez intentos llevan unos minutos, y al final tendrás una idea de cómo las palabras sobre cámara, luz y textura dan forma a una foto.

PicassoIA también ofrece 91 modelos de texto a imagen y 87 modelos de texto a video, además de modelos de música, voz y lenguaje, todos en la lista completa de modelos. Elige uno, escribe un prompt y crea algo propio hoy mismo.

Compartir este artículo

Elige tu idioma