Precios de Claude Agent SDK: suscripción, créditos y costos
El uso de Claude Agent SDK puede consumir los límites del plan, los créditos mensuales de API que se añadieron a los planes Max y Team el 7 de octubre o la facturación por token. Este artículo detalla cada precio, los importes de los créditos, el ahorro por caché y un cálculo de costo para una ejecución de agente.
El Claude Agent SDK no tiene precio propio. La factura viene del modelo que hay detrás, y a partir del 8 de octubre de 2026 puede llegarte de tres formas distintas: a través de tus límites de suscripción, a través de los nuevos créditos mensuales de API de los planes Max y Team, o mediante la facturación por token tradicional. Si eliges mal la vía, te topas con un límite a mitad de una ejecución o pagas más de lo necesario. Este artículo explica cada opción con las cifras de las páginas de precios y de ayuda de Anthropic, y después calcula lo que cuesta una sola ejecución de agente con tres modelos distintos.
Cómo se factura el SDK
El Agent SDK es una biblioteca de Python y TypeScript que lleva el bucle de agente de Claude Code, sus herramientas integradas, las sesiones y los hooks dentro de tu propio programa. La documentación de Anthropic lo describe como una biblioteca que ejecuta el binario de Claude Code en un proceso que tú gestionas. Su página de precios no incluye ninguna tarifa del SDK, así que lo que pagas es el uso del modelo: tokens de entrada, tokens de salida y actividad de caché.
Tres formas de pagar
Dónde se cobran esos tokens depende de cómo se autentique el SDK:
Límites de suscripción. El SDK usa tu inicio de sesión de Claude y consume la misma cuota que tus chats y tu programación interactiva. No hay un contador en dólares, solo límites que se reinician.
Créditos mensuales de API. Los planes Max y Team incluyen ahora un importe en dólares en cada ciclo de facturación que el SDK gasta a precios normales de API.
API por token. Compras créditos en la Claude Console, creas una credencial de API y cada token se factura a precio de lista.
Vía
Se factura en
Ideal para
Ojo con
Límites de suscripción
Cuota del plan
Scripts personales y tareas nocturnas
Compartir un solo grupo con tus chats
Créditos mensuales
Dólares que caducan
Prototipos y proyectos secundarios
Sin acumulación al final del ciclo
Por token
Dólares que compras
Productos con usuarios reales
Sin tope salvo que lo definas
💡 Los proveedores de nube son una cuarta vía. El SDK puede ejecutarse en Amazon Bedrock, Google Cloud o Microsoft Foundry. Esas facturas llegan del proveedor de nube, y los créditos de Max y Team no se aplican allí.
Por qué los artículos antiguos no coinciden
Los resultados de búsqueda están llenos de afirmaciones contradictorias porque las reglas cambiaron tres veces este año:
13 de mayo: Anthropic anunció que, a partir del 15 de junio, el Agent SDK, claude -p, las GitHub Actions de Claude Code y las apps de terceros creadas con el SDK pasarían a un crédito mensual independiente facturado a tarifas completas de API: 20 $ en Pro, 100 $ en Max 5x y 200 $ en Max 20x.
15 de junio: Anthropic pausó ese cambio el mismo día en que debía entrar en vigor. El uso del Agent SDK siguió consumiendo los límites de suscripción y no había ningún crédito que reclamar.
7 de octubre: los planes Max y Team recibieron créditos mensuales de API que incluyen el SDK. Pro no recibió ninguno.
Si un artículo dice que los suscriptores Pro reciben un crédito de 20 $ para el SDK, está describiendo el plan que se pausó.
Límites del plan o créditos mensuales
Uso con los límites del plan
La ayuda de Anthropic para el SDK indica que el uso que pasa por tu inicio de sesión de Claude sigue contando contra los límites de tu suscripción, igual que claude -p. Esa es la vía adecuada para la automatización personal: un script en tu equipo portátil o una tarea nocturna en tu propia máquina. Una suscripción cuesta 20 $ al mes en Pro, 100 $ en Max 5x y 200 $ en Max 20x, y no pagas nada por token.
La trampa está en compartir. El SDK usa el mismo grupo que cada chat y cada sesión de programación interactiva que abres, así que un bucle de agente largo puede dejarte sin cuota para el resto del día.
Los créditos de Max y Team
El 7 de octubre de 2026, Anthropic añadió créditos mensuales de API a los planes Max y Team. Se aplican a la API de Claude, a Claude Managed Agents, al Claude Agent SDK y al playground de la Console.
Plan
Crédito mensual
Max 5x
100 $
Max 20x
200 $
Team, puesto Standard
20 $ por puesto
Team, puesto Premium
100 $ por puesto
Free, Pro y Enterprise
No elegibles
Un crédito se gasta a los precios de API de la sección siguiente, así que 100 $ equivalen a 100 $ en tokens. La programación interactiva con Claude Code y el uso extra dentro de las apps de Claude quedan excluidos, y los créditos no modifican tus límites del plan.
Cómo reclamar y gastar los créditos
Los créditos no se activan solos. Sigue estos pasos:
En claude.ai, abre Settings > Billing si tienes un plan Max, o Organization settings > Billing si tienes un plan Team.
En la sección API credits, elige la organización de Claude Console que debe recibirlos y acepta las condiciones del programa.
Consulta el saldo en la Console, en Settings > Billing, en la sección Promotional credits.
Crea una credencial de API en esa organización y apunta el SDK a ella.
Unas cuantas reglas determinan hasta dónde llega el dinero:
Los nuevos suscriptores pueden reclamarlos a los 7 días en un plan elegible.
Cada plan se vincula a una organización de Console, y después no puedes cambiar el vínculo tú mismo, así que elige la organización en la que vas a construir.
Los créditos incluidos se gastan antes que los que hayas comprado, y no se necesita método de pago en Claude Platform.
Los créditos no usados caducan al final de cada ciclo de facturación (mensual en los planes anuales) y nunca se acumulan.
Cuando el saldo llega a cero y no hay nada más disponible, las peticiones se detienen hasta que llegue el siguiente lote. El uso nunca se carga a tu plan de Claude. El error dice Your credit balance is too low to access the Anthropic API.
Precios de tokens modelo por modelo
La tabla de precios actual
Estos son los precios de lista por millón de tokens de la página de precios de Anthropic, consultados el 8 de octubre de 2026.
Claude Haiku 5.5 cuesta más cuando un prompt supera los 100.000 tokens: 0,50 $ de entrada y 2,50 $ de salida.
💡 Claude Sonnet 5 se lanzó con 2 $ y 10 $ como precio de introducción hasta el 31 de agosto de 2026. La página de Anthropic indica ahora que ese es el precio estándar y que la subida prevista al 1 de septiembre, a 3 $ y 15 $, no se producirá. Cualquier página que siga mostrando esa subida está desactualizada.
Los modelos desde la versión 4.7 usan un tokenizador más reciente que genera alrededor de un 30 % más de tokens para el mismo texto que la generación 4.6 y anteriores. Compara el costo de una tarea terminada, no solo el precio por token.
Las lecturas de caché cuestan menos
El SDK usa el caché de prompts por su cuenta. Una escritura de caché de 5 minutos cuesta 1,25 veces el precio base de entrada, una escritura de 1 hora cuesta 2 veces, y una lectura de caché cuesta 0,1 veces. Opus 5.5 y Sonnet 5.5 se leen a 0,05 veces, y Fable 5.1 a 0,025 veces. Un bucle de agente reenvía un prefijo largo y estable en cada paso, así que la mayoría de sus tokens de entrada acaban siendo lecturas baratas.
Con una credencial de API, el caché dura 5 minutos por defecto. Si tus ejecuciones están más separadas que eso, define la variable de entorno ENABLE_PROMPT_CACHING_1H. La opción de 1 hora cuesta más escribirla y compensa cuando las ejecuciones posteriores leen el mismo prefijo.
Multiplicadores ocultos a vigilar
Los tokens no son toda la factura. Revisa estos puntos antes de presupuestar:
Búsqueda web: 10 $ por cada 1.000 búsquedas en la API de Claude, además de los tokens. La obtención de páginas web no añade nada más allá de los tokens que genera.
Inferencia solo en EE. UU.: un multiplicador de 1,1x en todas las categorías de tokens cuando defines inference_geo: "us" en los modelos Claude 4.6 y posteriores.
Endpoints regionales en la nube: en Bedrock y Google Cloud, los endpoints regionales y multirregionales tienen un recargo del 10 % sobre los globales.
Modo rápido: Opus 5.5 funciona a 8 $ de entrada y 40 $ de salida por millón de tokens en vista previa de investigación, el doble de la tarifa estándar.
API de lotes: 50 % de descuento en entrada y salida, pero encaja con tareas offline enviadas directamente a la API, no con un bucle interactivo del SDK.
Cuánto cuesta una ejecución de agente
La configuración
Imagina una ejecución de corrección de errores: el agente lee algunos archivos, edita código, ejecuta las pruebas y repite unos 30 pasos. Supongamos 600.000 tokens de entrada en esos pasos, formados por 20.000 tokens sin caché, 40.000 escritos en el caché de 5 minutos y 540.000 leídos de él, más 30.000 tokens de salida. Son cifras ilustrativas, no una medición, pero tienen la forma de un bucle de agente con caché.
El resultado
En Sonnet 5.5, el cálculo es:
20.000 tokens de entrada sin caché × 2 $ por millón = 0,04 $
40.000 tokens de escritura en caché × 2,50 $ por millón = 0,10 $
540.000 tokens de lectura de caché × 0,10 $ por millón = 0,054 $
30.000 tokens de salida × 10 $ por millón = 0,30 $
En total, 0,494 $. Si aplicas la misma forma a tres modelos, un crédito de 100 $ compra cantidades de trabajo muy distintas:
Modelo
Costo por ejecución
Ejecuciones con un crédito de 100 $
Claude Haiku 5.5
unos 0,03 $
más de 3.600
Claude Sonnet 5.5
unos 0,49 $
unas 200
Claude Opus 5.5
unos 0,99 $
unas 100
Hay dos lecciones claras. Primero, el caché ahorra aproximadamente dos tercios: la misma ejecución en Sonnet 5.5 sin caché costaría 1,50 $. Segundo, la salida es la parte cara. Esos 30.000 tokens de salida son alrededor del 5 % del volumen y el 61 % del costo. Un crédito de Max 20x simplemente duplica cada cifra de la última columna.
Seguir el gasto dentro del SDK
Leer la estimación de costo
Cada llamada a query() termina con un mensaje de resultado que incluye total_cost_usd, el costo estimado de esa llamada. El campo modelUsage lo desglosa por modelo, incluidas las lecturas y escrituras de caché. Hay tres detalles que confunden a la gente:
total_cost_usd y modelUsage incluyen el trabajo de los subagentes, pero usage no, así que usage subcuenta en cuanto se ejecutan subagentes.
Las llamadas paralelas a herramientas generan varios mensajes del asistente que comparten un mismo ID. Cuenta cada ID una sola vez.
El output_tokens de cada paso es un valor provisional. Lee el recuento real de salida en el mensaje de resultado.
💡 total_cost_usd es una estimación del lado del cliente basada en una tabla de precios incluida en el SDK. Anthropic indica que, para una facturación oficial, uses la Usage and Cost API o la página de uso de la Console, y que nunca factures a tus propios clientes a partir de la estimación.
import { query } from "@anthropic-ai/claude-agent-sdk";
for await (const message of query({
prompt: "Fix the failing test in src/auth.ts",
options: { maxBudgetUsd: 2 },
})) {
if (message.type === "result") {
console.log(message.subtype, message.total_cost_usd);
}
}
Limitar una ejecución
La opción maxBudgetUsd en TypeScript, o max_budget_usd en Python, detiene una llamada cuando su propio gasto supera el límite. Solo cuenta esa llamada: el gasto recuperado de una sesión reanudada no le suma, y un /clear reinicia el presupuesto. El resultado llega entonces con el subtipo error_max_budget_usd.
Para fijar un techo en todo un proyecto, asígnale su propio workspace de la Console y define el límite de gasto de ese workspace. Cada credencial y workspace de una organización vinculada consume del mismo saldo de créditos, así que un límite por workspace evita que una tarea descontrolada se coma la cuota del mes.
Equipos, productos y Managed Agents
Cómo funcionan los grupos de equipo
Los créditos de Team son 20 $ por puesto Standard y 100 $ por puesto Premium, agrupados en un saldo único con un tope de 500 $ al mes. Un equipo con tres puestos Standard y dos Premium recibe 260 $ al mes, y añadir un puesto Premium eleva el crédito del mes siguiente a 360 $. El importe lo determinan los puestos del plan al inicio de cada mes de facturación. Vincular una organización también la sitúa en al menos el nivel de uso Start, o en el nivel Build si el crédito mensual supera los 200 $.
Crear para clientes
Si lanzas un producto, cuenta con la facturación por API. Anthropic no permite que los desarrolladores externos ofrezcan en sus productos el inicio de sesión de claude.ai ni sus límites de uso, incluidos los agentes creados con el SDK, salvo que Anthropic lo haya aprobado de antemano. Los créditos mensuales están pensados para crear y ejecutar tus propias aplicaciones y agentes, así que mantén el tráfico de clientes en la facturación por token, donde controlas los límites de gasto por workspace.
Comparación con Managed Agents
Claude Managed Agents es la alternativa alojada: Anthropic ejecuta el bucle de agente en un entorno sandbox en la nube que gestiona. Factura las mismas tarifas de tokens más 0,08 $ por hora de sesión, contadas solo mientras la sesión está en marcha. El tiempo inactivo no cuenta. Una sesión de una hora en Sonnet 5.5 con 50.000 tokens de entrada y 15.000 de salida cuesta 0,10 $ + 0,15 $ + 0,08 $, es decir, 0,33 $. Con el SDK no hay cargo por tiempo de ejecución, pero la máquina en la que corre la pagas tú. Los créditos de Max y Team funcionan en ambos casos.
Antes de gastar créditos ajustando un agente, redacta y prueba su prompt de sistema en un modelo de chat. Claude Sonnet 5 está disponible en PicassoIA, pensado para programación en varios pasos y tareas de uso de herramientas, lo que lo convierte en un lugar práctico para probar un prompt antes de conectarlo al SDK.
Abre la página de Claude Sonnet 5 en la colección Large Language Models.
Pega la tarea en Prompt y luego escribe el rol y las reglas en System Prompt.
Ajusta Effort. El valor por defecto, low, desactiva el razonamiento para obtener respuestas más rápidas y baratas. Sube por medium, high, xhigh y max para un error que afecta a varios archivos.
Deja Max Tokens en 8.192 salvo que esperes una respuesta más larga.
Adjunta una captura en Image si la tarea parte de una pantalla de error. Max Image Resolution tiene por defecto 0,5 megapíxeles, y una imagen cuenta como ancho × alto ÷ 750 tokens de entrada.
Ejecútalo, ajusta la redacción y copia la versión que funcione en las opciones de tu SDK.
💡 La escala de effort también mueve la factura del SDK. Más effort significa más tokens de salida, y la salida es el lado caro de cada tabla de precios de arriba.
Todas las fotos de este artículo salieron de P Image, un modelo de texto a imagen de PicassoIA que devuelve una imagen terminada en menos de un segundo. Admite 16:9, 1:1, 9:16 y tamaños personalizados, ofrece upsampling de prompts para ideas breves y acepta una semilla para que un resultado que te guste pueda reproducirse exactamente.
Pruébalo ahora. Describe una escena en una sola frase, por ejemplo una mesa, una ventana y la luz de última hora de la tarde. Ejecútalo, cambia un solo detalle y vuelve a ejecutarlo. Diez intentos llevan unos minutos, y al final tendrás una idea de cómo las palabras sobre cámara, luz y textura dan forma a una foto.
PicassoIA también ofrece 91 modelos de texto a imagen y 87 modelos de texto a video, además de modelos de música, voz y lenguaje, todos en la lista completa de modelos. Elige uno, escribe un prompt y crea algo propio hoy mismo.