Claude Opus 5.5 cuesta $4 por millón de tokens de entrada y $20 por millón de tokens de salida en la API de Anthropic. Eso es un 20% menos que Claude Opus 5, que cobra $5 y $25, y cada otra línea de tu factura se calcula a partir de esos dos números. Una respuesta corta en el chat cuesta unos dos centavos. Un servicio de atención al cliente muy activo se acerca a los cuatrocientos dólares al mes. Y la ruta gratuita que la gente sigue buscando tiene un límite estricto que muchas páginas de "Opus gratis" no mencionan. Aquí tienes cifras reales de los tres casos, para que calcules tu propia factura antes de escribir una sola línea de código.

El precio en una tabla
Anthropic cobra Claude por token, y cada tarifa de abajo es por un millón de tokens (MTok). Un token equivale a unos cuatro caracteres en inglés, así que 1.000 tokens son unas 750 palabras, y un informe de 10 páginas ronda los 7.000 tokens.
Tarifas por millón de tokens
| Concepto | Precio por millón de tokens |
|---|
| Entrada, estándar | $4,00 |
| Salida, estándar | $20,00 |
| Lectura de caché | $0,20 |
| Escritura en caché, 5 minutos | $5,00 |
| Escritura en caché, 1 hora | $8,00 |
| Entrada por lotes | $2,00 |
| Salida por lotes | $10,00 |
| Modo rápido, entrada y salida | $8,00 y $40,00 |
Cuatro datos más marcan la factura:
- ID del modelo:
claude-opus-5-5
- Ventana de contexto: 1 millón de tokens
- Salida máxima: 128.000 tokens por respuesta
- Priority Tier: no disponible para este modelo
La fórmula es sencilla: (tokens de entrada × 4 + tokens de salida × 20) ÷ 1.000.000 da el costo en dólares. Una petición con 10.000 tokens de entrada y 1.000 de salida cuesta $0,04 más $0,02, es decir, seis centavos. Cada respuesta de la API informa de los tokens exactos de entrada y salida en sus datos de uso, así que registra esas cifras en cada petición y multiplícalas. Los equipos que omiten este paso tienden a subestimar la salida, que es el lado caro.
💡 La salida cuesta cinco veces más que la entrada. Una respuesta larga dispara la factura mucho más que un prompt largo, así que define un max_tokens razonable en cada petición.

Los tokens de razonamiento también se cobran
Opus 5.5 siempre razona antes de responder. No puedes desactivar el razonamiento, y los tokens de razonamiento se cobran a la tarifa de salida de $20 por millón. El nivel de esfuerzo por defecto es medio. Una pregunta difícil de programación con esfuerzo alto puede consumir miles de tokens de razonamiento antes de la primera palabra visible, así que una respuesta de 500 palabras puede facturar muchos más tokens de salida de los que ves.
Dos detalles más cambian las estimaciones antiguas. Opus 5.5 usa el tokenizador presentado con Opus 4.7, que puede generar hasta un 35% más de tokens que los modelos Claude anteriores para el mismo texto. Si tu presupuesto se basó en cifras de Claude 4.6, vuelve a medir con el endpoint de conteo de tokens antes de fiarte de él.
Lo que cuestan las cargas de trabajo reales
Las tarifas dicen poco hasta que las aplicas a una tarea. Todas las cifras de esta sección usan las tarifas estándar de $4 y $20, sin caché y sin descuento por lotes.
Chat, borradores y revisiones de código
| Tarea | Tokens de entrada | Tokens de salida | Costo |
|---|
| Una respuesta de chat | 2.000 | 800 | $0,024 |
| Borrador de artículo de 2.500 palabras | 1.500 | 3.300 | $0,072 |
| Revisión de una pull request | 30.000 | 3.000 | $0,18 |
| Revisión de un contrato largo | 200.000 | 4.000 | $0,88 |
Incluso la revisión del contrato, con 200.000 tokens de entrada, se queda por debajo de un dólar. La sorpresa rara vez viene de una sola llamada. Viene de las mil llamadas que nadie contó y de los tokens de razonamiento que van con cada una.
Las sesiones de agentes suman rápido
Un agente que edita archivos y ejecuta pruebas vuelve a leer su contexto, que crece, en cada paso. Imagina una sesión de 40 pasos que consume 500.000 tokens de entrada en total y escribe 40.000 tokens de salida:
- Entrada: 500.000 tokens × $4 por millón = $2,00
- Salida: 40.000 tokens × $20 por millón = $0,80
- Total: $2,80
Ahora guarda en caché el contexto repetido, de modo que el 90% de la entrada se lea desde la caché. Los 450.000 tokens en caché cuestan $0,09, los 50.000 tokens nuevos cuestan $0,20, y la salida sigue en $0,80. La sesión baja a unos $1,09, más una escritura en caché única en la primera petición.
Calcula el presupuesto de un mes antes de empezar
Un método rápido evita que las sorpresas sean grandes:
- Haz 50 peticiones reales y anota el promedio de tokens de entrada y salida.
- Multiplica por tu volumen mensual previsto.
- Añade un 30% para reintentos, conversaciones más largas y variaciones en el razonamiento.
- Aplica los descuentos de caché o por lotes solo al tráfico que de verdad cumple los requisitos.
Pruébalo con una app que hace 20.000 peticiones al mes, de 3.000 tokens de entrada y 700 de salida cada una. La entrada son 60 millones de tokens, que cuestan $240. La salida son 14 millones de tokens, que cuestan $280. La factura base es $520, y el margen del 30% lleva la cifra de planificación a $676.

Opus 5.5 frente al resto
Más barato que Opus 5
Opus 5.5 cobra $4 y $20 donde Opus 5 cobra $5 y $25, un recorte del 20% en ambos lados. Las lecturas de caché bajan de $0,50 a $0,20 por millón de tokens, un recorte del 60%. La ventana de contexto, el límite de salida y el tokenizador siguen igual, así que para un equipo que ya usa Opus 5, la bajada de precio por sí sola es motivo para probar el cambio. Un equipo que gasta $5.000 al mes en Opus 5 pagaría unos $4.000 por el mismo volumen de tokens en Opus 5.5, un ahorro de $1.000 al mes o $12.000 al año, antes de cualquier descuento por caché o por lotes.
Revisa primero dos cambios incompatibles: en Opus 5.5 no se puede desactivar el razonamiento, y forzar una herramienta concreta con tool_choice devuelve un error. El código escrito para modelos Opus anteriores podría necesitar pequeños cambios.
Para comparar la familia de forma justa, toma una misma carga de trabajo: un servicio de atención que responde 1.000 tickets al día, con 1.500 tokens de entrada y 400 de salida cada uno, durante 30 días.
| Modelo | Entrada y salida por MTok | Factura mensual |
|---|
| Claude Fable 5.1 | $10 y $50 | $1.050 |
| Claude Opus 5 | $5 y $25 | $525 |
| Claude Opus 5.5 | $4 y $20 | $420 |
| Claude Sonnet 5.5 | $2 y $10 | $210 |
| Claude Haiku 4.5 | $1 y $5 | $105 |
Opus 5.5 queda $105 por debajo de Opus 5 cada mes en esta carga de trabajo, y una ejecución por lotes lo reduciría a la mitad, hasta $210.
Cuándo gana Sonnet o Haiku
El precio por llamada no es el precio por tarea terminada. Un modelo más barato que necesita dos reintentos cuesta más que uno más potente que acierta a la primera. Aun así, en la práctica la división es clara:
- Opus 5.5: ejecuciones largas de agentes, depuración difícil, razonamiento a nivel de contrato.
- Claude Sonnet 5.5 a $2 y $10: programación cotidiana, redacción y chat a la mitad del precio de Opus.
- Claude Haiku 4.5 a $1 y $5: clasificación, enrutamiento y etiquetado a gran volumen.
Prueba tus propios prompts con los tres y, después, compara costo por resultado correcto en lugar de costo por petición.

La caché de prompts se amortiza rápido
Supongamos que haces diez preguntas sobre el mismo contrato de 100.000 tokens. Sin caché, cada petición paga $0,40 por esa entrada: $4,00 en total por diez. Con una caché de 5 minutos, la primera petición escribe el contrato a $5 por millón ($0,50) y las nueve siguientes lo leen a $0,20 por millón ($0,02 cada una). El total de entrada es $0,68.
Pon primero el material estable (instrucciones, documentos, definiciones de herramientas) y la pregunta cambiante al final, porque la caché funciona sobre un prefijo exacto. Una sola palabra editada cerca del principio invalida todo lo que viene después.
Los trabajos por lotes cuestan la mitad
La Batch API recibe peticiones en bloque y devuelve los resultados de forma asíncrona, normalmente en menos de un día, al 50% de los precios estándar: $2 de entrada y $10 de salida por millón de tokens. Cualquier cosa por la que nadie espere es apta: resúmenes nocturnos, descripciones de catálogo, etiquetado de conjuntos de datos, evaluaciones. El ejemplo del servicio de atención baja de $420 a $210 al mes si las respuestas pueden esperar, y Batch se puede combinar con la caché para un recorte aún mayor.

Baja el nivel de esfuerzo
El esfuerzo es la palanca más barata, porque reduce los tokens de razonamiento sin tocar el prompt. El valor por defecto en Opus 5.5 es medio. El chat, las reescrituras breves y la extracción simple rara vez necesitan más que low, mientras que las refactorizaciones de varios archivos y la depuración complicada merecen high. Mide con una muestra de tus peticiones reales antes de cambiar un valor por defecto, y combina el ajuste con un techo de max_tokens.
💡 El modo rápido duplica el precio. Ejecuta el mismo modelo a hasta 2,5 veces la velocidad de salida, por $8 de entrada y $40 de salida por millón de tokens. Es una vista previa de investigación solo en la API de Anthropic, y no se puede combinar con la Batch API. Úsalo solo cuando haya una persona esperando en pantalla.
Acceso gratuito: qué es real
Seamos directos. A principios de octubre de 2026 no existe un nivel gratuito para Opus 5.5 en la API, y el plan gratuito de claude.ai no lo incluye. Todas las vías que funcionan tienen un precio o una trampa que conviene conocer.
El límite del plan gratuito
El plan gratuito de Claude te da chat con modelos de clase Sonnet y Haiku, dentro de límites de uso diarios. Opus 5.5 está detrás de un plan de pago. Eso encaja con cómo funciona la API: pago por uso desde la primera petición, con créditos prepagados y sin una cuota gratuita permanente. Los planes y los límites cambian a menudo, así que lee la página de planes de la web de Claude antes de pagar nada.

Planes de pago que incluyen Opus
Claude Pro cuesta $20 al mes y Claude Max empieza en $100 al mes. Ambos abren modelos Opus dentro de la app de chat, con límites de uso en lugar de facturación por token. Una comparación aproximada: a tarifas de API, $20 dan para unas 830 respuestas de chat del tamaño que calculamos antes (2.000 tokens de entrada, 800 de salida). Un usuario ocasional suele salir ganando con un plan, mientras que una app que hace miles de llamadas necesita la API.
Los créditos de nube son el otro descuento legítimo. Amazon Bedrock, Google Cloud Vertex AI y Microsoft Foundry ofrecen Claude, y una empresa que ya tenga créditos con alguno de ellos puede gastarlos allí. Bedrock y Vertex AI publican sus propias tarifas, así que compruébalas en lugar de suponer que las cifras de este artículo se aplican.

Sitios que prometen Opus gratis
Busca Opus 5.5 gratis y encontrarás páginas que prometen acceso ilimitado sin registro. Desconfía de ellas. Muchas son intermediarios que revenden una cuota pequeña, algunas te redirigen a un modelo más barato sin decirlo, y otras recogen todo lo que pegas. Nunca envíes contratos, código fuente ni datos de clientes a un sitio que no puedas verificar. Unos pocos centavos por petición en la API oficial salen más baratos que una filtración.
Si solo necesitas respuestas de nivel Opus unas pocas veces a la semana, la vía honesta más barata es un saldo pequeño prepagado en la API. Con unos 2,4 centavos por respuesta de chat, cada $10 compra unas 400 respuestas del tamaño que calculamos antes.
La versión corta:
- Nivel gratuito para Opus 5.5 en la API: no
- Opus 5.5 en el plan gratuito de claude.ai: no, a principios de octubre de 2026
- Precio fijo mensual para acceso al chat: desde $20
- Mayores descuentos en la API: caché y lotes
- Modelos de texto gratuitos para probar en su lugar: modelos abiertos del catálogo de PicassoIA
Cómo usar Claude en PicassoIA
Opus 5.5 en sí no está en el catálogo de PicassoIA en el momento de escribir este artículo. El modelo Opus más cercano es Claude Opus 4.7, y la misma colección incluye Claude Fable 5, Claude Sonnet 5, Claude Sonnet 4.6 y Claude 4.5 Haiku. Abres una página, escribes y lees la respuesta. No hay que configurar una cuenta de desarrollador ni vigilar un panel de facturación.
Abre la página del modelo
- Abre la página de Claude Opus 4.7 en la colección de modelos de lenguaje (LLM).
- Escribe tu pregunta en el cuadro Prompt. Pega código, un borrador o un documento largo.
- Si quieres, sube una imagen, por ejemplo una captura de una factura o un diagrama.
- Ejecuta el modelo y lee la respuesta.
Define el prompt y los límites
| Ajuste | Por defecto | Qué hace |
|---|
| Prompt | Obligatorio | Tu pregunta o tarea |
| System Prompt | Vacío | Define el rol, el tono y las reglas de formato |
| Max Tokens | 8.192 | Limita la longitud de la respuesta |
| Image | Ninguna | Añade una captura o una foto |
| Max Image Resolution | 0,5 megapíxeles | Reduce la imagen antes de enviarla, lo que ahorra tiempo y dinero |
Tres hábitos mejoran las respuestas. Asigna un rol en el system prompt, por ejemplo "Eres un revisor cuidadoso de páginas de precios." Pide una tabla cuando quieras una comparación. Baja Max Tokens cuando solo necesites una respuesta corta.
💡 ¿Buscas una opción sin costo? El catálogo también incluye modelos abiertos como GPT OSS 120B y Llama 4 Maverick Instruct, ambos marcados como gratuitos para probar. La calidad y los límites difieren de Opus, así que pruébalos con tus propios prompts.

Combina Claude con imágenes y video
Un modelo de lenguaje también tiene su lugar en un flujo de trabajo visual. Pide a Claude veinte prompts de imagen detallados de unas 120 palabras cada uno. Eso son unos 3.200 tokens de salida, o unos 6 centavos a la tarifa de salida de Opus 5.5, y los prompts incluyen el detalle del objetivo, la iluminación y la textura que hacen que las fotos generadas parezcan reales.
Una petición que funciona bien se ve así: "Escribe un prompt fotográfico de 70 palabras para una escena de cocina por la mañana. Incluye el sujeto, el entorno, la dirección de la luz, el objetivo de la cámara y dos texturas de superficie. Sin texto en la imagen." Claude devuelve un párrafo denso que puedes pegar directamente en un modelo de imagen, y una segunda pasada cuesta solo unos centavos más.
Después pasa a los modelos de imagen y video de PicassoIA:
- Imágenes: pega el prompt en Seedream 4.5 o P-Image para obtener fotos fotorrealistas.
- Video: usa una imagen fija como fotograma inicial en Seedance 2.5 Lite o PicassoIA Video. La ficha de Seedance 2.5 Lite lo describe como un generador gratuito e ilimitado de clips de hasta 10 segundos.
- Iterar: envía el resultado de vuelta a Claude, pregunta qué cambiar y vuelve a ejecutarlo.
Usar una herramienta para las palabras y otra para las imágenes hace visible el costo de cada parte. Pagas centavos por el prompt y dejas que el modelo de imagen o de video haga el trabajo pesado.

Crea tus primeras imágenes en PicassoIA
Ahora tienes el precio de Opus 5.5, el punto en el que terminan las vías gratuitas y tres formas de estirar cada token. La forma más rápida de aprovecharlo es probarlo tú mismo. Abre PicassoIA, pide a un modelo de Claude que redacte un prompt fotográfico para una escena que te importe y pásalo por Seedream 4.5. Luego lleva el mejor fotograma a un modelo de video y míralo moverse. Explora todo lo demás en todos los modelos de PicassoIA, y sigue experimentando hasta que los prompts te parezcan tuyos.