Anthropic lanzó Claude Opus 5.5 el 22 de septiembre de 2026, cinco meses después de que Claude Opus 4.7 llegara el 16 de abril. La sorpresa está en el precio: bajó. Opus 5.5 cuesta $4 por millón de tokens de entrada y $20 por millón de tokens de salida, mientras que Opus 4.7 sigue en $5 y $25. Un modelo más barato y con una fecha de corte de conocimiento más reciente convierte la pregunta de la actualización en una cuestión práctica.
Las actualizaciones tienen costos que nunca aparecen en una factura. Algunas llamadas a la API que funcionaban bien en 4.7 ahora devuelven un error 400 en 5.5, y tus evaluaciones deberían repetirse antes de cambiar un ID de modelo en producción. Esta comparativa se basa en las páginas oficiales de precios y modelos de Anthropic y en índices de benchmarks de terceros, y señala con claridad dónde la evidencia es escasa.

💡 Resumen rápido: si pagas facturas de API cada mes, Opus 5.5 supone un descuento del 20% al 31% en las mismas cargas de trabajo, con algunos cambios que romperían el código y que conviene revisar antes. Si usas Claude a través de una página de chat alojada, no hay factura que reducir ni código que migrar, así que la decisión es más sencilla.
El veredicto rápido
Aquí va la respuesta antes de los detalles. Opus 5.5 es el mejor modelo sobre el papel y el más barato en la factura. La propia visión general de modelos de Anthropic ahora indica a los desarrolladores que empiecen con Opus 5.5 para la mayoría de cargas de trabajo y que reserven Fable 5.1 para el razonamiento exigente y el trabajo de agentes a largo plazo. La única razón sólida para esperar es la compatibilidad.

Cambia ya si te encaja esto
- Tienes bucles de agentes con mucho prompt caching. Las lecturas de caché bajan de $0.50 a $0.20 por millón de tokens, el mayor ahorro de toda la comparativa.
- Envías peticiones con muchas herramientas. El prompt de sistema integrado para uso de herramientas baja de 675 tokens a 286 tokens por petición.
- Quieres modo rápido. Opus 5.5 lo admite con un precio premium, mientras que Opus 4.7 rechaza la petición directamente.
- Necesitas conocimiento más reciente. Opus 5.5 indica una fecha de corte de conocimiento fiable de junio de 2026.
- Empiezas un proyecto nuevo. No hay nada que migrar, así que hay pocos motivos para empezar con el modelo anterior.
Espera si te encaja esto
Mejor no cambies si tu código depende de alguno de los siguientes puntos, porque Opus 5.5 devuelve un error 400 en cada uno de ellos:
- Desactivar el pensamiento con
thinking: {"type": "disabled"}, o fijar un budget_tokens manual.
- Forzar una herramienta concreta con
tool_choice.
- Usar la herramienta de uso del equipo
computer_20251124.
- Editar los bloques de pensamiento entre turnos.
Los equipos que trabajan en flujos auditados o regulados y que no puedan repetir sus evaluaciones este trimestre también deberían quedarse donde están. Opus 4.7 sigue disponible como modelo heredado, y una migración tranquila es mejor que una apresurada.
Opus 4.7 y 5.5, lado a lado
La mayoría de las especificaciones coinciden, y eso facilita ver las diferencias. Ambos modelos ofrecen una ventana de contexto de 1M de tokens y 128K tokens de salida máxima. Los dos admiten hasta 300K tokens de salida en la API de lotes con un encabezado beta. Las diferencias están en el dinero y en las herramientas.
| Especificación | Opus 4.7 | Opus 5.5 |
|---|
| Fecha de lanzamiento | 16 de abril de 2026 | 22 de septiembre de 2026 |
| Precio de entrada por 1M de tokens | $5 | $4 |
| Precio de salida por 1M de tokens | $25 | $20 |
| Lectura de caché por 1M de tokens | $0.50 | $0.20 |
| Escritura de caché de 5 minutos | $6.25 | $5 |
| Escritura de caché de 1 hora | $10 | $8 |
| Lote entrada / salida | $2.50 / $12.50 | $2 / $10 |
| Ventana de contexto | 1M de tokens | 1M de tokens |
| Salida máxima | 128K tokens | 128K tokens |
| Modo rápido | No disponible | $8 entrada / $40 salida |
| Prompt de sistema para uso de herramientas | 675 tokens | 286 tokens |

Dónde está cada versión
Opus 4.7 y 5.5 no son vecinos. Opus 4.8 y Opus 5 salieron en medio, y ambos mantuvieron el precio de $5 y $25. Pasar de 4.7 a 5.5 supone, por tanto, reunir varias generaciones de cambios en una sola migración, y por eso importan los cambios que rompen compatibilidad que se explican más adelante en este artículo.
La oferta actual de Anthropic tiene cuatro niveles: Fable 5.1 a $10 y $50, Opus 5.5 a $4 y $20, Sonnet 5.5 a $2 y $10, y Haiku 5.5 desde $0.10 y $0.50. Opus 5.5 es además el Opus más barato desde que empezó la generación de $5 y $25. Si quieres probar hoy a los modelos vecinos de la familia, PicassoIA aloja Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 5 y Claude Fable 5.
Qué cambió en Opus 5.5
Cuatro cambios son los más importantes. Tres de ellos ahorran dinero. Uno puede romper una aplicación.
Precios más bajos y lecturas de caché más baratas
El recorte del 20% en el precio base es el titular, pero el cambio en la caché importa más en cargas de trabajo reales. Las lecturas de caché en Opus 5.5 se cobran al 5% del precio de entrada en lugar del 10%, es decir, $0.20 por millón de tokens frente a $0.50 en Opus 4.7. Eso supone una bajada del 60%. Los agentes que releen un prompt de sistema largo y una transcripción que crece en cada paso gastan la mayor parte de su presupuesto de entrada en lecturas de caché, así que son los primeros en notar el cambio.

Pensamiento adaptativo, con medio por defecto
Opus 5.5 usa un pensamiento adaptativo que siempre está activo, dirigido por un ajuste de esfuerzo cuyo valor por defecto es medio. El modelo decide cuánto tiempo pensar, y tú lo orientas con el esfuerzo en lugar de con un presupuesto manual de tokens. Opus 4.7 introdujo el nivel de esfuerzo xhigh entre alto y máximo, así que los controles de esfuerzo no son nuevos. Lo nuevo es que 5.5 elimina la opción de desactivar el pensamiento.
Dejar medio como valor por defecto es una decisión de costo tanto como de calidad. Los informes del lanzamiento indican que Opus 5.5 con esfuerzo por defecto superó a Opus 5 con esfuerzo máximo en Terminal-Bench 4.0, con aproximadamente una quinta parte del costo por intento. Esa comparación es contra Opus 5, no contra 4.7, así que tómala como una orientación y no como una promesa para tu carga de trabajo.
En la práctica, define el esfuerzo de forma explícita en lugar de confiar en el valor por defecto. Empieza en medio, pasa a alto solo en tareas donde una respuesta errónea sale cara, como revisiones de seguridad o refactorizaciones de varios archivos, y registra el número de tokens en cada nivel para ver lo que cuesta el pensamiento extra.

Llega el modo rápido
El modo rápido es una opción en vista previa de investigación que cobra más a cambio de velocidad. En Opus 5.5 cuesta $8 por millón de tokens de entrada y $40 por millón de tokens de salida, exactamente el doble de la tarifa estándar. Opus 4.7 no lo admite en absoluto, y una petición con speed: "fast" devuelve un error. El modo rápido solo está disponible en la API de Claude, no en las plataformas de nube asociadas, y no se puede combinar con la API de lotes.
Menos sobrecarga por herramientas
Cada petición que incluye herramientas lleva un prompt de sistema oculto. En Opus 4.7 ocupa 675 tokens con la elección automática de herramienta. En Opus 5.5 ocupa 286. En 1,000 peticiones con herramientas, eso son 675,000 tokens frente a 286,000, o unos $3.38 frente a $1.14 con el precio de entrada de cada modelo. Por llamada es poco dinero, pero un agente ocupado hace muchas llamadas.
Benchmarks: ¿mejoras reales o ruido?
Los benchmarks son el punto donde los artículos sobre actualizaciones se vuelven resbaladizos, así que aquí va la versión honesta. Las cifras de lanzamiento de Anthropic para Opus 5.5 lo comparan con Opus 5, y las cifras publicadas para Opus 4.7 en abril proceden de versiones anteriores de las baterías de pruebas. No hemos podido verificar una comparación directa limpia y de la misma versión. La mejor evidencia neutral es un índice de terceros que puntúa a ambos modelos con la misma metodología.

Puntuaciones de índices de terceros
La página de comparación de LLM Stats puntúa a ambos modelos así:
| Índice | Opus 4.7 | Opus 5.5 | Diferencia |
|---|
| Puntuación global | 43.5 | 60.4 | +16.9 |
| Razonamiento | 45.2 | 59.0 | +13.8 |
| Programación | 35.2 | 51.0 | +15.8 |
| Visión | 32.8 | 41.3 | +8.5 |
| Uso de herramientas | 24.7 | 32.8 | +8.1 |
| Multimodal | 31.4 | 40.9 | +9.5 |
| Matemáticas | 39.0 | 41.8 | +2.8 |
Esa página sitúa a Opus 5.5 en primer lugar en general y a Opus 4.7 en el puesto cuarenta y ocho. La diferencia es mayor en programación y razonamiento, mientras que en matemáticas apenas se mueve. Las cifras de los agregadores cambian a medida que llegan nuevos resultados, así que léelas como una tendencia y no como un decimal exacto.
Qué miden las cifras de lanzamiento
En su lanzamiento, Opus 4.7 alcanzó un 64.3% en SWE-bench Pro, frente al 53.4% de Opus 4.6, y con un 87.6% en SWE-bench Verified. También amplió la entrada de imagen de 1.15 a 3.75 megapíxeles. Opus 5.5, con esfuerzo máximo, alcanzó un 66.4% en Terminal-Bench 4.0, un 81.8% en OSWorld 2.0, un 57.8% en CursorBench 4.0 y 1,846 puntos Elo en GDPval-AA v2.1.
Son baterías distintas, versiones distintas y niveles de esfuerzo distintos. No restes una cifra de la otra.
💡 Pruébalo tú mismo: elige 20 tareas reales de tu propia lista pendiente, ejecútalas en ambos modelos y puntúa los resultados a ciegas. El modelo que gane en tus tareas es el mejor modelo para ti, sin importar lo que diga una clasificación.
El costo real de cambiar
El precio por token es fácil de comparar. El precio por tarea terminada es lo que realmente pagas. Ambos modelos usan el mismo tokenizador, así que el mismo texto produce el mismo número de tokens. Aun así, la longitud de la salida puede variar, porque el pensamiento adaptativo decide cuánto escribir, así que mide una muestra antes de confiar en cualquier proyección.
Cuatro cargas de trabajo de ejemplo
Estas cifras usan las tarifas publicadas y suponen el mismo número de tokens. No incluyen los costos de escritura en caché para que el cálculo sea fácil de seguir.
| Carga de trabajo | Opus 4.7 | Opus 5.5 | Ahorro |
|---|
| 10M de entrada, 2M de salida, sin caché | $100 | $80 | 20% |
| 50M de entrada (40M lecturas de caché), 5M de salida | $195 | $148 | 24% |
| Lote: 20M de entrada, 4M de salida | $100 | $80 | 20% |
| Bucle de agente: 200M de entrada (190M lecturas de caché), 8M de salida | $345 | $238 | 31% |
El patrón está claro. El tráfico normal ahorra el 20% anunciado. Cuanta más entrada llegue como lecturas de caché, mayor es el descuento, porque la tarifa de caché bajó un 60% mientras que la tarifa base bajó un 20%.
Para leer la tabla con tu propio tráfico, saca el informe de uso del mes pasado, separa los tokens de entrada en nuevos y lecturas de caché, y aplica la misma fórmula: entrada nueva por la tarifa de entrada, más lecturas de caché por la tarifa de caché, más salida por la tarifa de salida. Si nunca activaste la caché, hazlo primero. Una lectura de caché en Opus 4.7 ya cuesta un 90% menos que un token de entrada nuevo, así que el ahorro de la caché puede eclipsar el ahorro de cambiar de modelo.

Lotes y modo rápido
La API de lotes aplica un 50% de descuento a ambos modelos, así que los precios de lote quedan en $2 y $10 en Opus 5.5 frente a $2.50 y $12.50 en Opus 4.7. Así se mantiene la diferencia del 20% en los trabajos nocturnos. El modo rápido funciona al revés. A $8 y $40 cuesta un 60% más que la tarifa estándar de Opus 4.7, así que úsalo solo en la parte del tráfico en la que una persona espera la respuesta.
Errores de migración que conviene revisar primero
La mayoría de las actualizaciones fallan por cosas pequeñas que nadie probó. Pasa esta lista de comprobación sobre una copia de pruebas de tu aplicación antes de cambiar un ID de modelo.

Llamadas que ahora fallan
- Pensamiento desactivado o presupuesto manual.
thinking: {"type": "disabled"} y budget_tokens devuelven un error 400 invalid_request_error.
- Elección de herramienta forzada. Cualquier
tool_choice que fuerce el uso de una herramienta, ya sea cualquiera o una concreta, devuelve un 400.
- Bloques de pensamiento editados. Los bloques de pensamiento están ligados al estado de la conversación, así que las ediciones devuelven un 400.
- La herramienta antigua de uso del equipo.
computer_20251124 se rechaza. Cambia a computer_toolset_20260801.
Cada una se arregla en una línea, pero cualquiera de ellas puede tumbar una ruta de peticiones si la encuentras por primera vez en producción.
Tokenizador y bloques de pensamiento
Primero la buena noticia: no hay cambio de tokenizador. El tokenizador actual llegó con Opus 4.7 y produce aproximadamente un 30% más de tokens que los modelos anteriores a 4.7 para el mismo texto. Opus 5.5 usa el mismo. Si ya pasaste de 4.6 a 4.7, tus recuentos de tokens se mantienen estables. Si sigues en 4.6, presupuesta ese 30% además de todo lo anterior.
El problema más silencioso es de comportamiento. El texto que el modelo escribe entre llamadas a herramientas ahora llega dentro de bloques de pensamiento en lugar de bloques de texto, así que una interfaz que muestra en directo las notas de progreso desde los bloques de texto puede quedarse en blanco hasta que ajustes el parámetro thinking.display. Además, los bloques de pensamiento solo pueden leerlos Opus 5.5, Fable 5.1 y Mythos 5.1, así que un cambio de respaldo a otro modelo a mitad de conversación necesita un plan propio.
Un despliegue seguro tiene cuatro pasos. Primero, repite un día de tráfico real contra Opus 5.5 en pruebas y registra cada error 400. Segundo, compara el costo por tarea terminada, no el costo por token, en al menos 200 peticiones. Tercero, envía el 5% del tráfico en vivo al nuevo modelo durante una semana mientras Opus 4.7 atiende el resto. Cuarto, aumenta la proporción solo si las tasas de error y la opinión de los usuarios se mantienen. Si algo empeora, el ID del modelo es la única línea que necesitas cambiar para volver atrás.
Cómo usar Opus 4.7 en PicassoIA
Puedes probar el lado anterior de esta comparativa sin escribir una sola línea de código. Claude Opus 4.7 funciona directamente desde su página de modelo, sin credenciales de API, instalaciones ni configuración. En el momento de escribir esto, el catálogo incluye Opus 4.7, Opus 4.6, Sonnet 5 y Fable 5 de Anthropic, pero no Opus 5.5, así que esta sección explica la mitad 4.7 de tu prueba.

Paso a paso
- Abre la página de Claude Opus 4.7 en la colección de modelos de lenguaje grandes.
- Escribe tu tarea en el campo Prompt. Pega código, una cláusula de contrato o un informe largo.
- Añade un System Prompt si quieres un rol fijo, como "Eres un revisor senior. Responde con viñetas cortas".
- Opcionalmente, sube una Imagen, como una captura de pantalla, un gráfico o un diagrama. El modelo la lee junto con tu texto. Max Image Resolution tiene por defecto 0.5 megapíxeles, así que auméntalo para capturas densas.
- Define Max Tokens. El valor por defecto es 8,192, y puedes bajarlo cuando quieras respuestas más cortas.
- Ejecuta el prompt, lee la respuesta y continúa la conversación en el mismo hilo.
Prompts que miden la diferencia
Crea un pequeño conjunto de pruebas y reutilízalo con cada modelo que compares. Tres prompts cubren la mayor parte del terreno:
- Caza de errores. Pega un archivo real con un defecto conocido y pide una revisión línea por línea.
- Resumen largo. Pega un documento de 5,000 palabras y pide los diez puntos que necesita un gerente con poco tiempo.
- Pregunta sobre una captura. Sube un panel denso y pregunta qué cambió entre dos gráficos.
Anota el tiempo, el costo y una puntuación de 1 a 5 para cada uno. Diez minutos de esto valen más que una hora leyendo hilos de benchmarks.
Crea después tus propias imágenes
Los modelos de lenguaje escriben el plan. Picasso IA lo convierte en imágenes. Pídele a Opus cinco prompts fotorrealistas para imagen con el objetivo, la iluminación y la composición detallados, y luego pégalos en un modelo de texto a imagen y compara los resultados lado a lado. Buenos puntos de partida son Seedream 4.5, Flux 2 Pro y PicassoIA Image.
Cuando un fotograma fijo te parezca bien, puedes ponerlo en movimiento con Seedance 2.0 o Kling v3 Video. Elige un prompt, ejecútalo y guarda la versión que más te guste. Tu primera imagen está a unos segundos, así que prueba Picasso IA hoy y mira cómo se ven tus propias ideas.