Claude Opus 5.5 frente a Opus 4.7: ¿qué cambió y merece la pena?

Claude Opus 5.5 se lanzó el 22 de septiembre de 2026 a $4 y $20 por millón de tokens, un 20% menos que Opus 4.7. Esta comparativa recoge los cambios en precio, caché, modo rápido y herramientas, las puntuaciones de benchmarks de terceros y las llamadas a la API que fallan ahora, antes de que cambies.

Claude Opus 5.5 frente a Opus 4.7: ¿qué cambió y merece la pena?
Cristian Da Conceicao
Fundador de Picasso IA

Anthropic lanzó Claude Opus 5.5 el 22 de septiembre de 2026, cinco meses después de que Claude Opus 4.7 llegara el 16 de abril. La sorpresa está en el precio: bajó. Opus 5.5 cuesta $4 por millón de tokens de entrada y $20 por millón de tokens de salida, mientras que Opus 4.7 sigue en $5 y $25. Un modelo más barato y con una fecha de corte de conocimiento más reciente convierte la pregunta de la actualización en una cuestión práctica.

Las actualizaciones tienen costos que nunca aparecen en una factura. Algunas llamadas a la API que funcionaban bien en 4.7 ahora devuelven un error 400 en 5.5, y tus evaluaciones deberían repetirse antes de cambiar un ID de modelo en producción. Esta comparativa se basa en las páginas oficiales de precios y modelos de Anthropic y en índices de benchmarks de terceros, y señala con claridad dónde la evidencia es escasa.

Manos de un desarrollador escribiendo en un escritorio con dos monitores desenfocados al fondo

💡 Resumen rápido: si pagas facturas de API cada mes, Opus 5.5 supone un descuento del 20% al 31% en las mismas cargas de trabajo, con algunos cambios que romperían el código y que conviene revisar antes. Si usas Claude a través de una página de chat alojada, no hay factura que reducir ni código que migrar, así que la decisión es más sencilla.

El veredicto rápido

Aquí va la respuesta antes de los detalles. Opus 5.5 es el mejor modelo sobre el papel y el más barato en la factura. La propia visión general de modelos de Anthropic ahora indica a los desarrolladores que empiecen con Opus 5.5 para la mayoría de cargas de trabajo y que reserven Fable 5.1 para el razonamiento exigente y el trabajo de agentes a largo plazo. La única razón sólida para esperar es la compatibilidad.

Vista aérea de un camino de grava que se divide en dos direcciones alrededor de un poste de madera

Cambia ya si te encaja esto

  • Tienes bucles de agentes con mucho prompt caching. Las lecturas de caché bajan de $0.50 a $0.20 por millón de tokens, el mayor ahorro de toda la comparativa.
  • Envías peticiones con muchas herramientas. El prompt de sistema integrado para uso de herramientas baja de 675 tokens a 286 tokens por petición.
  • Quieres modo rápido. Opus 5.5 lo admite con un precio premium, mientras que Opus 4.7 rechaza la petición directamente.
  • Necesitas conocimiento más reciente. Opus 5.5 indica una fecha de corte de conocimiento fiable de junio de 2026.
  • Empiezas un proyecto nuevo. No hay nada que migrar, así que hay pocos motivos para empezar con el modelo anterior.

Espera si te encaja esto

Mejor no cambies si tu código depende de alguno de los siguientes puntos, porque Opus 5.5 devuelve un error 400 en cada uno de ellos:

  • Desactivar el pensamiento con thinking: {"type": "disabled"}, o fijar un budget_tokens manual.
  • Forzar una herramienta concreta con tool_choice.
  • Usar la herramienta de uso del equipo computer_20251124.
  • Editar los bloques de pensamiento entre turnos.

Los equipos que trabajan en flujos auditados o regulados y que no puedan repetir sus evaluaciones este trimestre también deberían quedarse donde están. Opus 4.7 sigue disponible como modelo heredado, y una migración tranquila es mejor que una apresurada.

Opus 4.7 y 5.5, lado a lado

La mayoría de las especificaciones coinciden, y eso facilita ver las diferencias. Ambos modelos ofrecen una ventana de contexto de 1M de tokens y 128K tokens de salida máxima. Los dos admiten hasta 300K tokens de salida en la API de lotes con un encabezado beta. Las diferencias están en el dinero y en las herramientas.

EspecificaciónOpus 4.7Opus 5.5
Fecha de lanzamiento16 de abril de 202622 de septiembre de 2026
Precio de entrada por 1M de tokens$5$4
Precio de salida por 1M de tokens$25$20
Lectura de caché por 1M de tokens$0.50$0.20
Escritura de caché de 5 minutos$6.25$5
Escritura de caché de 1 hora$10$8
Lote entrada / salida$2.50 / $12.50$2 / $10
Ventana de contexto1M de tokens1M de tokens
Salida máxima128K tokens128K tokens
Modo rápidoNo disponible$8 entrada / $40 salida
Prompt de sistema para uso de herramientas675 tokens286 tokens

Dos cuadernos abiertos uno al lado del otro sobre una mesa de roble, uno gastado y otro nuevo

Dónde está cada versión

Opus 4.7 y 5.5 no son vecinos. Opus 4.8 y Opus 5 salieron en medio, y ambos mantuvieron el precio de $5 y $25. Pasar de 4.7 a 5.5 supone, por tanto, reunir varias generaciones de cambios en una sola migración, y por eso importan los cambios que rompen compatibilidad que se explican más adelante en este artículo.

La oferta actual de Anthropic tiene cuatro niveles: Fable 5.1 a $10 y $50, Opus 5.5 a $4 y $20, Sonnet 5.5 a $2 y $10, y Haiku 5.5 desde $0.10 y $0.50. Opus 5.5 es además el Opus más barato desde que empezó la generación de $5 y $25. Si quieres probar hoy a los modelos vecinos de la familia, PicassoIA aloja Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 5 y Claude Fable 5.

Qué cambió en Opus 5.5

Cuatro cambios son los más importantes. Tres de ellos ahorran dinero. Uno puede romper una aplicación.

Precios más bajos y lecturas de caché más baratas

El recorte del 20% en el precio base es el titular, pero el cambio en la caché importa más en cargas de trabajo reales. Las lecturas de caché en Opus 5.5 se cobran al 5% del precio de entrada en lugar del 10%, es decir, $0.20 por millón de tokens frente a $0.50 en Opus 4.7. Eso supone una bajada del 60%. Los agentes que releen un prompt de sistema largo y una transcripción que crece en cada paso gastan la mayor parte de su presupuesto de entrada en lecturas de caché, así que son los primeros en notar el cambio.

Dos pilas de monedas sobre una mesa de nogal, la pila de la izquierda más alta

Pensamiento adaptativo, con medio por defecto

Opus 5.5 usa un pensamiento adaptativo que siempre está activo, dirigido por un ajuste de esfuerzo cuyo valor por defecto es medio. El modelo decide cuánto tiempo pensar, y tú lo orientas con el esfuerzo en lugar de con un presupuesto manual de tokens. Opus 4.7 introdujo el nivel de esfuerzo xhigh entre alto y máximo, así que los controles de esfuerzo no son nuevos. Lo nuevo es que 5.5 elimina la opción de desactivar el pensamiento.

Dejar medio como valor por defecto es una decisión de costo tanto como de calidad. Los informes del lanzamiento indican que Opus 5.5 con esfuerzo por defecto superó a Opus 5 con esfuerzo máximo en Terminal-Bench 4.0, con aproximadamente una quinta parte del costo por intento. Esa comparación es contra Opus 5, no contra 4.7, así que tómala como una orientación y no como una promesa para tu carga de trabajo.

En la práctica, define el esfuerzo de forma explícita en lugar de confiar en el valor por defecto. Empieza en medio, pasa a alto solo en tareas donde una respuesta errónea sale cara, como revisiones de seguridad o refactorizaciones de varios archivos, y registra el número de tokens en cada nivel para ver lo que cuesta el pensamiento extra.

Perilla de latón girada a la marca central en un amplificador vintage

Llega el modo rápido

El modo rápido es una opción en vista previa de investigación que cobra más a cambio de velocidad. En Opus 5.5 cuesta $8 por millón de tokens de entrada y $40 por millón de tokens de salida, exactamente el doble de la tarifa estándar. Opus 4.7 no lo admite en absoluto, y una petición con speed: "fast" devuelve un error. El modo rápido solo está disponible en la API de Claude, no en las plataformas de nube asociadas, y no se puede combinar con la API de lotes.

Menos sobrecarga por herramientas

Cada petición que incluye herramientas lleva un prompt de sistema oculto. En Opus 4.7 ocupa 675 tokens con la elección automática de herramienta. En Opus 5.5 ocupa 286. En 1,000 peticiones con herramientas, eso son 675,000 tokens frente a 286,000, o unos $3.38 frente a $1.14 con el precio de entrada de cada modelo. Por llamada es poco dinero, pero un agente ocupado hace muchas llamadas.

Benchmarks: ¿mejoras reales o ruido?

Los benchmarks son el punto donde los artículos sobre actualizaciones se vuelven resbaladizos, así que aquí va la versión honesta. Las cifras de lanzamiento de Anthropic para Opus 5.5 lo comparan con Opus 5, y las cifras publicadas para Opus 4.7 en abril proceden de versiones anteriores de las baterías de pruebas. No hemos podido verificar una comparación directa limpia y de la misma versión. La mejor evidencia neutral es un índice de terceros que puntúa a ambos modelos con la misma metodología.

Velocista agachado en los tacos de salida sobre una pista roja al amanecer

Puntuaciones de índices de terceros

La página de comparación de LLM Stats puntúa a ambos modelos así:

ÍndiceOpus 4.7Opus 5.5Diferencia
Puntuación global43.560.4+16.9
Razonamiento45.259.0+13.8
Programación35.251.0+15.8
Visión32.841.3+8.5
Uso de herramientas24.732.8+8.1
Multimodal31.440.9+9.5
Matemáticas39.041.8+2.8

Esa página sitúa a Opus 5.5 en primer lugar en general y a Opus 4.7 en el puesto cuarenta y ocho. La diferencia es mayor en programación y razonamiento, mientras que en matemáticas apenas se mueve. Las cifras de los agregadores cambian a medida que llegan nuevos resultados, así que léelas como una tendencia y no como un decimal exacto.

Qué miden las cifras de lanzamiento

En su lanzamiento, Opus 4.7 alcanzó un 64.3% en SWE-bench Pro, frente al 53.4% de Opus 4.6, y con un 87.6% en SWE-bench Verified. También amplió la entrada de imagen de 1.15 a 3.75 megapíxeles. Opus 5.5, con esfuerzo máximo, alcanzó un 66.4% en Terminal-Bench 4.0, un 81.8% en OSWorld 2.0, un 57.8% en CursorBench 4.0 y 1,846 puntos Elo en GDPval-AA v2.1.

Son baterías distintas, versiones distintas y niveles de esfuerzo distintos. No restes una cifra de la otra.

💡 Pruébalo tú mismo: elige 20 tareas reales de tu propia lista pendiente, ejecútalas en ambos modelos y puntúa los resultados a ciegas. El modelo que gane en tus tareas es el mejor modelo para ti, sin importar lo que diga una clasificación.

El costo real de cambiar

El precio por token es fácil de comparar. El precio por tarea terminada es lo que realmente pagas. Ambos modelos usan el mismo tokenizador, así que el mismo texto produce el mismo número de tokens. Aun así, la longitud de la salida puede variar, porque el pensamiento adaptativo decide cuánto escribir, así que mide una muestra antes de confiar en cualquier proyección.

Cuatro cargas de trabajo de ejemplo

Estas cifras usan las tarifas publicadas y suponen el mismo número de tokens. No incluyen los costos de escritura en caché para que el cálculo sea fácil de seguir.

Carga de trabajoOpus 4.7Opus 5.5Ahorro
10M de entrada, 2M de salida, sin caché$100$8020%
50M de entrada (40M lecturas de caché), 5M de salida$195$14824%
Lote: 20M de entrada, 4M de salida$100$8020%
Bucle de agente: 200M de entrada (190M lecturas de caché), 8M de salida$345$23831%

El patrón está claro. El tráfico normal ahorra el 20% anunciado. Cuanta más entrada llegue como lecturas de caché, mayor es el descuento, porque la tarifa de caché bajó un 60% mientras que la tarifa base bajó un 20%.

Para leer la tabla con tu propio tráfico, saca el informe de uso del mes pasado, separa los tokens de entrada en nuevos y lecturas de caché, y aplica la misma fórmula: entrada nueva por la tarifa de entrada, más lecturas de caché por la tarifa de caché, más salida por la tarifa de salida. Si nunca activaste la caché, hazlo primero. Una lectura de caché en Opus 4.7 ya cuesta un 90% menos que un token de entrada nuevo, así que el ahorro de la caché puede eclipsar el ahorro de cambiar de modelo.

Operario de almacén escaneando cajas idénticas en estanterías metálicas altas

Lotes y modo rápido

La API de lotes aplica un 50% de descuento a ambos modelos, así que los precios de lote quedan en $2 y $10 en Opus 5.5 frente a $2.50 y $12.50 en Opus 4.7. Así se mantiene la diferencia del 20% en los trabajos nocturnos. El modo rápido funciona al revés. A $8 y $40 cuesta un 60% más que la tarifa estándar de Opus 4.7, así que úsalo solo en la parte del tráfico en la que una persona espera la respuesta.

Errores de migración que conviene revisar primero

La mayoría de las actualizaciones fallan por cosas pequeñas que nadie probó. Pasa esta lista de comprobación sobre una copia de pruebas de tu aplicación antes de cambiar un ID de modelo.

Técnico conectando un cable Ethernet azul a un panel de parcheo

Llamadas que ahora fallan

  1. Pensamiento desactivado o presupuesto manual. thinking: {"type": "disabled"} y budget_tokens devuelven un error 400 invalid_request_error.
  2. Elección de herramienta forzada. Cualquier tool_choice que fuerce el uso de una herramienta, ya sea cualquiera o una concreta, devuelve un 400.
  3. Bloques de pensamiento editados. Los bloques de pensamiento están ligados al estado de la conversación, así que las ediciones devuelven un 400.
  4. La herramienta antigua de uso del equipo. computer_20251124 se rechaza. Cambia a computer_toolset_20260801.

Cada una se arregla en una línea, pero cualquiera de ellas puede tumbar una ruta de peticiones si la encuentras por primera vez en producción.

Tokenizador y bloques de pensamiento

Primero la buena noticia: no hay cambio de tokenizador. El tokenizador actual llegó con Opus 4.7 y produce aproximadamente un 30% más de tokens que los modelos anteriores a 4.7 para el mismo texto. Opus 5.5 usa el mismo. Si ya pasaste de 4.6 a 4.7, tus recuentos de tokens se mantienen estables. Si sigues en 4.6, presupuesta ese 30% además de todo lo anterior.

El problema más silencioso es de comportamiento. El texto que el modelo escribe entre llamadas a herramientas ahora llega dentro de bloques de pensamiento en lugar de bloques de texto, así que una interfaz que muestra en directo las notas de progreso desde los bloques de texto puede quedarse en blanco hasta que ajustes el parámetro thinking.display. Además, los bloques de pensamiento solo pueden leerlos Opus 5.5, Fable 5.1 y Mythos 5.1, así que un cambio de respaldo a otro modelo a mitad de conversación necesita un plan propio.

Un despliegue seguro tiene cuatro pasos. Primero, repite un día de tráfico real contra Opus 5.5 en pruebas y registra cada error 400. Segundo, compara el costo por tarea terminada, no el costo por token, en al menos 200 peticiones. Tercero, envía el 5% del tráfico en vivo al nuevo modelo durante una semana mientras Opus 4.7 atiende el resto. Cuarto, aumenta la proporción solo si las tasas de error y la opinión de los usuarios se mantienen. Si algo empeora, el ID del modelo es la única línea que necesitas cambiar para volver atrás.

Cómo usar Opus 4.7 en PicassoIA

Puedes probar el lado anterior de esta comparativa sin escribir una sola línea de código. Claude Opus 4.7 funciona directamente desde su página de modelo, sin credenciales de API, instalaciones ni configuración. En el momento de escribir esto, el catálogo incluye Opus 4.7, Opus 4.6, Sonnet 5 y Fable 5 de Anthropic, pero no Opus 5.5, así que esta sección explica la mitad 4.7 de tu prueba.

Hombre escribiendo en un equipo portátil en una mesa de cafetería con un cuaderno a su lado

Paso a paso

  1. Abre la página de Claude Opus 4.7 en la colección de modelos de lenguaje grandes.
  2. Escribe tu tarea en el campo Prompt. Pega código, una cláusula de contrato o un informe largo.
  3. Añade un System Prompt si quieres un rol fijo, como "Eres un revisor senior. Responde con viñetas cortas".
  4. Opcionalmente, sube una Imagen, como una captura de pantalla, un gráfico o un diagrama. El modelo la lee junto con tu texto. Max Image Resolution tiene por defecto 0.5 megapíxeles, así que auméntalo para capturas densas.
  5. Define Max Tokens. El valor por defecto es 8,192, y puedes bajarlo cuando quieras respuestas más cortas.
  6. Ejecuta el prompt, lee la respuesta y continúa la conversación en el mismo hilo.

Prompts que miden la diferencia

Crea un pequeño conjunto de pruebas y reutilízalo con cada modelo que compares. Tres prompts cubren la mayor parte del terreno:

  • Caza de errores. Pega un archivo real con un defecto conocido y pide una revisión línea por línea.
  • Resumen largo. Pega un documento de 5,000 palabras y pide los diez puntos que necesita un gerente con poco tiempo.
  • Pregunta sobre una captura. Sube un panel denso y pregunta qué cambió entre dos gráficos.

Anota el tiempo, el costo y una puntuación de 1 a 5 para cada uno. Diez minutos de esto valen más que una hora leyendo hilos de benchmarks.

Crea después tus propias imágenes

Los modelos de lenguaje escriben el plan. Picasso IA lo convierte en imágenes. Pídele a Opus cinco prompts fotorrealistas para imagen con el objetivo, la iluminación y la composición detallados, y luego pégalos en un modelo de texto a imagen y compara los resultados lado a lado. Buenos puntos de partida son Seedream 4.5, Flux 2 Pro y PicassoIA Image.

Cuando un fotograma fijo te parezca bien, puedes ponerlo en movimiento con Seedance 2.0 o Kling v3 Video. Elige un prompt, ejecútalo y guarda la versión que más te guste. Tu primera imagen está a unos segundos, así que prueba Picasso IA hoy y mira cómo se ven tus propias ideas.

Compartir este artículo

Elige tu idioma