Saltar al contenido

Claude Opus 5.5 baja el precio de salida a 20 dólares por millón

Anthropic publicó Claude Opus 5.5 el 22 de septiembre de 2026, a 4 dólares de entrada y 20 de salida por millón de tokens, con el razonamiento siempre activo.

Por Tech AI Wire Team

3 min de lectura

XLinkedIn
The Claude Platform Docs page for Claude Opus 5.5, showing a 1M-token context window, 128K maximum output, and input and output prices of $4 and $20 per million tokens.

En cifras

output price per million tokens, down from $25
$20
less to run than Opus 5, Anthropic says
40%
tokens in the context window
1M

Anthropic publicó Claude Opus 5.5 el 22 de septiembre de 2026. El modelo cuesta 4 dólares por millón de tokens de entrada y 20 dólares por millón de tokens de salida. La sala de prensa de Anthropic dice que "rinde al nivel de Claude Fable 5.1 en la mayoría del trabajo y cuesta un 40 % menos de ejecutar que Opus 5". Para los equipos que mantienen agentes de código funcionando durante horas, los tokens de salida son la línea de la factura que crece. Por eso la noticia es el precio.

TechCrunch informó de que ese precio de salida de 20 dólares baja desde los 25 dólares de la versión anterior. TechCrunch también escribió que el modelo va más rápido y necesita menos cómputo para lograrlo.

Lo que cuesta Opus 5.5

ConceptoPrecio por millón de tokens
Entrada4 dólares
Salida20 dólares
Escritura en caché, 5 minutos5 dólares
Escritura en caché, 1 hora8 dólares
Lectura en caché0,20 dólares

El almacenamiento en caché de instrucciones guarda parte de una petición para no enviarla ni cobrarla entera cada vez. Aquí una lectura en caché cuesta 0,20 dólares por millón de tokens. La API Batch descuenta un 50 % en entrada y salida, a cambio de respuestas más lentas.

Lo que dice la ficha del modelo

La documentación de la plataforma de Anthropic da el identificador claude-opus-5-5. En Amazon Bedrock es anthropic.claude-opus-5-5. El modelo está disponible a través de la API de Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry y la Claude Platform en AWS.

La ventana de contexto admite 1 millón de tokens. Es todo lo que el modelo puede leer y escribir en una conversación. Una sola respuesta síncrona puede llegar a 128.000 tokens. Con la API Batch y una cabecera beta, ese techo sube a 300.000 tokens.

La documentación indica un corte de conocimiento en junio de 2026. También dice que el modelo no se retirará antes del 22 de septiembre de 2027. Esa segunda fecha importa a quien fija un identificador de modelo en código de producción.

Cuatro cambios que pueden romper código en marcha

La documentación enumera cuatro diferencias con Opus 5 que no son retrocompatibles.

  • El razonamiento extendido está siempre activo y no se puede desactivar. Razonar es que el modelo recorra un problema antes de responder.
  • El uso forzado de herramientas ahora devuelve un error en lugar de aceptarse.
  • Los bloques de razonamiento quedan ligados al modelo y a la conversación que los produjo.
  • La versión anterior de la herramienta computer_20251124 ya no se acepta.

El ajuste de esfuerzo por defecto es medio. En Claude Fable 5.1 es alto. El esfuerzo controla cuánto trabaja el modelo una respuesta. Una instrucción sin cambios puede comportarse de otra manera.

Qué significa esto para los desarrolladores

Lea esos cuatro cambios antes de sustituir un identificador de modelo en un servicio en marcha. El razonamiento siempre activo es la trampa. El código que pasa una bandera para desactivar el razonamiento, o que mueve bloques de razonamiento entre modelos, tiene que cambiar primero. Una rebaja de precio no compensa una caída del servicio.

Vuelva a ejecutar sus propias evaluaciones en lugar de fiarse de la comparación con Fable 5.1. La afirmación de Anthropic cubre la mayoría del trabajo, y su carga de trabajo no es la mayoría del trabajo. TechCrunch informó de que el modelo superó a Fable en muchas pruebas de resolución de tareas informales, y lo situó cerca de Mythos en biología y ciberseguridad. Son categorías amplias, no su conjunto de pruebas.

Revise el esfuerzo por defecto si viene de Fable 5.1. Pasar de alto a medio cambia el coste y la calidad de la respuesta a la vez. Eso hace fácil malinterpretar una regresión.

Si el contexto repetido domina su factura, lea las filas de caché antes que las de tokens. Anthropic hizo un movimiento parecido con los precios de caché de Claude Fable 5.1 a principios de mes. Los equipos que envían la misma instrucción de sistema larga en cada llamada notan más un cambio de caché que uno de tokens.

Existe una razón para esperar. TechCrunch informó de que Sonnet 5.5 y Haiku 5.5 llegan en las próximas semanas. La mayor parte del tráfico de producción no necesita el modelo más grande. Un nivel más barato podría encajar mejor con su carga de trabajo dentro del mismo mes.

Fuentes

  1. Anthropic releases Opus 5.5 with lower prices and Fable-level performance - TechCrunch
  2. Claude Opus 5.5 overview - Claude Platform Docs
  3. Anthropic newsroom - Anthropic

Artículos relacionados