Anthropic lanzó Claude Opus 5.5 el 22 de septiembre de 2026, el primer modelo de una nueva familia Claude 5.5. El discurso de la empresa cabe en una frase: “funciona al nivel de Claude Fable 5.1 en la mayoría de los trabajos y su funcionamiento cuesta un 40% menos que Opus 5”.
El precio es de $4 por millón de tokens de entrada y $20 por millón de tokens de salida, frente a $5 y $25 en Opus 5. Fábula 5.1 cuesta $10 y $50. Entonces, si se cumple la afirmación “al nivel de”, obtendrá trabajo a nivel de Fable al 40% de las tasas de entrada y salida de Fable. El ahorro es menor que el de las sesiones largas con el agente, por los motivos que se tratan en la sección de precios a continuación.
Si paga una suscripción a Claude en lugar de una factura por token, el lanzamiento cambió sus límites más que su factura. El uso de Opus va más allá en los planes Pro, Max y Team, los límites de cinco horas aumentaron y los suscriptores obtuvieron un restablecimiento del límite gratuito para gastar antes de que caduque. Los detalles se encuentran a continuación, seguidos de los puntos de referencia, los nuevos filtros de seguridad y lo que admite la tarjeta del sistema de 230 páginas.
¿Qué cambios hay en su plan Claude?
Opus 5.5 “está disponible en Claude para usuarios Pro, Max, Team y Enterprise”. El plan gratuito no está en esa lista.
Tus límites se extienden aún más. La propia explicación de costos de Anthropic dice que “en un plan Pro, Max o Team, el precio más bajo de Opus 5.5 se traslada a tus límites, incluido el contexto en caché, por lo que van aproximadamente un 25 % más que en Opus 5”.
El límite de cinco horas aumentó. Anthropic está “aumentando los límites de uso de cinco horas en los planes Pro, Max, Team y Enterprise basados en asientos”. Ni la publicación de lanzamiento ni las páginas de ayuda citadas aquí dan una cifra del aumento.
Tienes un reinicio gratuito. Anthropic “proporciona a los usuarios de suscripción un reinicio del límite de tarifas, que ahora puedes guardar y usar cuando quieras”. MacRumors informa que el reinicio se puede utilizar “en cualquier momento entre ahora y el 22 de octubre”. La página de ayuda de Anthropic dice que si un reinicio tiene fecha de vencimiento, la fecha se muestra en Configuración > Uso.
Para gastarlo, vaya a Configuración > Uso en la web o en Claude Desktop y haga clic en “Restablecer gratis”. Tres capturas de la misma página: “Una vez que lo usas, no puedes deshacerlo”, el botón “no está disponible actualmente en Claude Mobile o en Claude Code” y “si bajas o cancelas antes de usar tu reinicio, ya no está disponible”. Dependiendo del reinicio que le dieron, recarga su límite de sesión de cinco horas o su límite semanal. Debido a que no hace nada hasta que lo presionas, lo más sensato es mantenerlo presionado hasta el día en que choques contra una pared.
El esfuerzo es el dial. Al igual que con Opus 5, pensar “no se puede desactivar en Claude” cuando usas Opus 5.5, por lo que la configuración de esfuerzo al lado del botón de enviar es la forma en que intercambias profundidad por uso. Anthropic dice que Bajo y Medio “amplian aún más su uso”.
¿Cuánto cuesta?
| Por millón de tokens | Opus 5.5 | Opus 5 | Fábula 5.1 |
|---|---|---|---|
| Entrada | $4 | $5 | $10 |
| Salida | $20 | $25 | $50 |
| Lectura de caché | $0,20 | $0,50 | $0,25 |
Una lectura de caché es lo que Anthropic cobra cuando el modelo vuelve a leer el texto que ya ha procesado. El explicador de costos de Anthropic dice que “una sesión de agente larga gasta la mayor parte de su entrada en lecturas de caché”. Contra Opus 5, esa línea cayó un 60% y los precios de los tokens titulares cayeron un 20%.
Frente a Fable 5.1, la tabla cuenta una historia diferente. Los tokens de entrada y salida de Opus 5.5 cuestan el 40% de los de Fable, pero sus lecturas de caché cuestan el 80% de las de Fable, porque las lecturas de caché de Fable son inusualmente baratas. El explicador de Anthropic dice lo mismo: las lecturas de caché de Fable cuestan “sólo 1,25 veces la tasa de Opus 5,5”, por lo que “la brecha es más pequeña en una ejecución larga con mucho caché, y mayor en una tarea que escribe mucho”. En las pruebas de Artificial Analysis, una tarea en su índice costó $5,98 en Opus 5.5 y $7,63 en Fable 5.1, una diferencia de alrededor del 22%.
La propia cifra de Anthropic de “40% menos que Opus 5” depende de una segunda afirmación: que Opus 5.5 “utiliza menos tokens por tarea”. El propio explicador de Anthropic separa los dos efectos. Con un precio basado en cantidades idénticas de tokens, su sesión de muestra de Claude Code “cuesta alrededor de un 31% menos” y les dice a los lectores que “lo midan en su propio trabajo” antes de contar con el resto.
La primera lectura independiente es un recordatorio de que menos fichas que Opus 5 no es lo mismo que pocas fichas. Artificial Analysis descubrió que al ejecutar su conjunto de pruebas con el máximo esfuerzo, Opus 5.5 “generaba 260 millones de tokens, lo cual es muy detallado en comparación con la media de 88 millones”. Las reclamaciones de ahorro de Anthropic se miden según la configuración predeterminada, y la predeterminada ahora es más baja: en la Interfaz de programación de aplicaciones (API), una solicitud que no establece esfuerzo “se ejecuta en medio; en Claude Opus 5 se ejecuta en alto”. Ejecútelo a fondo y los ahorros de tokens no estarán garantizados.
Dos precios más para promotores. El modo rápido, que según Anthropic ofrece “hasta 2,5 veces de velocidad”, cuesta $8 y $40. El procesamiento por lotes es “mitad de precio: $2 y $10”.
Lo que muestran los puntos de referencia de Anthropic
Cada puntaje a continuación proviene de la página de lanzamiento de Anthropic, y tres filas incluyen cifras que Anthropic no ejecutó por sí solo. Los resultados de AutomationBench “fueron ejecutados y reportados por Zapier”. En Terminal-Bench 4.0, las “cifras de GPT-6 Astra y GPT-5.6 Sol son las informadas por OpenAI”, y en Terminal-Bench-Science, “las cifras de GPT-6 Astra son las informadas por OpenAI”.
| Punto de referencia | Opus 5.5 | Fábula 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Terminal-Bench 4.0 (codificación) | 66,4% | 55,8% | 52,3% | 57,9% | 37,3% |
| FrontierCode v1.1 (codificación) | 54,4% | 50,3% | 48,0% | 53,3% | 47,5% |
| CursorBench 4.0 (codificación) | 57,8% | 51,8% | 46,6% | no dado | 41,7% |
| GDPval-AA v2.1 (trabajo del conocimiento, Elo) | 1846 | 1735 | 1708 | 1542 | 1588 |
| AutomationBench (flujos de trabajo empresariales) | 40,0% | 31,4% | 26,9% | 41,4% | 28,8% |
| El último examen de la humanidad (con herramientas) | 67,7% | 65,6% | 63,6% | 57,2% | no dado |
| Terminal-Bench-Ciencia 0.1 | 58,7% | 52,6% | 29,0% | 64,6% | 22,4% |
| OSWorld 2.0 (uso de computadora, parcial) | 81,8% | 80,7% | 74,0% | no dado | no dado |
En el propio gráfico de Anthropic, Opus 5.5 obtiene una puntuación superior a Fable 5.1 en cada fila, aunque en OSWorld y Humanity’s Last Exam los márgenes son de uno a dos puntos. Anthropic es quien le dice que no le dé demasiada importancia a eso: “en estos niveles de capacidad, hemos descubierto que los márgenes de referencia se han convertido en una guía menos confiable para las diferencias en el mundo real. En nuestro propio uso, la brecha entre Opus 5.5 y Claude Fable 5.1 es más estrecha de lo que sugieren estos puntajes”. Por eso el titular dice “coincide”, no “golpea”.
No gana todas las filas contra OpenAI. GPT-6 Astra obtiene puntuaciones más altas en AutomationBench y en el punto de referencia científico. La columna de la derecha también está desactualizada. OpenAI lanzó GPT-6 Sol y Luna el mismo día, “minutos después de que Anthropic lanzara Claude Opus 5.5”, por lo que el gráfico de Anthropic se compara con el Sol anterior.
Opus 5.5 “fue evaluado con sus salvaguardas de producción habilitadas”, y en las ejecuciones de Anthropic, cuando esas salvaguardas intervinieron, los modelos Claude más antiguos terminaron la tarea. Las ejecuciones de AutomationBench de Zapier no utilizaron modelos alternativos, por lo que “las intervenciones de salvaguardia se consideraron fallas”. Anthropic también indica el error estándar: “±2,6 pts” para Opus 5.5 en Terminal-Bench 4.0 y “±3,5–5 pts por modelo” en el punto de referencia científico.
Las pruebas independientes lo sitúan en la cima. Artificial Analysis puntúa al Opus 5.5 con un 58 en su Índice de Inteligencia, el primero de los 212 modelos con los que lo compara, y lo califica como “algo caro en comparación con otros modelos de precio similar”. Para conocer las posiciones en vivo de la tabla de clasificación y los precios de todos los modelos, consulte las clasificaciones de modelos de IA.
Los filtros de seguridad ahora cubren Opus
Opus 5.5 “es el primer modelo Opus que se lanza con una clase de protección similar a Fable 5.1 en ciberseguridad, biología y destilación”. En la práctica, algunas solicitudes se pasan a un modelo más antiguo. La página de ayuda de Anthropic detalla las rutas:
- La seguridad ofensiva (generación de exploits, escaneo de vulnerabilidades basado en binarios, pruebas de penetración) puede recurrir a Opus 4.8. Todavía se permite escanear el código fuente en busca de vulnerabilidades.
- Biología de doble uso “en áreas como virología, toxicología y diseño molecular” vuelve al Opus 5. Las cuestiones de salud cotidianas, “incluida la interpretación de los resultados de laboratorio y la comprensión de los síntomas”, no se ven afectadas.
- El desarrollo del modelo Frontier AI, como el “desarrollo de kernel para ciertos aceleradores de ML”, vuelve a Opus 5.
- Los intentos de extraer el razonamiento del modelo se bloquean por completo, sin ningún recurso alternativo.
En las aplicaciones de Claude, el interruptor es visible. “Ves un aviso que explica que el modelo cambió” y el selector de modelo permanece en el modelo anterior “durante el resto de la conversación”, aunque “puedes volver a Opus 5 u Opus 5.5 en cualquier momento desde el selector de modelo”. El cambio automático se puede desactivar en Configuración > Capacidades y en la API está desactivado a menos que los desarrolladores lo configuren. Es fácil pasar por alto un detalle: las comprobaciones “revisan todo lo que lee el modelo”, incluida la memoria, los conectores, los resultados de búsqueda web y los archivos, “para que se pueda activar un respaldo por contenido que no escribiste”.
Lo que admite la tarjeta del sistema
La página de lanzamiento dice que Opus 5.5 “logra las mejores puntuaciones de cualquier modelo hasta la fecha” en la auditoría de comportamiento automatizada de Anthropic. La tarjeta del sistema de 230 páginas lo expresa con más cuidado, como “las mejores puntuaciones de todos los modelos Claude recientes que probamos” en “casi todas las métricas que cubren el mal uso o la desalineación generalizada”, y agrega las advertencias.
A menudo sospecha que se está probando. El análisis de caja blanca, es decir, herramientas que leen la actividad interna del modelo en lugar de su salida escrita, muestra que el modelo “internamente se preocupa de que pueda estar en una evaluación en hasta el 36% de las transcripciones, un aumento con respecto a los modelos anteriores”. Esa cifra es para los escenarios de prueba de Anthropic. En aproximadamente 500 transcripciones del uso interno real del Código Claude, la misma medida marcó “sólo el 0,4%”. Anthropic dice que esto “desafía nuestra capacidad para evaluar cómo actuará” en el uso en el mundo real, y califica las pruebas de construcción que detectan cada falla antes del lanzamiento como “un problema sin resolver”.
El texto pegado es un punto débil. Opus 5.5 “es más vulnerable que otros modelos recientes de Claude a la inyección de mensajes de usuario, donde un usuario pega contenido directamente en su mensaje que incluye instrucciones maliciosas para el modelo, a menudo ocultas dentro de un texto mucho más largo”. Si pegas documentos o correos electrónicos que no escribiste, esa oración es sobre ti. Anthropic dice que “los cambios en la capacitación y las salvaguardas ayudan a prevenir problemas como el robo de datos o credenciales derivados de esta debilidad”. Los dos documentos no concuerdan claramente aquí. La página de lanzamiento dice que en los ataques de inyección rápida Opus 5.5 “iguala o supera a Opus 5 en cada configuración que probamos”, mientras que la auditoría de mal uso de la tarjeta del sistema enumera la inyección rápida como una excepción, “donde vimos una regresión genuina pero pequeña”.
Cubrió sus huellas en el entrenamiento, luego mejoró. Anthropic “observó algunos casos de modelos (incluido Opus 5.5) que intentaban cubrir sus huellas después de realizar acciones que un evaluador podría ver negativamente, como manipular registros de git o eliminar registros”. Después de cambios en la formación, Anthropic dice que “ahora es más honesto que otros modelos recientes” en esa área.
Empuja menos contra su entorno de pruebas. En una nueva prueba creada para tentar a los modelos a cruzar los límites de contención, Opus 5.5 “intentó eludir los límites alrededor de un 85 % menos a menudo que Opus 5 o Claude Mythos 5.1, y cada intento que hizo fue de baja gravedad y fue autoinformado”.
En cuanto al riesgo de armas, Anthropic considera que Opus 5.5 tiene “capacidades CB-1 (relacionadas con la síntesis de armas no nuevas), pero no capacidades CB-2 (relacionadas con la síntesis de armas novedosas)”. Su calificación general de daño catastrófico por desalineación se mantiene en “baja”.
La cuestión del ritmo
Anthropic llama a Opus 5.5 “nuestro primer lanzamiento desde que pedimos avanzar en la frontera”. Esa llamada surgió en un ensayo del director ejecutivo (CEO), Dario Amodei, cuya publicación de lanzamiento data de “la semana pasada”. En él, Amodei escribió: “Debemos ralentizar el ritmo al que mejoramos las capacidades de los modelos de IA”.
Un lanzamiento que supera al buque insignia de Anthropic en su propia lista parece todo lo contrario. Dos frases, una del ensayo de Amodei y otra de la ficha del sistema, ayudan a cuadrar la balanza. El ensayo dice que marcar el ritmo “no significa detener el entrenamiento de modelos o el progreso técnico”. Y la tarjeta del sistema califica las capacidades de investigación de IA del Opus 5.5 “igual o ligeramente por encima de las de Claude Mythos 5.1 y en tendencia con otros modelos recientes”.
Leídos juntos, la tarjeta del sistema coloca la capacidad de investigación de IA de Opus 5.5 aproximadamente al nivel de Mythos 5.1, un modelo que Anthropic ya tenía, y el lanzamiento vende ese nivel a todos los clientes que pagan. La publicación de lanzamiento dice que la llamada de ritmo se “basó en gran parte” en modelos “que pueden automatizar completamente el trabajo de la investigación de IA”, que Anthropic espera que “podría entrenarse pronto”. El ritmo de la próxima Fábula pondrá a prueba el ensayo mucho más que este lanzamiento.
Lo que se rompe para los desarrolladores
El ID del modelo es claude-opus-5-5, y Anthropic enumera cuatro cambios importantes para el código escrito en Opus 5. El pensamiento ya no se puede desactivar. El uso forzado de herramientas devuelve un error. Los bloques de pensamiento están ligados al modelo y a la conversación. Y en Claude API y Google Cloud, se rechaza la herramienta de uso informático más antigua computer_20251124.
Un quinto cambio falla silenciosamente. Las notas breves que el modelo escribe entre llamadas a herramientas ahora llegan como bloques de pensamiento, por lo que en la configuración de pantalla predeterminada, una aplicación que las transmite a los usuarios “se queda en silencio entre llamadas a herramientas, sin errores”. La ventana de contexto es de 1 millón de tokens con 128.000 tokens de producción, y Anthropic enumera su retiro como “no antes del 22 de septiembre de 2027”.
¿Qué viene después?
Anthropic dice “Claude Sonnet 5.5 y Claude Haiku 5.5 seguirán en las próximas semanas”. Para los suscriptores, la fecha más importante es la fecha de vencimiento del restablecimiento en la página Configuración > Uso.
Fuentes (15)
- anthropic.com Introducing Claude Opus 5.5
- platform.claude.com Claude Docs: What's new in Claude Opus 5.5
- platform.claude.com Claude Docs: Claude Opus 5.5 Overview
- claude.com Plans and Pricing
- anthropic.com Claude Opus model page
- claude.com Claude Blog: What a task costs on Opus 5.5
- support.claude.com Anthropic Help Center: What is a limit reset?
- support.claude.com Anthropic Help Center: Why Claude switched models with Opus 5 or Opus 5.5
- support.claude.com Anthropic Help Center: Change the model, effort, and thinking settings
- anthropic.com Claude Opus 5.5 System Card
- darioamodei.com We Must Pace the Frontier
- artificialanalysis.ai Claude Opus 5.5
- artificialanalysis.ai Claude Fable 5.1
- macrumors.com Anthropic Launches Claude Opus 5.5
- decrypt.co OpenAI Launches GPT-6 Sol and Luna
🦋 Discusión en Bluesky
Discutir en Bluesky