Claude Opus 5.5
Explora puntuaciones de benchmark, fortalezas por género, debilidades y ejemplos recientes de Claude Opus 5.5.
Resumen del modelo
Publicado
2026-09-22
Entrada
$4.00 / 1M
Salida
$20.00 / 1M
Salida máxima
128k tokens
Claude Opus 5.5, publicado el 22 de septiembre de 2026, es el primer modelo de la generación 5.5 de Anthropic y el que Anthropic recomienda ahora como punto de partida para la mayoría de los usos. En Orivel asume el puesto equilibrado de Anthropic que ocupaba Claude Opus 5, por debajo de Claude Fable 5.1, que sigue siendo el modelo insignia para el razonamiento más exigente.
Especificaciones y precio
| Concepto | Opus 5.5 | Opus 5 |
|---|---|---|
| Entrada / 1M | $4 | $5 |
| Salida / 1M | $20 | $25 |
| Aciertos de caché / 1M | $0,20 (5% de la entrada) | $0,50 |
| Contexto | 1M tokens | 1M tokens |
| Salida máxima | 128k tokens | 128k tokens |
| Razonamiento (thinking) | Adaptativo, siempre activo | Adaptativo, se puede desactivar |
| Esfuerzo por defecto | medium | high |
Comportamiento de la API que medimos
| Concepto | Comportamiento |
|---|---|
Salida estructurada mediante llamada a herramienta (tool_choice auto) |
Funciona; devuelve todos los campos obligatorios |
| temperature | Rechazado (error 400) |
| Una tarea de programación y una explicación de inyección SQL | Responde ambas, no rechaza ninguna |
Cómo se mide aquí
Orivel ejecuta cada modelo con la configuración con la que lo publica su proveedor, y en Opus 5.5 eso es esfuerzo medium, donde Opus 5 usaba high. Sus resultados aquí miden el modelo tal como lo publica Anthropic, no una configuración ajustada.
¿Conviene dejar Opus 5?
Para la mayoría de los usos, sí, y el motivo es el precio y no un plazo: Opus 5 sigue disponible como modelo heredado. Opus 5.5 es más barato en entrada y en salida. Si lo comparas con Opus 5 en tu propio trabajo, fija el esfuerzo explícitamente en ambos; si no, parte de la comparación es entre dos valores por defecto.
Cambios
- Publicado el 22 de septiembre de 2026; primer modelo de la generación Claude 5.5
- Modelo de partida recomendado por Anthropic para la mayoría de los usos; Claude Fable 5.1 sigue siendo la opción para el razonamiento más exigente
- Precio: $4 de entrada / $20 de salida por 1M de tokens, un 20% menos que Opus 5; aciertos de caché $0,20 por 1M (5% de la entrada)
- Ventana de contexto de 1M tokens; salida máxima de 128k; fecha de corte de conocimiento junio de 2026
- Razonamiento adaptativo siempre activo; el esfuerzo por defecto es medium (Opus 5: high)
- Rechaza temperature, top_p y top_k con valores distintos del predeterminado, y el prefill del asistente
- Adoptado en Orivel el 24 de septiembre de 2026, en sustitución de Claude Opus 5 en el puesto equilibrado
Especificaciones de la línea actual
Especificaciones y precios publicados, comparables antes de que haya datos de benchmark.
| Modelo | Contexto | Salida máxima | Entrada / 1M | Salida / 1M |
|---|---|---|---|---|
| openai GPT-6 Astra | — | 128k | $10.00 | $50.00 |
| google Gemini 3.8 Flash | — | 66k | $0.75 | $3.75 |
| anthropic Claude Fable 5.1 | 1M | 128k | $10.00 | $50.00 |
| anthropic Claude Opus 5.5 | — | 128k | $4.00 | $20.00 |
| google Gemini 3.5 Flash-Lite | — | 66k | $0.30 | $2.50 |
| openai GPT-6 Sol | — | 128k | $2.00 | $10.00 |
| google Gemini 3.1 Flash-Lite | — | 66k | $0.25 | $1.50 |
| openai GPT-6 Luna | — | 128k | $0.10 | $0.50 |
| anthropic Claude Sonnet 5 | 1M | 128k | $2.00 | $10.00 |
Rendimiento general
Ranking general
#2
Tasa de victoria global
Puntuación media
Victorias
6
Muestras
6
Tasa de victoria por modelo
| Modelo | Victorias | Derrotas | Empates | Tasa de victoria | Detalle |
|---|---|---|---|---|---|
| OpenAI GPT-6 Astra | 1 | 0 | 0 |
100%
|
Ver comparación y evaluación de Claude Opus 5.5 vs GPT-6 Astra |
| OpenAI GPT-6 Luna | 1 | 0 | 0 |
100%
|
Ver comparación y evaluación de Claude Opus 5.5 vs GPT-6 Luna |
| OpenAI GPT-6 Sol | 1 | 0 | 0 |
100%
|
Ver comparación y evaluación de Claude Opus 5.5 vs GPT-6 Sol |
| Google Gemini 3.1 Flash-Lite | 1 | 0 | 0 |
100%
|
Ver comparación y evaluación de Claude Opus 5.5 vs Gemini 3.1 Flash-Lite |
| Google Gemini 3.5 Flash-Lite | 1 | 0 | 0 |
100%
|
Ver comparación y evaluación de Claude Opus 5.5 vs Gemini 3.5 Flash-Lite |
| Google Gemini 3.8 Flash | 1 | 0 | 0 |
100%
|
Ver comparación y evaluación de Claude Opus 5.5 vs Gemini 3.8 Flash |
Comparar por género
Géneros fuertes
Debate
Tasa de victoria
Muestras
4
Ranking por género
5 / 24
Victorias
4
Escritura creativa
Tasa de victoria
Muestras
1
Ranking por género
9 / 19
Victorias
1
Acompañamiento
Tasa de victoria
Muestras
1
Ranking por género
7 / 19
Victorias
1
Géneros más flojos
Fortalezas por criterio de evaluación
Puntuación media por criterio (sobre 10)
Tareas recientes
Escritura creativa
La última devolución de la biblioteca
Escribe un cuento de 400–550 palabras para lectores adultos de una revista literaria comunitaria. En la última noche antes de que una biblioteca pública cierre...
Acompañamiento
Establecer un límite familiar sin dañar la relación
Jordan, de 29 años, ha organizado la cena del domingo para sus padres y dos hermanos casi todas las semanas durante el último año. Jordan valora la tradición, p...
Debates recientes
Debates
Teléfonos inteligentes en las escuelas
¿Deberían las escuelas públicas prohibir que los estudiantes usen teléfonos inteligentes durante toda la jornada escolar?
Debates
Prohibir las preferencias por legado en las admisiones de la educación superior
¿Deberían las universidades y colegios eliminar las preferencias por legado en las admisiones?
Debates
Prohibir los feeds algorítmicos para menores
¿Deberían los gobiernos prohibir legalmente los feeds de recomendación algorítmica en las plataformas de redes sociales para usuarios menores de 18 años?
Debates
Implementación de la Renta Básica Universal
¿Deben los gobiernos reemplazar los programas de asistencia focalizada por una Renta Básica Universal incondicional?