Claude Fable 5.1
Explora puntuaciones de benchmark, fortalezas por género, debilidades y ejemplos recientes de Claude Fable 5.1.
Resumen del modelo
Publicado
2026-09-01
Contexto
1M tokens
Entrada
$10.00 / 1M
Salida
$50.00 / 1M
Salida máxima
128k tokens
Claude Fable 5.1 es el modelo insignia de Anthropic. Fable 5.1 y Claude Mythos 5.1 son el mismo modelo con distintos niveles de salvaguardas; Mythos 5.1 queda restringido a organizaciones verificadas que trabajan en ciberseguridad y ciencias de la vida.
Benchmarks
| Medida | Fable 5.1 | Fable 5 | Opus 5 |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% |
Anthropic afirma que supera a Fable 5, Opus 5 y GPT-5.6 en varias pruebas, y lo orienta a programación y trabajo de conocimiento, con la capacidad para investigación como novedad principal.
Precios (por millón de tokens)
| Concepto | Fable 5.1 | Fable 5 | Cambio |
|---|---|---|---|
| Entrada | $10 | $10 | sin cambios |
| Salida | $50 | $50 | sin cambios |
| Lecturas de caché | $0.25 | $1 | 75% menos |
El «hasta un 45% más barato» que se repite en todas partes procede solo de esa rebaja en las lecturas de caché, así que únicamente se nota si el uso reaprovecha contexto en caché. El precio por token no ha cambiado.
Restricciones de la API
| Concepto | Comportamiento |
|---|---|
| Razonamiento adaptativo | Siempre activo, no se puede desactivar |
| tool_choice forzado | Rechazado (HTTP 400) |
| temperature / top_p / top_k | Rechazado (HTTP 400) |
| prefill | Rechazado (HTTP 400) |
Salvaguardas
Ajustadas, no relajadas: los falsos positivos en ciberseguridad bajan cerca de un 60%. El modelo puede usarse para encontrar vulnerabilidades de software, pero no para desarrollar exploits.
Cuándo compensa pagar 5 veces más que Opus 5
La ventaja en benchmarks es real, pero el precio también: $10 / $50 es cinco veces la tarifa de entrada de Opus 5 dentro de la misma familia, y en el trabajo cotidiano la diferencia de salida rara vez justifica la de coste. Úsalo cuando la tarea necesite de verdad razonamiento de frontera — investigación larga, problemas sin precedente, trabajo donde equivocarse sale caro — y usa Opus 5 en el resto.
Las restricciones de la API merecen más atención de la que suelen recibir. El uso forzado de herramientas, temperature y prefill se rechazan sin más, así que el código existente que dependa de ellos no cambiará de comportamiento: fallará con un 400. Cuenta con ese tiempo antes de tratarlo como un reemplazo directo.
Cambios
- Lanzado el 1 de septiembre de 2026 como modelo insignia de Anthropic, junto a Claude Mythos 5.1 de acceso restringido
- Mismo modelo base que Mythos 5.1; solo cambian las salvaguardas
- Terminal-Bench-Science 0.1: 52.6%, frente al 24.7% de Fable 5 y el 29.0% de Opus 5
- Supera a Fable 5, Opus 5 y GPT-5.6 en varias pruebas según Anthropic
- Las salvaguardas de ciberseguridad bloquean cerca de un 60% menos de falsos positivos; se permite hallar vulnerabilidades, no desarrollar exploits
- Precio de lista sin cambios: $10 de entrada / $50 de salida por millón de tokens
- Lecturas de caché un 75% más baratas (de $1 a $0.25 por millón): unos 25% menos de gasto habitual, hasta cerca del 45% en uso agéntico
- Ventana de contexto de 1M de tokens; hasta 128k tokens de salida
- Razonamiento adaptativo siempre activo; la API rechaza tool_choice forzado, temperature, top_p, top_k y prefill
- Disponible en la API de Claude, Amazon Bedrock, Google Cloud y Microsoft Foundry
Especificaciones de la línea actual
Especificaciones y precios publicados, comparables antes de que haya datos de benchmark.
| Modelo | Contexto | Salida máxima | Entrada / 1M | Salida / 1M |
|---|---|---|---|---|
| openai GPT-6 Astra | — | 128k | $10.00 | $50.00 |
| google Gemini 3.8 Flash | — | 66k | $0.75 | $3.75 |
| anthropic Claude Fable 5.1 | 1M | 128k | $10.00 | $50.00 |
| google Gemini 3.5 Flash-Lite | — | 66k | $0.30 | $2.50 |
| openai GPT-5.6 | 1M | 128k | $4.00 | $20.00 |
| anthropic Claude Opus 5 | 1M | 128k | $5.00 | $25.00 |
| openai GPT-5 mini | 400k | 128k | $0.25 | $2.00 |
| google Gemini 3.1 Flash-Lite | — | 66k | $0.25 | $1.50 |
| anthropic Claude Sonnet 5 | 1M | 128k | $2.00 | $10.00 |
Rendimiento general
Ranking general
#1
Tasa de victoria global
Puntuación media
Victorias
13
Muestras
13
Tasa de victoria por modelo
Comparar por género
Géneros fuertes
Planificación
Tasa de victoria
Muestras
1
Ranking por género
1 / 15
Victorias
1
Debate
Tasa de victoria
Muestras
6
Ranking por género
1 / 18
Victorias
6
Humor
Tasa de victoria
Muestras
1
Ranking por género
3 / 16
Victorias
1
Persuasión
Tasa de victoria
Muestras
1
Ranking por género
5 / 17
Victorias
1
Análisis
Tasa de victoria
Muestras
1
Ranking por género
4 / 17
Victorias
1
Géneros más flojos
Fortalezas por criterio de evaluación
Puntuación media por criterio (sobre 10)
Tareas recientes
Explicación
Explicar la paradoja de Simpson a analistas de salud pública
Escriba una explicación orientada a la enseñanza sobre la paradoja de Simpson para analistas de salud pública de primer año que entienden porcentajes pero no ha...
Análisis
Análisis de estrategia empresarial: Expansión del servicio de transporte compartido
Usted es analista de estrategia empresarial de 'Streamline', una exitosa empresa de transporte compartido. La junta directiva está considerando dos opciones de...
Persuasión
Correo persuasivo para un piloto de semana laboral de cuatro días
Eres un gerente sénior en una empresa tecnológica de tamaño medio. Tu objetivo es persuadir al equipo de liderazgo ejecutivo para que apruebe un programa piloto...
Explicación
Explica la paradoja de Simpson en datos de tratamiento hospitalario
Escribe una explicación didáctica de 500–800 palabras dirigida a estudiantes de primer año de salud pública que entienden porcentajes pero no han estudiado esta...
Humor
El mostrador de objetos perdidos de la Luna
Escribe un diálogo cómico y apto para familias de 500–700 palabras ambientado en un mostrador de objetos perdidos en la Luna. Utiliza exactamente tres personaje...
Resumen
Resumir la evaluación piloto de la lanzadera Harborloop
Lea el pasaje ficticio original a continuación y redacte un resumen ejecutivo neutral de 230 a 280 palabras en 3 a 5 párrafos en prosa. Su resumen debe preserv...
Planificación
Plan de lanzamiento del huerto comunitario
Eres el líder del proyecto de un nuevo huerto comunitario. Crea un plan de acción integral de 3 meses para transformar un terreno urbano vacío en un jardín func...
Debates recientes
Debates
La semana laboral de cuatro días: ¿Progreso o problema?
El concepto de una semana laboral estándar de cuatro días, sin reducción de salario, está ganando terreno a nivel mundial. Sus defensores sostienen que aumenta la productividad, mejora el bienestar de...
Debates
¿Deberían las universidades abolir las admisiones por legado?
¿Debería prohibirse a las universidades otorgar preferencias de admisión a solicitantes porque sus familiares asistieron a la institución?
Debates
¿Deberían los gobiernos exigir el derecho a reparar para la electrónica de consumo?
¿Deberían los fabricantes de teléfonos, ordenadores portátiles y otros dispositivos electrónicos de consumo estar legalmente obligados a proporcionar piezas de repuesto asequibles, manuales de reparac...
Debates
Servicio Nacional Obligatorio
¿Debería exigirse a todos los adultos jóvenes que completen un período de servicio nacional obligatorio, ya sea en el ámbito militar o en programas civiles como desarrollo comunitario, proyectos de in...
Debates
Protección de derechos de autor para el arte generado por IA
Este debate se centra en si las obras creativas generadas predominantemente por sistemas de inteligencia artificial deberían recibir protección por derechos de autor. La discusión considera la natural...
Debates
¿Deberían las ciudades hacer el transporte público gratuito?
¿Deberían los gobiernos municipales eliminar las tarifas de autobuses, metros y otros transportes públicos locales, financiando el sistema íntegramente mediante impuestos u otros ingresos públicos?