anthropic

Claude Fable 5.1

Claude Fable 5.1 es el modelo flagship de Anthropic para programación de agentes y ciencia, con un context window de 1M, pensamiento adaptativo y 128K output...

AnthropicProgramación de AgentesContexto LargoRazonamientoMultimodal
anthropic logoanthropicClaude1 de septiembre de 2026
Contexto
1Mtokens
Salida máx.
128Ktokens
Precio entrada
$10.00/ 1M
Precio salida
$50.00/ 1M
Modalidad:TextImage
Capacidades:VisiónHerramientasStreamingRazonamiento
Benchmarks
GPQA
93.7%
GPQA: Q&A Científico Nivel Posgrado. Un riguroso benchmark con 448 preguntas de opción múltiple en biología, física y química creadas por expertos. Los doctores solo logran 65-74% de precisión, mientras que los no expertos obtienen solo 34% incluso con acceso ilimitado a internet (por eso 'a prueba de Google'). Claude Fable 5.1 obtuvo 93.7% en este benchmark.
HLE
60.9%
HLE: Razonamiento de Alto Nivel de Experticia. Evalúa la capacidad de un modelo para demostrar razonamiento a nivel experto en dominios especializados. Evalúa la comprensión profunda de temas complejos que requieren conocimiento profesional. Claude Fable 5.1 obtuvo 60.9% en este benchmark.
MMLU
89.8%
MMLU: Comprensión Masiva Multitarea del Lenguaje. Un benchmark completo con 16,000 preguntas de opción múltiple en 57 materias académicas incluyendo matemáticas, filosofía, derecho y medicina. Evalúa conocimiento amplio y capacidades de razonamiento. Claude Fable 5.1 obtuvo 89.8% en este benchmark.
MMLU Pro
78.4%
MMLU Pro: MMLU Edición Profesional. Una versión mejorada de MMLU con 12,032 preguntas usando un formato más difícil de 10 opciones. Cubre Matemáticas, Física, Química, Derecho, Ingeniería, Economía, Salud, Psicología, Negocios, Biología, Filosofía e Informática. Claude Fable 5.1 obtuvo 78.4% en este benchmark.
SimpleQA
44.5%
SimpleQA: Benchmark de Precisión Factual. Evalúa la capacidad de un modelo para proporcionar respuestas precisas y factuales a preguntas directas. Mide la fiabilidad y reduce las alucinaciones en tareas de recuperación de conocimiento. Claude Fable 5.1 obtuvo 44.5% en este benchmark.
IFEval
88.6%
IFEval: Evaluación de Seguimiento de Instrucciones. Mide qué tan bien un modelo sigue instrucciones y restricciones específicas. Evalúa la capacidad de adherirse a reglas de formato, límites de longitud y otros requisitos explícitos. Claude Fable 5.1 obtuvo 88.6% en este benchmark.
AIME 2025
88%
AIME 2025: Examen de Matemáticas Invitacional Americano. Problemas de matemáticas a nivel de competencia del prestigioso examen AIME diseñado para estudiantes talentosos de secundaria. Evalúa resolución avanzada de problemas matemáticos que requiere razonamiento abstracto. Claude Fable 5.1 obtuvo 88% en este benchmark.
MATH
94.2%
MATH: Resolución de Problemas Matemáticos. Un benchmark completo de matemáticas que evalúa la resolución de problemas en álgebra, geometría, cálculo y otros dominios matemáticos. Requiere razonamiento en múltiples pasos y conocimiento matemático formal. Claude Fable 5.1 obtuvo 94.2% en este benchmark.
GSM8k
97.6%
GSM8k: Matemáticas de Primaria 8K. 8,500 problemas de matemáticas de nivel primaria que requieren razonamiento en múltiples pasos. Evalúa aritmética básica y pensamiento lógico a través de escenarios cotidianos. Claude Fable 5.1 obtuvo 97.6% en este benchmark.
MGSM
92.1%
MGSM: Matemáticas de Primaria Multilingüe. El benchmark GSM8k traducido a 10 idiomas incluyendo español, francés, alemán, ruso, chino y japonés. Evalúa el razonamiento matemático en diferentes idiomas. Claude Fable 5.1 obtuvo 92.1% en este benchmark.
MathVista
71.5%
MathVista: Razonamiento Visual Matemático. Evalúa la capacidad de resolver problemas matemáticos que involucran elementos visuales como gráficos, diagramas de geometría y figuras científicas. Combina comprensión visual con razonamiento matemático. Claude Fable 5.1 obtuvo 71.5% en este benchmark.
SWE-Bench
58.2%
SWE-Bench: Benchmark de Ingeniería de Software. Los modelos de IA intentan resolver issues reales de GitHub en proyectos Python de código abierto con verificación humana. Evalúa habilidades prácticas de ingeniería de software. Los mejores modelos pasaron de 4.4% (2023) a más del 70% (2024). Claude Fable 5.1 obtuvo 58.2% en este benchmark.
HumanEval
92.4%
HumanEval: Problemas de Programación Python. 164 problemas de programación escritos a mano donde los modelos deben generar implementaciones correctas de funciones Python. Cada solución se verifica con tests unitarios. Los mejores modelos ahora logran más del 90%. Claude Fable 5.1 obtuvo 92.4% en este benchmark.
LiveCodeBench
74.8%
LiveCodeBench: Benchmark de Codificación en Vivo. Evalúa habilidades de codificación con desafíos de programación del mundo real continuamente actualizados. A diferencia de benchmarks estáticos, usa problemas frescos para prevenir contaminación de datos. Claude Fable 5.1 obtuvo 74.8% en este benchmark.
MMMU
71.2%
MMMU: Comprensión Multimodal. Benchmark de Comprensión Multimodal Multidisciplinaria Masiva que evalúa modelos de visión-lenguaje en problemas universitarios en 30 materias que requieren tanto comprensión de imágenes como conocimiento experto. Claude Fable 5.1 obtuvo 71.2% en este benchmark.
MMMU Pro
58.7%
MMMU Pro: MMMU Edición Profesional. Versión mejorada de MMMU con preguntas más desafiantes y evaluación más estricta. Evalúa razonamiento multimodal avanzado a niveles profesional y experto. Claude Fable 5.1 obtuvo 58.7% en este benchmark.
ChartQA
89.2%
ChartQA: Respuesta a Preguntas sobre Gráficos. Evalúa la capacidad de comprender y razonar sobre información presentada en gráficos y diagramas. Requiere extracción de datos, comparación de valores y cálculos desde representaciones visuales. Claude Fable 5.1 obtuvo 89.2% en este benchmark.
DocVQA
94.1%
DocVQA: Q&A Visual de Documentos. Benchmark de Respuesta a Preguntas Visuales de Documentos que evalúa la capacidad de extraer y razonar sobre información de imágenes de documentos incluyendo formularios, reportes y texto escaneado. Claude Fable 5.1 obtuvo 94.1% en este benchmark.
Terminal-Bench
55.8%
Terminal-Bench: Tareas de Terminal/CLI. Evalúa la capacidad de realizar operaciones de línea de comandos, escribir scripts de shell y navegar en entornos de terminal. Mide habilidades prácticas de administración de sistemas y flujos de trabajo de desarrollo. Claude Fable 5.1 obtuvo 55.8% en este benchmark.
ARC-AGI
12.4%
ARC-AGI: Abstracción y Razonamiento. Corpus de Abstracción y Razonamiento para AGI - evalúa inteligencia fluida a través de puzzles de reconocimiento de patrones novedosos. Cada tarea requiere descubrir la regla subyacente a partir de ejemplos, midiendo capacidad de razonamiento general en lugar de memorización. Claude Fable 5.1 obtuvo 12.4% en este benchmark.

Acerca de Claude Fable 5.1

Conoce las capacidades, características y formas de uso de Claude Fable 5.1.

Resumen Arquitectónico

Claude Fable 5.1 es el modelo flagship frontier de Anthropic diseñado para flujos de trabajo de agentes de larga duración, ingeniería de software autónoma e investigación científica. Sucede al modelo Fable 5 original, manteniendo los precios base de tokens idénticos e introduciendo una reducción del 75% en las tarifas de lectura de prompt cache. El modelo está construido sobre una arquitectura de pensamiento adaptativo que le permite planificar, ejecutar y autocorregirse a través de bucles de ejecución de múltiples pasos sin perder el contexto en su ventana de un millón de tokens.

Capacidades Principales

Arquitectónicamente, Fable 5.1 está optimizado para la persistencia de agentes, lo que le permite manejar tareas que abarcan horas o días de ejecución, como el desarrollo de aplicaciones full-stack o el modelado de datos científicos en múltiples etapas. Incorpora salvaguardas refinadas que reducen las denegaciones por falsos positivos en tareas de seguridad técnica y biología entre un 60% y un 85%.

Cargas de Trabajo Objetivo

Este modelo está diseñado para desarrolladores y empresas que construyen agentes autónomos donde la fiabilidad en la refactorización de múltiples archivos y el razonamiento a nivel experto son el requisito principal. El soporte de visión nativa también le permite analizar diagramas técnicos, maquetas de UI y gráficos tabulares anidados directamente dentro de las bases de código.

Claude Fable 5.1

Casos de uso de Claude Fable 5.1

Descubre las diferentes formas de usar Claude Fable 5.1 para lograr excelentes resultados.

Ingeniería de Software Autónoma

Navega por repositorios complejos de múltiples directorios para localizar fallos arquitectónicos y ejecutar refactorizaciones de múltiples archivos de forma coherente.

Modelado de Datos Científicos

Automatiza el análisis de datos de observación sin procesar, el ajuste de ecuaciones diferenciales y el entrenamiento de neural network para la investigación.

Auditoría de Seguridad Defensiva

Inspecciona APIs internas y código fuente para identificar vulnerabilidades de software y sugerir parches de remediación.

Prototipado UI/UX Visual

Genera simulaciones 3D funcionales, escenas WebGL interactivas y código frontend listo para producción a partir de descripciones de texto.

Síntesis de Conocimiento Multi-fuente

Ingiere conjuntos de datos masivos de presentaciones a la SEC, transcripciones y gráficos para construir modelos financieros o de valoración analítica detallados.

Orquestación de Agentes a Largo Plazo

Actúa como un controlador principal para flujos de trabajo asíncronos, delegando subtareas a herramientas y supervisando el progreso durante decenas de turnos.

Fortalezas

Limitaciones

Razonamiento Científico de Élite: Alcanza un 93.7% en GPQA Diamond y un 55.8% en Terminal-Bench para investigación y automatización técnica.
Precio Prémium sin Caché: El precio base de $10/M tokens de input y $50/M de output hace que las llamadas individuales sin caché sean costosas.
Capacidad Agentic Masiva: Proporciona un context window de 1,000,000 de tokens y 128,000 output tokens máximos para una ejecución autónoma prolongada.
Redacción Interna con Muchos Tokens: Los ciclos de pensamiento adaptativo extendidos consumen un alto recuento de output tokens antes de la emisión final.
Economía de Caché Optimizada: El precio de lectura de caché a $0.25/M tokens reduce los costes operativos totales en bucles de prompts de múltiples pasos.
Sin Soporte de Vídeo Nativo: El modelo procesa imágenes estáticas y documentos, pero no puede ingerir archivos de vídeo en bruto.
Sistema de Seguridad Refinado: Reduce los bloqueos por falsos positivos benignos hasta en un 60% en tareas de ciberseguridad defensiva y vulnerabilidades.
Sesgo de Reemplazo de Archivo Completo: Tiende a reescribir archivos fuente enteros para ediciones simples a menos que se le indique explícitamente que devuelva diffs.

Inicio rápido de API

anthropic/claude-fable-5.1

Ver documentación
anthropic SDK
import Anthropic from '@anthropic-ai/sdk';

const anthropic = new Anthropic({
  apiKey: process.env.ANTHROPIC_API_KEY,
});

const msg = await anthropic.messages.create({
  model: "claude-fable-5.1",
  max_tokens: 1024,
  messages: [{ role: "user", content: "Analyze this codebase for architectural flaws." }],
});

console.log(msg.content[0].text);

Instala el SDK y comienza a hacer llamadas API en minutos.

Lo que la gente dice sobre Claude Fable 5.1

Mira lo que la comunidad piensa sobre Claude Fable 5.1

Fable 5.1 es el primer modelo que realmente se siente como un copiloto para refactorizaciones largas sin perder el hilo a mitad de camino.
DevOpsGuru
reddit
Mientras que los modelos anteriores se volvían difíciles de seguir cuanto más tiempo trabajaban, Fable 5.1 sigue siendo legible en tareas largas y de múltiples pasos.
Craig Falls
hackernews
¡Claude Fable 5.1 ya está disponible en Cursor! Es el modelo más capaz que hemos ejecutado en CursorBench 3.2, obteniendo una puntuación del 73.4%.
cursor_ai
twitter
Los modelos clase Mythos de Anthropic finalmente están resolviendo el problema de los agentes de larga duración. La persistencia de Fable 5.1 no tiene comparación.
HackernewsUser42
hackernews
Fable 5.1 es una locura, chicos. Consumió mi límite de uso de sesión de un solo golpe, pero completó toda la migración limpiamente.
TechLeadDev
twitter
La reducción de precio del prompt cache hace que ejecutar bucles continuos de prueba y corrección sea realmente viable en producción.
VibeCoder
youtube

Videos sobre Claude Fable 5.1

Mira tutoriales, reseñas y discusiones sobre Claude Fable 5.1

Fable 5.1 costará aproximadamente un 25% menos que Fable 5 para cargas de trabajo típicas

Para trabajos altamente agentic, el ahorro a menudo será mucho mayor, hasta aproximadamente el 50%

Claude Mythos 5.1 es idéntico a Fable 5.1, pero ofrece salvaguardas más permisivas para personas y organizaciones verificadas

Las sombras se ven mucho más realistas, la física se siente más real

siendo requerido. Y lo que también es interesante de esto es que hemos estado elogiando su deseo o su capacidad de acertar en todos los pequeños detalles sin que se lo pidas. Y este es un lugar donde, por la razón que sea, no es tan bueno.

simplemente silencia tu micrófono si estás escribiendo. Resulta ser aproximadamente un 50% más eficiente en tokens que Opus 5. También es más rápido que Opus 5. Así que, si

pulido. Um, creo que en términos del futuro aquí, hay más cosas que vamos a estar explorando en cuanto a cómo podemos hacer esto aún más fácil. Creo

Mas que solo prompts

Potencia tu flujo de trabajo con Automatizacion IA

Automatio combina el poder de agentes de IA, automatizacion web e integraciones inteligentes para ayudarte a lograr mas en menos tiempo.

Agentes de IA
Automatización Web
Flujos Inteligentes

Consejos Pro para Claude Fable 5.1

Consejos de expertos para ayudarte a sacar el máximo provecho de Claude Fable 5.1.

Maximiza el Ahorro en Caché

Mantén las instrucciones del sistema y los árboles de repositorios grandes al principio de tu prompt para aprovechar el precio de lectura de caché de $0.25/M.

Controla el Esfuerzo de Ejecución

Utiliza el parámetro de esfuerzo para cambiar entre 'low' para tareas estándar y 'high' para depuración compleja con el fin de equilibrar coste y velocidad.

Haz Prompts para Ediciones Dirigidas

Instruye explícitamente al modelo para que proporcione diffs unificados o cambios de líneas específicos para evitar que reescriba archivos grandes enteros.

Estimula la Persistencia Autónoma

En bucles agentic, incluye instrucciones que inciten al modelo a completar tareas de múltiples pasos directamente en lugar de pausar para pedir permiso.

Testimonios

Lo Que Dicen Nuestros Usuarios

Unete a miles de usuarios satisfechos que han transformado su flujo de trabajo

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Relacionados AI Models

openai

GPT-5.5

OpenAI

GPT-5.5 is OpenAI's flagship frontier model with a 1M context window and five reasoning effort levels, optimized for autonomous agentic workflows and coding.

1M context
$5.00/$30.00/1M
xai

Grok-3

xAI

Grok-3 is xAI's flagship reasoning model, featuring deep logic deduction, a 128k context window, and real-time integration with X for live research and coding.

1M context
$3.00/$15.00/1M
moonshot

Kimi K3

Moonshot

Kimi K3 is Moonshot AI's 2.8T MoE model with a 1M token context window, native multimodal vision, and frontier-tier coding performance for complex agents.

1M context
$3.00/$15.00/1M
google

Gemini 3.1 Flash Live Preview

Google

Gemini 3.1 Flash Live Preview is Google's ultra-low-latency, audio-to-audio model featuring a 131K context window, high-fidelity multimodal reasoning, and...

131K context
$0.75/$4.50/1M
anthropic

Claude Opus 4.7

Anthropic

Claude Opus 4.7 is Anthropic's flagship model with a 1-million-token context, adaptive reasoning, and 3.3x vision resolution for enterprise-scale agents.

1M context
$5.00/$25.00/1M
openai

GPT-5.2 Pro

OpenAI

GPT-5.2 Pro is OpenAI's 2025 flagship reasoning model featuring Extended Thinking for SOTA performance in mathematics, coding, and expert knowledge work.

400K context
$21.00/$168.00/1M
google

Gemini 3.1 Pro

Google

Gemini 3.1 Pro is Google's elite multimodal model featuring the DeepThink reasoning engine, a 1M+ context window, and industry-leading ARC-AGI logic scores.

1M context
$2.00/$12.00/1M
alibaba

Qwen 3.7 Max

alibaba

Qwen 3.7 Max is Alibaba’s flagship AI model for deep reasoning and autonomous agent tasks, featuring a 256k context window and top-tier coding performance.

256K context
$1.20/$6.00/1M

Preguntas Frecuentes Sobre Claude Fable 5.1

Encuentra respuestas a preguntas comunes sobre Claude Fable 5.1