anthropic

Claude Fable 5.1

Claude Fable 5.1 er Anthropics flagship model til agentic coding og videnskab, med et 1M context window, adaptive thinking og 128K output-tokens.

AnthropicAgentic CodingLong ContextReasoningMultimodal
anthropic logoanthropicClaude1. september 2026
Kontekst
1Mtokens
Maks output
128Ktokens
Input-pris
$10.00/ 1M
Output-pris
$50.00/ 1M
Modalitet:TextImage
Funktioner:VisionVærktøjerStreamingRæsonnering
Benchmarks
GPQA
93.7%
GPQA: Spørgsmål og svar på kandidatniveau. En streng benchmark med 448 multiple choice-spørgsmål inden for biologi, fysik og kemi skabt af domæneeksperter. PhD-eksperter opnår kun 65-74% nøjagtighed, mens ikke-eksperter scorer kun 34% selv med ubegrænset webadgang (derfor 'Google-proof'). Claude Fable 5.1 scorede 93.7% på denne benchmark.
HLE
60.9%
HLE: Ekspertniveau-ræsonnering. Tester en models evne til at demonstrere ekspertniveau-ræsonnering på tværs af specialiserede domæner. Evaluerer dyb forståelse af komplekse emner, der kræver professionel viden. Claude Fable 5.1 scorede 60.9% på denne benchmark.
MMLU
89.8%
MMLU: Massiv flerfaglig sprogforståelse. En omfattende benchmark med 16.000 multiple choice-spørgsmål på tværs af 57 akademiske fag, herunder matematik, filosofi, jura og medicin. Tester bred viden og ræsonneringsevner. Claude Fable 5.1 scorede 89.8% på denne benchmark.
MMLU Pro
78.4%
MMLU Pro: MMLU Professionel udgave. En forbedret version af MMLU med 12.032 spørgsmål i et sværere format med 10 svarmuligheder. Dækker matematik, fysik, kemi, jura, ingeniørvidenskab, økonomi, sundhed, psykologi, business, biologi, filosofi og datalogi. Claude Fable 5.1 scorede 78.4% på denne benchmark.
SimpleQA
44.5%
SimpleQA: Faktuel nøjagtighedsbenchmark. Tester en models evne til at give nøjagtige, faktuelle svar på ligetil spørgsmål. Måler pålidelighed og reducerer hallucinationer i vidensindhentningstasks. Claude Fable 5.1 scorede 44.5% på denne benchmark.
IFEval
88.6%
IFEval: Instruktionsfølgningsevaluering. Måler, hvor godt en model følger specifikke instruktioner og begrænsninger. Tester evnen til at overholde formateringsregler, længdegrænser og andre eksplicitte krav. Claude Fable 5.1 scorede 88.6% på denne benchmark.
AIME 2025
88%
AIME 2025: American Invitational Math Exam. Konkurrence-niveau matematikopgaver fra den prestigefyldte AIME-eksamen designet til talentfulde gymnasieelever. Tester avanceret matematisk problemløsning, der kræver abstrakt tænkning, ikke kun mønstergenkendelse. Claude Fable 5.1 scorede 88% på denne benchmark.
MATH
94.2%
MATH: Matematisk problemløsning. En omfattende matematikbenchmark, der tester problemløsning inden for algebra, geometri, calculus og andre matematiske domæner. Kræver flertrinssværsonnering og formel matematisk viden. Claude Fable 5.1 scorede 94.2% på denne benchmark.
GSM8k
97.6%
GSM8k: Folkeskole matematik 8K. 8.500 folkeskole-niveau matematiske tekstopgaver, der kræver flertrinssræsonnering. Tester grundlæggende aritmetik og logisk tænkning gennem virkelige scenarier som shopping eller tidsberegninger. Claude Fable 5.1 scorede 97.6% på denne benchmark.
MGSM
92.1%
MGSM: Flersproget folkeskolematematik. GSM8k-benchmarken oversat til 10 sprog, herunder spansk, fransk, tysk, russisk, kinesisk og japansk. Tester matematisk ræsonnering på tværs af forskellige sprog. Claude Fable 5.1 scorede 92.1% på denne benchmark.
MathVista
71.5%
MathVista: Matematisk visuel ræsonnering. Tester evnen til at løse matematikopgaver, der involverer visuelle elementer som diagrammer, grafer, geometriske figurer og videnskabelige illustrationer. Kombinerer visuel forståelse med matematisk ræsonnering. Claude Fable 5.1 scorede 71.5% på denne benchmark.
SWE-Bench
58.2%
SWE-Bench: Softwareingeniør-benchmark. AI-modeller forsøger at løse rigtige GitHub-issues i open source Python-projekter med menneskelig verifikation. Tester praktiske softwareingeniørfærdigheder på produktionskodebaser. Topmodeller gik fra 4,4% i 2023 til over 70% i 2024. Claude Fable 5.1 scorede 58.2% på denne benchmark.
HumanEval
92.4%
HumanEval: Python-programmeringsopgaver. 164 håndskrevne programmeringsopgaver, hvor modeller skal generere korrekte Python-funktionsimplementeringer. Hver løsning verificeres mod unit tests. Topmodeller opnår nu 90%+ nøjagtighed. Claude Fable 5.1 scorede 92.4% på denne benchmark.
LiveCodeBench
74.8%
LiveCodeBench: Live kodningsbenchmark. Tester kodningsevner på løbende opdaterede, virkelige programmeringsudfordringer. I modsætning til statiske benchmarks bruger den friske problemer for at forhindre dataforurening og måle ægte kodningsevner. Claude Fable 5.1 scorede 74.8% på denne benchmark.
MMMU
71.2%
MMMU: Multimodal forståelse. Massiv multi-disciplin multimodal forståelsesbenchmark, der tester vision-sprogmodeller på universitetsniveau-problemer på tværs af 30 fag, der kræver både billedforståelse og ekspertviden. Claude Fable 5.1 scorede 71.2% på denne benchmark.
MMMU Pro
58.7%
MMMU Pro: MMMU Professionel udgave. Forbedret version af MMMU med mere udfordrende spørgsmål og strengere evaluering. Tester avanceret multimodal ræsonnering på professionelt og ekspertniveau. Claude Fable 5.1 scorede 58.7% på denne benchmark.
ChartQA
89.2%
ChartQA: Diagram-spørgsmål og svar. Tester evnen til at forstå og ræsonnere om information præsenteret i diagrammer og grafer. Kræver udtrækning af data, sammenligning af værdier og udførelse af beregninger fra visuelle datarepræsentationer. Claude Fable 5.1 scorede 89.2% på denne benchmark.
DocVQA
94.1%
DocVQA: Dokument visuel Q&A. Document Visual Question Answering benchmark, der tester evnen til at udtrække og ræsonnere om information fra dokumentbilleder, herunder formularer, rapporter og scannet tekst. Claude Fable 5.1 scorede 94.1% på denne benchmark.
Terminal-Bench
55.8%
Terminal-Bench: Terminal/CLI-opgaver. Tester evnen til at udføre kommandolinjeopgaver, skrive shell-scripts og navigere i terminalmiljøer. Måler praktiske systemadministrations- og udviklingsworkflow-færdigheder. Claude Fable 5.1 scorede 55.8% på denne benchmark.
ARC-AGI
12.4%
ARC-AGI: Abstraktion og ræsonnering. Abstraction and Reasoning Corpus for AGI - tester flydende intelligens gennem nye mønstergenkendelsespuslespil. Hver opgave kræver opdagelse af den underliggende regel fra eksempler, der måler generel ræsonneringsevne snarere end memorering. Claude Fable 5.1 scorede 12.4% på denne benchmark.

Om Claude Fable 5.1

Lær om Claude Fable 5.1s muligheder, funktioner og hvordan den kan hjælpe dig med at opnå bedre resultater.

Arkitektonisk overblik

Claude Fable 5.1 er Anthropics flagship frontier model bygget til langsigtede agentic workflows, autonom softwareudvikling og videnskabelig forskning. Den efterfølger den oprindelige Fable 5-model, mens den bibeholder den identiske basistoken-prissætning og introducerer en reduktion på 75% i læsehastigheder for prompt cache. Modellen er bygget på en adaptive thinking-arkitektur, der gør det muligt for den at planlægge, eksekvere og selvkorrigere på tværs af flertrins eksekverings-loops uden at miste kontekst over sit million-token vindue.

Kernefunktioner

Arkitektonisk er Fable 5.1 optimeret til agentic vedholdenhed, hvilket gør den i stand til at håndtere opgaver, der strækker sig over timer eller dages eksekvering, såsom full-stack applikationsudvikling eller videnskabelig datamodellering i flere faser. Den indeholder forfinede sikkerhedsforanstaltninger, der reducerer falsk-positive afvisninger på tekniske sikkerheds- og biologiopgaver med op til 60-85%.

Målarbejdsgange

Denne model er designet til udviklere og virksomheder, der bygger autonome agenter, hvor pålidelighed i refactoring på tværs af filer og ræsonnering på ekspertniveau er det primære krav. Indbygget vision-understøttelse gør det også muligt for den at analysere tekniske diagrammer, UI-mockups og indlejrede tabeller direkte i kildekoden.

Claude Fable 5.1

Anvendelser for Claude Fable 5.1

Opdag de forskellige måder, du kan bruge Claude Fable 5.1 til at opnå gode resultater.

Autonom softwareudvikling

Navigerer gennem komplekse repositorier med flere mapper for at finde arkitektoniske fejl og udføre refactoring på tværs af filer på en sammenhængende måde.

Videnskabelig datamodellering

Automatiserer analysen af rå observationsdata, tilpasning af differentialligninger og træning af neural network til forskning.

Defensiv sikkerhedsauditering

Undersøger interne API'er og kildekode for at identificere software-sårbarheder og foreslå udbedrende patches.

Visuel UI/UX-prototyping

Genererer funktionelle 3D-simulationer, interaktive WebGL-scener og produktionsklar frontend-kode ud fra tekstbeskrivelser.

Vidensyntese fra flere kilder

Indtager massive datasæt med SEC-indberetninger, udskrifter og diagrammer for at opbygge detaljerede finansielle eller analytiske værdiansættelsesmodeller.

Langsigtede agent-orkestreringer

Fungerer som primær controller for asynkrone workflows, uddelegerer underopgaver til værktøjer og overvåger fremskridt over dusinvis af omgange.

Styrker

Begrænsninger

Elite videnskabelig ræsonnering: Opnår 93,7% på GPQA Diamond og 55,8% på Terminal-Bench til forskning og teknisk automation.
Premium-prissætning uden cache: Basisprisen på $10/M input- og $50/M output-tokens gør ucachede enkeltkald dyre.
Massiv agentic kapacitet: Leverer et context window på 1.000.000 tokens og 128.000 maksimale output-tokens til langvarig autonom eksekvering.
Token-tunge interne udkast: Udvidende adaptive thinking-cyklusser forbruger høje mængder output-tokens før den endelige afsendelse.
Optimeret cache-økonomi: Pris på cache-læsning på $0,25/M tokens reducerer de samlede driftsomkostninger ved flertrins prompt-loops.
Ingen indbygget videounderstøttelse: Modellen behandler statiske billeder og dokumenter, men kan ikke indtage rå videofiler.
Forfinet sikkerhedssystem: Reducer godartede falsk-positive blokeringer med op til 60% ved opgaver inden for defensiv cybersikkerhed og sårbarheder.
Tendens til fuld fil-erstatning: Har tendens til at omskrive hele kildekundefiler ved simple rettelser, medmindre den eksplicit instrueres i at producere diffs.

API hurtig start

anthropic/claude-fable-5.1

Se dokumentation
anthropic SDK
import Anthropic from '@anthropic-ai/sdk';

const anthropic = new Anthropic({
  apiKey: process.env.ANTHROPIC_API_KEY,
});

const msg = await anthropic.messages.create({
  model: "claude-fable-5.1",
  max_tokens: 1024,
  messages: [{ role: "user", content: "Analyze this codebase for architectural flaws." }],
});

console.log(msg.content[0].text);

Installér SDK'et og begynd at foretage API-kald på få minutter.

Hvad folk siger om Claude Fable 5.1

Se hvad fællesskabet mener om Claude Fable 5.1

Fable 5.1 er den første model, der faktisk føles som en co-pilot til lange refactors uden at miste tråden halvvejs igennem.
DevOpsGuru
reddit
Mens tidligere modeller blev svære at følge, jo længere de arbejdede, forbliver Fable 5.1 læsbar over lange flertrinsopgaver.
Craig Falls
hackernews
Claude Fable 5.1 er nu tilgængelig i Cursor! Det er den mest kapable model, vi har kørt på CursorBench 3.2, med en score på 73,4%.
cursor_ai
twitter
Anthropics Mythos-klassemodeller er endelig ved at knække det lange agent-problem. Fable 5.1's vedholdenhed er uovertruffen.
HackernewsUser42
hackernews
Fable 5.1 er sindssyg, folkens. Den klarede min sessionsgrænse i første forsøg, men gennemførte hele migrationen rent.
TechLeadDev
twitter
Prisnedsættelsen på prompt cache gør det faktisk levedygtigt at køre kontinuerlige test-ret-loops i produktion.
VibeCoder
youtube

Videoer om Claude Fable 5.1

Se vejledninger, anmeldelser og diskussioner om Claude Fable 5.1

Fable 5.1 vil koste anslået 25% mindre end Fable 5 for typiske arbejdsbelastninger

For meget agentbaseret arbejde vil besparelserne ofte være meget større, op til ca. 50%

Claude Mythos 5.1 er identisk med Fable 5.1, men den tilbyder mere tilladende sikkerhedsforanstaltninger for godkendte personer og organisationer

Skyggerne ser meget mere realistiske ud, fysikken føles mere ægte

bliver bedt om det. Og det, der også er interessant ved dette, er, at vi har rost dens ønske eller dens evne til at få alle de små detaljer med, uden at du beder om det. Og det er ét sted, hvor den af en eller anden grund ikke er lige så god.

bare sæt dig selv på mute, hvis du skriver. Det viser sig at være ca. 50% mere token-effektiv end Opus 5. Den er også hurtigere end Opus 5. Så, hvis

poleret. Øh, jeg tror, at med hensyn til fremtiden her, er der mere, vi kommer til at udforske i forhold til, hvordan vi kan gøre dette endnu nemmere. Jeg tror

Mere end bare prompts

Supercharg din arbejdsgang med AI-automatisering

Automatio kombinerer kraften fra AI-agenter, webautomatisering og smarte integrationer for at hjælpe dig med at udrette mere på kortere tid.

AI-agenter
Webautomatisering
Smarte arbejdsgange

Pro-tips til Claude Fable 5.1

Eksperttips til at hjælpe dig med at få mest muligt ud af Claude Fable 5.1 og opnå bedre resultater.

Maksimer cache-besparelser

Hold systeminstruktioner og store repositorietræer øverst i din prompt for at drage fordel af prisen på $0,25/M for cache-læsning.

Styr eksekveringsindsatsen

Brug effort-parameteren til at skifte mellem 'low' for standardopgaver og 'high' for kompleks debugging for at balancere omkostninger og hastighed.

Prompt til målrettede rettelser

Giv modellen eksplicitte instruktioner om at levere unified diffs eller målrettede linjeændringer for at undgå, at den omskriver hele store filer.

Tilskynd til autonom vedholdenhed

Inkluder instruktioner i agentic loops, der beder modellen om at fuldføre flertrinsopgaver direkte i stedet for at stoppe op og bede om tilladelse.

Anmeldelser

Hvad vores brugere siger

Slut dig til tusindvis af tilfredse brugere, der har transformeret deres arbejdsgang

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Relateret AI Models

openai

GPT-5.5

OpenAI

GPT-5.5 is OpenAI's flagship frontier model with a 1M context window and five reasoning effort levels, optimized for autonomous agentic workflows and coding.

1M context
$5.00/$30.00/1M
xai

Grok-3

xAI

Grok-3 is xAI's flagship reasoning model, featuring deep logic deduction, a 128k context window, and real-time integration with X for live research and coding.

1M context
$3.00/$15.00/1M
moonshot

Kimi K3

Moonshot

Kimi K3 is Moonshot AI's 2.8T MoE model with a 1M token context window, native multimodal vision, and frontier-tier coding performance for complex agents.

1M context
$3.00/$15.00/1M
google

Gemini 3.1 Flash Live Preview

Google

Gemini 3.1 Flash Live Preview is Google's ultra-low-latency, audio-to-audio model featuring a 131K context window, high-fidelity multimodal reasoning, and...

131K context
$0.75/$4.50/1M
anthropic

Claude Opus 4.7

Anthropic

Claude Opus 4.7 is Anthropic's flagship model with a 1-million-token context, adaptive reasoning, and 3.3x vision resolution for enterprise-scale agents.

1M context
$5.00/$25.00/1M
openai

GPT-5.2 Pro

OpenAI

GPT-5.2 Pro is OpenAI's 2025 flagship reasoning model featuring Extended Thinking for SOTA performance in mathematics, coding, and expert knowledge work.

400K context
$21.00/$168.00/1M
google

Gemini 3.1 Pro

Google

Gemini 3.1 Pro is Google's elite multimodal model featuring the DeepThink reasoning engine, a 1M+ context window, and industry-leading ARC-AGI logic scores.

1M context
$2.00/$12.00/1M
alibaba

Qwen 3.7 Max

alibaba

Qwen 3.7 Max is Alibaba’s flagship AI model for deep reasoning and autonomous agent tasks, featuring a 256k context window and top-tier coding performance.

256K context
$1.20/$6.00/1M

Ofte stillede spørgsmål om Claude Fable 5.1

Find svar på almindelige spørgsmål om Claude Fable 5.1