anthropic

Claude Fable 5.1

Claude Fable 5.1 adalah flagship model dari Anthropic untuk agentic coding dan sains, menampilkan context window 1M, adaptive thinking, dan 128K output token.

AnthropicAgentic CodingContext PanjangReasoningMultimodal
anthropic logoanthropicClaude1 September 2026
Konteks
1Mtoken
Output maks.
128Ktoken
Harga input
$10.00/ 1M
Harga output
$50.00/ 1M
Modalitas:TextImage
Kemampuan:VisiAlatStreamingPenalaran
Benchmarks
GPQA
93.7%
GPQA: Tanya Jawab Sains Tingkat Doktoral. Benchmark ketat dengan 448 pertanyaan pilihan ganda dalam biologi, fisika, dan kimia yang dibuat oleh pakar domain. Para ahli PhD hanya mencapai akurasi 65-74%, sementara non-ahli hanya mendapat 34% bahkan dengan akses web tak terbatas (sehingga disebut 'tahan Google'). Claude Fable 5.1 meraih skor 93.7% pada benchmark ini.
HLE
60.9%
HLE: Penalaran Keahlian Tingkat Tinggi. Menguji kemampuan model untuk mendemonstrasikan penalaran tingkat ahli di domain khusus. Mengevaluasi pemahaman mendalam tentang topik kompleks yang membutuhkan pengetahuan tingkat profesional. Claude Fable 5.1 meraih skor 60.9% pada benchmark ini.
MMLU
89.8%
MMLU: Pemahaman Bahasa Multitugas Masif. Benchmark komprehensif dengan 16.000 pertanyaan pilihan ganda meliputi 57 mata pelajaran akademik termasuk matematika, filsafat, hukum, dan kedokteran. Menguji pengetahuan luas dan kemampuan penalaran. Claude Fable 5.1 meraih skor 89.8% pada benchmark ini.
MMLU Pro
78.4%
MMLU Pro: MMLU Edisi Profesional. Versi MMLU yang ditingkatkan dengan 12.032 pertanyaan menggunakan format 10 pilihan yang lebih sulit. Mencakup Matematika, Fisika, Kimia, Hukum, Teknik, Ekonomi, Kesehatan, Psikologi, Bisnis, Biologi, Filsafat, dan Ilmu Komputer. Claude Fable 5.1 meraih skor 78.4% pada benchmark ini.
SimpleQA
44.5%
SimpleQA: Benchmark Akurasi Faktual. Menguji kemampuan model untuk memberikan respons yang akurat dan faktual terhadap pertanyaan langsung. Mengukur keandalan dan mengurangi halusinasi dalam tugas pengambilan pengetahuan. Claude Fable 5.1 meraih skor 44.5% pada benchmark ini.
IFEval
88.6%
IFEval: Evaluasi Kepatuhan Instruksi. Mengukur seberapa baik model mengikuti instruksi dan batasan tertentu. Menguji kemampuan untuk mematuhi aturan format, batas panjang, dan persyaratan eksplisit lainnya. Claude Fable 5.1 meraih skor 88.6% pada benchmark ini.
AIME 2025
88%
AIME 2025: Ujian Matematika Undangan Amerika. Soal matematika tingkat kompetisi dari ujian AIME bergengsi yang dirancang untuk siswa SMA berbakat. Menguji pemecahan masalah matematika tingkat lanjut yang membutuhkan penalaran abstrak, bukan sekadar pencocokan pola. Claude Fable 5.1 meraih skor 88% pada benchmark ini.
MATH
94.2%
MATH: Pemecahan Masalah Matematika. Benchmark matematika komprehensif yang menguji pemecahan masalah dalam aljabar, geometri, kalkulus, dan domain matematika lainnya. Membutuhkan penalaran multi-langkah dan pengetahuan matematika formal. Claude Fable 5.1 meraih skor 94.2% pada benchmark ini.
GSM8k
97.6%
GSM8k: Matematika SD 8K. 8.500 soal cerita matematika tingkat SD yang membutuhkan penalaran multi-langkah. Menguji aritmatika dasar dan pemikiran logis melalui skenario dunia nyata seperti belanja atau perhitungan waktu. Claude Fable 5.1 meraih skor 97.6% pada benchmark ini.
MGSM
92.1%
MGSM: Matematika SD Multibahasa. Benchmark GSM8k yang diterjemahkan ke 10 bahasa termasuk Spanyol, Prancis, Jerman, Rusia, Cina, dan Jepang. Menguji penalaran matematika dalam berbagai bahasa. Claude Fable 5.1 meraih skor 92.1% pada benchmark ini.
MathVista
71.5%
MathVista: Penalaran Matematika Visual. Menguji kemampuan untuk menyelesaikan masalah matematika yang melibatkan elemen visual seperti grafik, diagram geometri, dan figur ilmiah. Menggabungkan pemahaman visual dengan penalaran matematika. Claude Fable 5.1 meraih skor 71.5% pada benchmark ini.
SWE-Bench
58.2%
SWE-Bench: Benchmark Rekayasa Perangkat Lunak. Model AI mencoba menyelesaikan masalah GitHub nyata dalam proyek Python open-source dengan verifikasi manusia. Menguji keterampilan rekayasa perangkat lunak praktis pada codebase produksi. Model terbaik meningkat dari 4,4% di 2023 menjadi lebih dari 70% di 2024. Claude Fable 5.1 meraih skor 58.2% pada benchmark ini.
HumanEval
92.4%
HumanEval: Masalah Pemrograman Python. 164 masalah pemrograman yang ditulis tangan di mana model harus menghasilkan implementasi fungsi Python yang benar. Setiap solusi diverifikasi dengan unit test. Model terbaik sekarang mencapai akurasi lebih dari 90%. Claude Fable 5.1 meraih skor 92.4% pada benchmark ini.
LiveCodeBench
74.8%
LiveCodeBench: Benchmark Koding Langsung. Menguji kemampuan koding pada tantangan pemrograman dunia nyata yang terus diperbarui. Berbeda dengan benchmark statis, menggunakan masalah baru untuk mencegah kontaminasi data dan mengukur keterampilan koding yang sebenarnya. Claude Fable 5.1 meraih skor 74.8% pada benchmark ini.
MMMU
71.2%
MMMU: Pemahaman Multimodal. Benchmark Pemahaman Multimodal Multi-disiplin Masif yang menguji model penglihatan-bahasa pada masalah tingkat universitas di 30 mata pelajaran yang membutuhkan pemahaman gambar dan pengetahuan ahli. Claude Fable 5.1 meraih skor 71.2% pada benchmark ini.
MMMU Pro
58.7%
MMMU Pro: MMMU Edisi Profesional. Versi MMMU yang ditingkatkan dengan pertanyaan lebih sulit dan evaluasi lebih ketat. Menguji penalaran multimodal tingkat lanjut di tingkat profesional dan ahli. Claude Fable 5.1 meraih skor 58.7% pada benchmark ini.
ChartQA
89.2%
ChartQA: Tanya Jawab Grafik. Menguji kemampuan untuk memahami dan bernalar tentang informasi yang disajikan dalam grafik dan diagram. Membutuhkan ekstraksi data, perbandingan nilai, dan melakukan perhitungan dari representasi visual data. Claude Fable 5.1 meraih skor 89.2% pada benchmark ini.
DocVQA
94.1%
DocVQA: Tanya Jawab Visual Dokumen. Benchmark Tanya Jawab Visual Dokumen yang menguji kemampuan untuk mengekstrak dan bernalar tentang informasi dari gambar dokumen termasuk formulir, laporan, dan teks yang dipindai. Claude Fable 5.1 meraih skor 94.1% pada benchmark ini.
Terminal-Bench
55.8%
Terminal-Bench: Tugas Terminal/CLI. Menguji kemampuan untuk melakukan operasi baris perintah, menulis skrip shell, dan menavigasi lingkungan terminal. Mengukur keterampilan administrasi sistem praktis dan alur kerja pengembangan. Claude Fable 5.1 meraih skor 55.8% pada benchmark ini.
ARC-AGI
12.4%
ARC-AGI: Abstraksi dan Penalaran. Abstraction and Reasoning Corpus untuk AGI - menguji kecerdasan fluida melalui teka-teki pengenalan pola baru. Setiap tugas membutuhkan penemuan aturan yang mendasari dari contoh, mengukur kemampuan penalaran umum daripada menghafal. Claude Fable 5.1 meraih skor 12.4% pada benchmark ini.

Tentang Claude Fable 5.1

Pelajari tentang kemampuan, fitur, dan cara menggunakan Claude Fable 5.1.

Tinjauan Arsitektur

Claude Fable 5.1 adalah flagship frontier model buatan Anthropic yang dirancang untuk workflow agentic jangka panjang, software engineering otonom, and riset ilmiah. Model ini meneruskan model Fable 5 asli dengan tetap mempertahankan harga token dasar yang identik serta memperkenalkan pengurangan 75% pada tarif pembacaan prompt cache. Model ini dibangun di atas arsitektur adaptive thinking yang memungkinkannya merencanakan, mengeksekusi, dan mengoreksi diri sendiri di seluruh loop eksekusi multi-langkah tanpa kehilangan context di jendela jutaan tokennya.

Kapabilitas Inti

Dari sisi arsitektur, Fable 5.1 dioptimalkan untuk ketekunan agentic, memungkinkannya menangani tugas yang memakan waktu eksekusi berjam-jam atau berhari-hari, seperti pengembangan aplikasi full-stack atau pemodelan data ilmiah multi-tahap. Model ini menggabungkan pengaman yang disempurnakan yang mengurangi penolakan false-positive pada tugas keamanan teknis dan biologi hingga 60-85%.

Beban Kerja Target

Model ini dirancang untuk developer dan enterprise yang membangun agen otonom di mana keandalan dalam refactoring multi-file dan reasoning tingkat ahli adalah persyaratan utama. Dukungan native vision juga memungkinkannya untuk mem-parsing diagram teknis, mockup UI, dan chart tabel bertingkat secara langsung di dalam codebase.

Claude Fable 5.1

Kasus Penggunaan untuk Claude Fable 5.1

Temukan berbagai cara menggunakan Claude Fable 5.1 untuk hasil yang luar biasa.

Software Engineering Otonom

Menavigasi repositori multi-direktori yang kompleks untuk menemukan kelemahan arsitektur dan mengeksekusi refactor multi-file secara koheren.

Pemodelan Data Ilmiah

Mengotomatiskan parsing data observasi mentah, fitting persamaan diferensial, dan training neural network untuk riset.

Audit Keamanan Defensif

Memeriksa API internal dan source code untuk mengidentifikasi kerentanan software dan menyarankan patch remediasi.

Prototyping UI/UX Visual

Menghasilkan simulasi 3D fungsional, adegan WebGL interaktif, dan kode frontend siap produksi dari deskripsi teks.

Sintesis Pengetahuan Multi-Sumber

Menelan dataset masif dari dokumen SEC, transkrip, dan chart untuk membangun model valuasi keuangan atau analitis yang mendetail.

Orkestrasi Agen Jangka Panjang

Bertindak sebagai pengendali utama untuk workflow asinkron, mendelegasikan sub-tugas ke tool dan memantau progres selama puluhan putaran.

Kelebihan

Keterbatasan

Reasoning Ilmiah Elite: Mencapai 93,7% pada GPQA Diamond dan 55,8% pada Terminal-Bench untuk riset dan otomatisasi teknis.
Harga Premium Tanpa Cache: Harga dasar $10/M input dan $50/M output token membuat panggilan tunggal tanpa cache menjadi mahal.
Kapasitas Agentic Masif: Menyediakan context window 1.000.000 token dan maksimum 128.000 output token untuk eksekusi otonom panjang.
Penyusunan Internal yang Boros Token: Siklus adaptive thinking yang diperpanjang menghabiskan jumlah output token yang tinggi sebelum emisi akhir.
Ekonomi Cache yang Dioptimalkan: Harga pembacaan cache sebesar $0.25/M token mengurangi total biaya operasional pada loop prompt multi-langkah.
Tidak Ada Dukungan Video Native: Model ini memproses gambar statis dan dokumen tetapi tidak dapat menelan file video mentah.
Sistem Keamanan yang Disempurnakan: Mengurangi blok false-positive yang jinak hingga 60% pada tugas cybersecurity defensif dan kerentanan.
Bias Penggantian File Penuh: Cenderung menulis ulang seluruh source code untuk pengeditan sederhana kecuali diinstruksikan secara eksplisit untuk mengeluarkan diff.

Mulai Cepat API

anthropic/claude-fable-5.1

Lihat Dokumentasi
anthropic SDK
import Anthropic from '@anthropic-ai/sdk';

const anthropic = new Anthropic({
  apiKey: process.env.ANTHROPIC_API_KEY,
});

const msg = await anthropic.messages.create({
  model: "claude-fable-5.1",
  max_tokens: 1024,
  messages: [{ role: "user", content: "Analyze this codebase for architectural flaws." }],
});

console.log(msg.content[0].text);

Instal SDK dan mulai melakukan panggilan API dalam hitungan menit.

Apa Kata Orang Tentang Claude Fable 5.1

Lihat apa yang dipikirkan komunitas tentang Claude Fable 5.1

Fable 5.1 adalah model pertama yang benar-benar terasa seperti co-pilot untuk refactor panjang tanpa kehilangan arah di tengah jalan.
DevOpsGuru
reddit
Meskipun model-model sebelumnya menjadi sulit diikuti semakin lama mereka bekerja, Fable 5.1 tetap mudah dipahami dalam tugas multi-langkah yang panjang.
Craig Falls
hackernews
Claude Fable 5.1 sekarang tersedia di Cursor! Ini adalah model paling kapabel yang pernah kami jalankan di CursorBench 3.2, dengan skor 73,4%.
cursor_ai
twitter
Model kelas Mythos Anthropic akhirnya memecahkan masalah agen jangka panjang. Ketekunan Fable 5.1 tidak tertandingi.
HackernewsUser42
hackernews
Fable 5.1 benar-benar luar biasa kawan. Model ini langsung menghabiskan batas penggunaan sesi saya dalam sekali jalan tapi menyelesaikan seluruh migrasi dengan bersih.
TechLeadDev
twitter
Pemotongan harga prompt cache membuat menjalankan loop test-fix berkelanjutan benar-benar layak di production.
VibeCoder
youtube

Video Tentang Claude Fable 5.1

Tonton tutorial, ulasan, dan diskusi tentang Claude Fable 5.1

Fable 5.1 akan menelan biaya sekitar 25% lebih murah daripada Fable 5 untuk beban kerja tipikal

Untuk pekerjaan yang sangat agentic, penghematannya sering kali jauh lebih besar, hingga sekitar 50%

Claude Mythos 5.1 identik dengan Fable 5.1, tetapi menawarkan perlindungan yang lebih permisif untuk individu dan organisasi yang telah diverifikasi

Bayangannya terlihat jauh lebih realistis, fisikanya terasa lebih nyata

diminta untuk melakukannya. Dan yang juga menarik tentang ini adalah kita telah memuji keinginannya atau kemampuannya untuk mendapatkan semua detail kecil dengan benar tanpa Anda meminta. Dan di sinilah entah kenapa hasilnya tidak begitu bagus.

cukup mute mikrofon Anda jika Anda sedang mengetik. Ini kebetulan eh sekitar uh 50% lebih efisien token daripada Opus 5. Ini juga lebih cepat daripada Opus 5. Jadi, jika

dipoles. Um, saya pikir dalam hal masa depan di sini, ada lebih banyak hal yang akan kita jelajahi dalam hal bagaimana kita bisa membuat ini lebih mudah lagi. Saya pikir

Lebih dari sekadar prompt

Tingkatkan alur kerja Anda dengan Otomatisasi AI

Automatio menggabungkan kekuatan agen AI, otomatisasi web, dan integrasi cerdas untuk membantu Anda mencapai lebih banyak dalam waktu lebih singkat.

Agen AI
Otomasi Web
Alur Kerja Cerdas

Tips Pro untuk Claude Fable 5.1

Tips ahli untuk memaksimalkan Claude Fable 5.1.

Maksimalkan Penghematan Cache

Simpan instruksi system dan tree repositori besar di bagian atas prompt Anda untuk memanfaatkan harga pembacaan cache $0.25/M.

Kontrol Effort Eksekusi

Gunakan parameter effort untuk beralih antara 'low' untuk tugas standar dan 'high' untuk debugging kompleks guna menyeimbangkan biaya dan kecepatan.

Prompt untuk Edit yang Ditargetkan

Instruksikan model secara eksplisit untuk memberikan unified diff atau perubahan baris yang ditargetkan agar tidak menulis ulang seluruh file besar.

Dorong Ketekunan Otonom

Dalam loop agentic, sertakan instruksi yang mendorong model untuk menyelesaikan tugas multi-langkah secara langsung alih-alih berhenti meminta izin.

Testimoni

Apa Kata Pengguna Kami

Bergabunglah dengan ribuan pengguna puas yang telah mengubah alur kerja mereka

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Terkait AI Models

openai

GPT-5.5

OpenAI

GPT-5.5 is OpenAI's flagship frontier model with a 1M context window and five reasoning effort levels, optimized for autonomous agentic workflows and coding.

1M context
$5.00/$30.00/1M
xai

Grok-3

xAI

Grok-3 is xAI's flagship reasoning model, featuring deep logic deduction, a 128k context window, and real-time integration with X for live research and coding.

1M context
$3.00/$15.00/1M
moonshot

Kimi K3

Moonshot

Kimi K3 is Moonshot AI's 2.8T MoE model with a 1M token context window, native multimodal vision, and frontier-tier coding performance for complex agents.

1M context
$3.00/$15.00/1M
google

Gemini 3.1 Flash Live Preview

Google

Gemini 3.1 Flash Live Preview is Google's ultra-low-latency, audio-to-audio model featuring a 131K context window, high-fidelity multimodal reasoning, and...

131K context
$0.75/$4.50/1M
anthropic

Claude Opus 4.7

Anthropic

Claude Opus 4.7 is Anthropic's flagship model with a 1-million-token context, adaptive reasoning, and 3.3x vision resolution for enterprise-scale agents.

1M context
$5.00/$25.00/1M
openai

GPT-5.2 Pro

OpenAI

GPT-5.2 Pro is OpenAI's 2025 flagship reasoning model featuring Extended Thinking for SOTA performance in mathematics, coding, and expert knowledge work.

400K context
$21.00/$168.00/1M
google

Gemini 3.1 Pro

Google

Gemini 3.1 Pro is Google's elite multimodal model featuring the DeepThink reasoning engine, a 1M+ context window, and industry-leading ARC-AGI logic scores.

1M context
$2.00/$12.00/1M
alibaba

Qwen 3.7 Max

alibaba

Qwen 3.7 Max is Alibaba’s flagship AI model for deep reasoning and autonomous agent tasks, featuring a 256k context window and top-tier coding performance.

256K context
$1.20/$6.00/1M

Pertanyaan yang Sering Diajukan tentang Claude Fable 5.1

Temukan jawaban untuk pertanyaan umum tentang Claude Fable 5.1