Analisis Menyeluruh Claude Fable 5.1: Tolok Ukur, Peningkatan, Harga, dan Kecepatan

Hasil lengkap Claude Fable 5.1 pada 7 kategori benchmark utama, dibandingkan satu per satu dengan Fable 5, Opus 5, dan GPT-5.6 Sol, serta penjelasan tentang tugas jangka panjang, panggilan alat, biaya cache, kecepatan, batasan paket, dan perubahan migrasi pada 5.1.

PandaNpcPertama diterbitkan pada
Analisis Menyeluruh Claude Fable 5.1: Tolok Ukur, Peningkatan, Harga, dan Kecepatan

Claude Fable 5.1 telah resmi dirilis pada 1 September 2026. Simpulan utama: ini bukan peningkatan model reguler untuk tanya jawab umum, melainkan model unggulan berbiaya tinggi yang disiapkan untuk pemrograman jangka panjang, riset rumit, pemanggilan alat lintas aplikasi, dan Agen tanpa pengawasan. Dalam 7 kategori tolok ukur utama yang diumumkan Anthropic, Fable 5.1 semuanya mengungguli Fable 5; tetapi harga satuan API-nya masih dua kali lipat Opus 5, dan pihak resmi juga menandai latensi relatifnya sebagai "lebih lambat".

Jika tugas Anda hanya mengubah satu file, menulis paragraf pendek, atau menjawab pertanyaan umum, Anthropic tetap menyarankan memulai dari Opus 5. Fable 5.1 lebih cocok untuk tugas berantai panjang yang masih belum dapat diselesaikan secara stabil oleh model biasa bahkan dengan effort tinggi. Artikel ini menyatukan data rilis resmi, makna setiap tolok ukur, peningkatan spesifik 5.1, harga, kecepatan, serta batasan migrasi, agar tidak hanya melihat satu bagan skor "siapa yang menang".

Spesifikasi Fable 5.1 dalam Satu Tabel

Aspek Claude Fable 5.1 Claude Opus 5 Claude Sonnet 5
Jendela konteks 1M token 1M token 1M token
Output maksimum 128K token 128K token 128K token
Harga input $10 / MTok $5 / MTok $2 / MTok
Harga output $50 / MTok $25 / MTok $10 / MTok
Latensi relatif Lebih lambat Sedang Cepat
Thinking Adaptive, selalu aktif Adaptive Adaptive
Effort default High High High
Batas pengetahuan andal Juni 2026 Mei 2026 Januari 2026

"Lebih lambat" di sini berasal dari katalog model Anthropic, yang menunjukkan tingkat latensi relatif, bukan jumlah token per detik yang tetap. Berapa lama waktu yang dibutuhkan untuk menyelesaikan suatu tugas sebenarnya juga bergantung pada effort, jumlah putaran pemanggilan alat, rasio cache hit, panjang konteks, dan berapa kali percobaan ulang setelah kegagalan.

Alur kerja Agen jangka panjang Fable 5.1 dari perencanaan hingga verifikasi
Fable 5.1 tidak ditujukan untuk jawaban sekali jadi, melainkan untuk tugas panjang yang terus-menerus merencanakan, mengeksekusi, memulihkan, memverifikasi, dan melaporkan.

Tabel Lengkap Tolok Ukur Utama Fable 5.1

Tabel di bawah ini langsung mengambil tabel utama dari halaman rilis Anthropic tanggal 1 September 2026. Untuk menghindari salah baca, persentase, skor mentah GDPval-AA, partial/strict OSWorld, serta hasil HLE dengan alat/tanpa alat dicantumkan secara terpisah. Setiap tolok ukur mempertahankan nama resmi bahasa Inggrisnya dan menampilkan nama bahasa Indonesia di baris berikutnya; versi bahasa lain juga akan menampilkan nama terjemahan bahasa terkait di bawah nama Inggrisnya.

Kemampuan Tolok ukur Fable 5.1 Fable 5 Opus 5 GPT-5.6 Sol 5.1 vs Fable 5
Riset ilmiah agen Terminal-Bench-Science 0.1
Tolok ukur terminal riset ilmiah agen
52.6% 24.7% 29.0% 22.4% +27.9 poin persentase
Pemrograman terminal agen Terminal-Bench 4.0
Tolok ukur pemrograman terminal agen
55.8% 42.0% 52.3% 37.3% +13.8 poin persentase
Pekerjaan pengetahuan profesional GDPval-AA v2
Tolok ukur tugas profesional bernilai ekonomi nyata
1853 1723 1824 1711 +130 poin
Operasi komputer OSWorld 2.0 — Partial
Tolok ukur operasi komputer nyata: skor penyelesaian parsial
77.9% 72.9% 75.4% — +5.0 poin persentase
Operasi komputer OSWorld 2.0 — Strict
Tolok ukur operasi komputer nyata: tingkat penyelesaian ketat
41.7% 36.1% 39.6% — +5.6 poin persentase
Penalaran multidisiplin Humanity's Last Exam — No tools
Ujian Terakhir Umat Manusia: tanpa alat
60.9% 57.8% 56.6% — +3.1 poin persentase
Penalaran multidisiplin Humanity's Last Exam — With tools
Ujian Terakhir Umat Manusia: dengan alat
65.0% 63.8% 63.6% — +1.2 poin persentase
Alur kerja bisnis AutomationBench
Tolok ukur alur kerja otomasi bisnis lintas aplikasi
31.4% 17.1% 26.9% 19.6% +14.3 poin persentase
Pemrograman agen CursorBench 3.2.0
Tolok ukur tugas pemrograman multi-file nyata
73.4% 70.5% 70.0% 67.2% +2.9 poin persentase

— berarti tabel utama Anthropic ini tidak menyediakan skor terkait; itu tidak berarti model tersebut tidak dapat menyelesaikan tugas. Pada Terminal-Bench 4.0, Mythos 5.1 yang memiliki lebih sedikit batasan dan hanya tersedia untuk program tepercaya memperoleh skor 60.9%; artikel ini berfokus pada Fable 5.1 yang tersedia bagi pengguna umum dan tidak mencampurkan hasil Mythos ke dalam kolom Fable.

Apa yang Diukur Terminal-Bench-Science 0.1

Terminal-Bench-Science 0.1 mencakup 70 alur kerja riset nyata di lima bidang utama: ilmu hayati, ilmu fisika, ilmu kebumian, matematika, dan teknik. Tugasnya bukan pilihan ganda, melainkan mengharuskan Agen menyelesaikan analisis data, inferensi statistik, simulasi, optimasi, pembuktian teorema, rekonstruksi citra, atau pembelajaran mesin ilmiah di dalam terminal, lalu memeriksa hasilnya dengan pengujian yang dapat direproduksi.

Skor 52.6% milik Fable 5.1 dibandingkan 24.7% milik Fable 5 dalam eksperimen reproduksi resmi merupakan peningkatan 27.9 poin persentase, lompatan paling mencolok di seluruh tabel. Namun, pihak resmi juga menandai galat baku sekitar ±3.5–4.5 poin persentase untuk setiap model, jadi angka satu desimal tidak boleh dianggap sebagai peringkat yang mutlak presisi.

Apa yang Diukur Terminal-Bench 4.0 dan CursorBench 3.2.0

Terminal-Bench membuat Agen menangani tugas kompleks di lingkungan terminal nyata, dengan fokus pada apakah ia dapat memahami lingkungan, memanggil alat, mengubah file, dan akhirnya lolos verifikasi. Fable 5.1 memperoleh 55.8%, lebih tinggi 13.8 poin persentase dari Fable 5, dan juga melampaui Opus 5 yang mencapai 52.3%.

CursorBench 3.2 berasal dari tugas multi-file yang samar dalam sesi Cursor nyata; versi 3.2 menambahkan soal kepatuhan terhadap instruksi dan penggunaan alat tingkat lanjut. Fable 5.1 Max memperoleh 73.4%; selisihnya tidak sebesar Terminal-Bench-Science, tetapi rata-rata memakai 72,060 token dan biaya $9.64 per tugas, sedangkan Fable 5 Max memakai 103,525 token dan $17.32. Yang lebih layak diperhatikan di sini adalah penurunan token dan biaya saat menyelesaikan jenis tugas yang sama, bukan angka 2.9 poin persentase itu sendiri.

Apa yang Diukur GDPval-AA v2

GDPval-AA v2 menggunakan 220 tugas yang dirancang oleh para profesional industri, mencakup 44 jenis pekerjaan dan 9 sektor industri, untuk mengevaluasi kemampuan model dalam menangani pekerjaan pengetahuan nyata yang bernilai ekonomis. Angka 1853 adalah skor gabungan, bukan 1853%. Hasil ini menunjukkan Fable 5.1 mengungguli Fable 5 pada dokumen, analisis, dan deliverables profesional, serta sedikit mengungguli Opus 5.

Mengapa OSWorld 2.0 Memiliki Dua Skor

OSWorld 2.0 memuat 108 alur kerja operasi komputer berantai panjang, dengan median waktu penyelesaian manusia sekitar 1.6 jam per tugas. Partial memberikan skor parsial berdasarkan beberapa titik pemeriksaan (checkpoint); Strict hanya menganggap tugas berhasil bila tujuannya tercapai sepenuhnya.

Jadi 77.9% partial dan 41.7% strict milik Fable 5.1 tidaklah kontradiktif: ia sering mampu menyelesaikan sebagian besar langkah, tetapi masih ada sebagian tugas yang tidak tuntas dari ujung ke ujung. Ini juga mengingatkan kita bahwa "tampak terus-menerus beroperasi" dari Agen komputer tidak sama dengan tugas yang sudah berhasil.

Apa yang Diukur Humanity's Last Exam

Humanity's Last Exam dibuat oleh Center for AI Safety dan Scale AI, berisi 2,500 soal lintas disiplin setingkat ahli yang sulit dijawab hanya dengan pencarian sederhana. Fable 5.1 lebih tinggi 3.1 poin persentase dari Fable 5 dalam kondisi tanpa alat; setelah alat diizinkan, hanya lebih tinggi 1.2 poin persentase. Ia memang lebih kuat, tetapi tidak semua tolok ukur mengalami peningkatan berlipat ganda.

Apa yang Diukur AutomationBench

AutomationBench memeriksa apakah Agen mampu menyelesaikan alur kerja penjualan, pemasaran, operasional, layanan pelanggan, keuangan, dan SDM di berbagai alat SaaS simulasi seperti CRM, email, kalender, pesan, dan manajemen proyek. Peningkatan Fable 5.1 dari 17.1% menjadi 31.4% berarti kenaikan relatif sekitar 84%, menunjukkan bahwa 5.1 mengalami kemajuan nyata dalam pengelolaan status multi-aplikasi dan eksekusi langkah panjang; tetapi 31.4% juga menunjukkan bahwa otomasi bisnis tanpa pengawasan semacam ini masih jauh dari tuntas.

Matriks cakupan kemampuan Fable 5.1 pada tujuh kategori tolok ukur utama
Tujuh kategori tolok ukur masing-masing mencakup riset ilmiah, pemrograman terminal, pekerjaan pengetahuan profesional, operasi komputer, penalaran multidisiplin, proses bisnis, dan pemrograman multi-file.

Apa Saja Peningkatan Fable 5.1 Dibandingkan Fable 5

1. Tugas Jangka Panjang Tidak Mudah Mengambil Jalan Pintas

Anthropic memposisikan Fable 5.1 sebagai model Agen jangka panjang: merencanakan terlebih dahulu, lalu menggunakan alat, memulihkan diri setelah kegagalan, memverifikasi hasil, dan secara proaktif melaporkan kemajuan. Model ini lebih menekankan perbaikan akar masalah daripada melakukan jalan pintas parsial hanya agar satu pengujian cepat berubah hijau. Skenario target yang disebutkan pihak resmi mencakup fitur lintas basis kode, peninjauan kode, optimasi performa, sesi otonom berhari-hari, riset, dokumentasi, spreadsheet, dan slide.

2. Effort Rendah pun Bisa Mendekati Hasil Berbiaya Tinggi Generasi Sebelumnya

Fable 5.1 menambahkan kemampuan untuk menyesuaikan effort per pesan. Kurva biaya resmi menunjukkan bahwa effort Low atau Medium pada sejumlah tugas dapat mencapai atau melampaui Fable 5, sekaligus menurunkan token dan biaya. Claude Code menggunakan High effort secara default; Claude.ai dan Cowork menggunakan Medium secara default. Saat membandingkan model, effort harus dipastikan terlebih dahulu; hasil dari tingkatan yang berbeda tidak boleh langsung disandingkan.

3. Kemajuan yang Dapat Dibaca Bisa Ditampilkan di Antara Pemanggilan Alat

API menambahkan kemampuan uji display: "updates" yang memungkinkan model memberikan pembaruan kemajuan yang ditujukan kepada pengguna di antara pemanggilan alat. Untuk tugas yang berjalan berjam-jam, ini memudahkan untuk menilai apa yang sedang dilakukan model dan apakah ia menyimpang dari tujuan, dibandingkan hanya melihat kartu alat bermunculan terus-menerus.

4. Penulisan, Verifikasi Visual, dan Pengujian Mandiri Lebih Lengkap

Pihak resmi menyatakan 5.1 secara proaktif menulis pengujian untuk memverifikasi perubahannya sendiri dan memanfaatkan kemampuan visual untuk memeriksa keluaran terhadap tujuan desain. Penilaian mitra juga berfokus pada kemajuan yang lebih ringkas, jawaban yang lebih lengkap untuk pertanyaan multi-bagian, pelacakan rantai pemanggilan di berbagai layanan, serta keterbacaan yang tetap terjaga setelah berjalan lama. Ini adalah umpan balik kualitatif dan tidak boleh dianggap sebagai kesimpulan tolok ukur yang seragam.

5. Intersepsi Keamanan Lebih Presisi, tetapi Tidak Hilang

Kesalahan positif palsu pada perlindungan keamanan siber Fable 5.1 berkurang sekitar 60% dibandingkan saat Fable 5 dirilis, dan frekuensi pemicu penurunan layanan (downgrade) pada soal biologi serta kedokteran dasar turun sekitar 85%. Model ini kini dapat digunakan untuk menemukan kerentanan perangkat lunak, tetapi tugas penggunaan ganda seperti pengujian penetrasi, pembuatan kode eksploitasi, dan pemindaian kerentanan biner masih dapat dialihkan ke Opus. Jika dialihkan, biaya tidak dikenakan sesuai harga Fable.

6. Penanda Asal Konten Baru

Fable 5.1 memperkenalkan content provenance. Teks yang dihasilkan dapat membawa tanda air statistik yang bisa diverifikasi melalui alat pemeriksaan konten milik Anthropic. Model ini tidak menambahkan penanda kasatmata pada permukaan teks, tetapi bagi platform konten, pendidikan, dan audit perusahaan, ini adalah perilaku baru yang perlu dipahami lebih dahulu.

Enam peningkatan inti Fable 5.1 dibandingkan generasi sebelumnya
Perubahan pada 5.1 berpusat pada tugas panjang, efisiensi effort rendah, pelaporan kemajuan, verifikasi mandiri, lebih sedikit positif palsu, dan penanda asal konten.

Bagaimana Biaya Fable 5.1 Dihitung

Komponen penagihan Harga Fable 5.1 Perbandingan dengan Fable 5
Input $10 / 1 juta token Sama
Output $50 / 1 juta token Sama
Penulisan cache 5 menit $12.50 / 1 juta token Tingkatan yang sama
Penulisan cache 1 jam $20 / 1 juta token Tingkatan yang sama
Pembacaan cache $0.25 / 1 juta token Turun 75%
Batch API 50% dari harga input dan output Sesuai aturan Batch

Misalkan satu tugas panjang membaca total 10 juta token cache, menghasilkan 200 ribu token input baru dan 50 ribu token output, tanpa memperhitungkan penulisan cache:

text
缓存读取:10 × $0.25 = $2.50
新输入:0.2 × $10 = $2.00
输出:0.05 × $50 = $2.50
合计:$7.00

Pembacaan cache 10 juta token yang sama pada Fable 5 sekitar $10, jadi hanya dari item ini saja selisihnya $7.50. Berdasarkan hal ini, Anthropic memperkirakan biaya aktual tugas berbayar per token yang tipikal dapat turun sekitar 25%, dan untuk tugas yang sangat bersifat agen serta sering menggunakan ulang konteks panjang, penurunannya maksimal sekitar 45%. Ini bukan penurunan harga tercantum API secara menyeluruh, melainkan semakin banyak cache hit, semakin jelas penghematannya.

Pelanggan Berlangganan Belum Tentu Langsung Mendapatkan Penurunan Harga Cache API

Premium seat pada Max serta Team/Enterprise dapat menggunakan hingga 50% dari jatah mingguan untuk model Fable; Pro dan kursi standar sejak awal menggunakan usage credits. Rincian pemakaian aktual mengacu pada halaman Usage di akun. Penurunan harga pembacaan cache terutama merupakan perubahan pada skenario penagihan per token; penurunan harga cache API sebesar 75% tidak dapat langsung dikonversi menjadi "paket Max jadi empat kali lebih banyak".

Struktur biaya input, output, dan cache Fable 5.1
Harga satuan input-output Fable 5.1 tidak berubah; penurunan harga utama berasal dari pembacaan cache. Semakin banyak konteks panjang digunakan ulang, semakin besar manfaatnya.

Sebenarnya Cepat atau Tidak Fable 5.1

Jawabannya: respons satu putaran cenderung lebih lambat, tetapi total waktu penyelesaian tugas kompleks bisa lebih singkat.

  • Katalog model Anthropic menandai Fable 5.1 sebagai Slower, Opus 5 sebagai Moderate, dan Sonnet 5 sebagai Fast.
  • Claude Code menggunakan High effort secara default, yang secara alami memakai lebih banyak waktu penalaran dibandingkan Low atau Medium.
  • Every menyebutkan pada beban kerja mereka sendiri bahwa Fable 5.1 sekitar dua kali lebih cepat dari Opus 5 dan memakai separuh token; ini adalah pengujian spesifik dari mitra, bukan jaminan kecepatan umum.
  • Pada CursorBench, Fable 5.1 Max rata-rata 70 langkah dan 72,060 token; Fable 5 Max juga 72 langkah tetapi memakai 103,525 token. Keunggulan 5.1 lebih mirip "lebih sedikit memutar, lebih sedikit menghabiskan token" dan tidak selalu tampak sebagai waktu hingga token pertama yang lebih cepat.

Oleh karena itu, untuk obrolan, kode pendek, dan interaksi yang sering, prioritaskan Sonnet 5 atau Opus 5; untuk penelusuran kesalahan lintas basis kode, riset panjang, dan tugas tanpa pengawasan yang perlu memverifikasi sendiri, barulah pertimbangkan Fable 5.1.

Perubahan Kompatibilitas yang Wajib Ditangani Sebelum Upgrade ke Fable 5.1

Upgrade Claude Code Minimal ke Versi 2.1.250

Penjelasan paket dan ketersediaan dari Anthropic mensyaratkan Claude Code 2.1.250 atau lebih baru. Jika Fable 5.1 tidak terlihat, periksa dulu:

bash
claude --version

Lalu perbarui dengan cara upgrade resmi Claude Code, kemudian mulai ulang sesi. ID model API untuk Fable 5.1 adalah:

text
claude-fable-5-1

Forced Tool Use Berpotensi Langsung Error

Jika permintaan memaksa model untuk memanggil alat tertentu, Fable 5.1 dapat mengembalikan error. Sebelum migrasi, periksa tool_choice dan alur pemaksaan alat pada Agen yang Anda bangun sendiri; jangan berasumsi perilaku Fable 5 sepenuhnya kompatibel.

Blok Thinking Tidak Boleh Dipakai Ulang Sembarangan lintas Model

Model yang lebih lama tidak dapat membaca thinking blocks milik Fable 5.1. Saat berpindah model, biarkan SDK menangani blok-blok ini sesuai aturan resmi, jangan menyodorkannya apa adanya ke model lain.

Mengubah Riwayat Lama Dapat Menyebabkan Error 400

Untuk akun API baru yang dibuat setelah 31 Agustus 2026, thinking blocks hanya valid dalam prefiks percakapan asli tempat blok tersebut dibuat. Memutar ulang thinking blocks setelah mengubah system, tools, atau pesan yang lebih lama dapat mengembalikan 400. Pihak resmi menyarankan agar riwayat bersifat append-only; jika perlu diringkas, ganti seluruh riwayat lama dengan satu ringkasan baru, jangan mengubah putaran lama sambil tetap mempertahankan thinking blocks aslinya. Mode terperinci lihat Panduan prompt dan migrasi Fable 5.1.

Kapan Sebaiknya Memilih Fable 5.1

Cocok untuk:

  • Tugas panjang yang melintasi banyak repositori, layanan, atau aplikasi;
  • Agen yang perlu berjalan berjam-jam dan memulihkan diri sendiri dari kegagalan;
  • Riset ilmiah, analisis data kompleks, dan deliverables profesional bertahap;
  • Masalah sistem yang sulit direproduksi, optimasi performa, dan investigasi akar masalah;
  • Beban kerja API dengan banyak penggunaan ulang konteks panjang dan porsi pembacaan cache yang tinggi.

Tidak cocok untuk:

  • Obrolan sederhana, teks pendek, atau perubahan kecil pada satu file;
  • Interaksi real-time yang sangat sensitif terhadap latensi token pertama;
  • Tugas beroutput besar dengan anggaran tetap tetapi tanpa penggunaan ulang cache;
  • Skenario yang tidak dapat menerima retensi data pemantauan keamanan default 30 hari dan tidak memenuhi ketentuan pengecualian perusahaan;
  • Alur kerja yang menginginkan semua permintaan keamanan siber atau ilmu hayati tidak memicu penurunan layanan.

Cara Memantau Tugas Panjang dari Jarak Jauh

Nilai Fable 5.1 sering muncul pada tugas yang berlangsung berjam-jam bahkan berhari-hari, tetapi itu tidak berarti seseorang harus terus-menerus menjaga mesin pengembangan. Pastikan dulu Fable 5.1 tersedia di Claude Code 2.1.250+ pada mesin lokal, lalu melalui PandaNpc Agent lihat sesi Claude Code di mesin pengembangan yang sama dari peramban, desktop, atau ponsel, tangani interaksi, dan lanjutkan memberikan perintah.

Yang berubah di sini hanyalah titik masuk kontrol; kode, alat, dan proses build tetap berjalan di mesin pengembangan Anda. Anda dapat membaca dulu Panduan akses jarak jauh Claude Code dan Tutorial menghubungkan ponsel ke Claude Code, lalu serahkan tugas panjang kepada Fable 5.1 setelah jalur jarak jauh dipastikan berfungsi.

FAQ: Pertanyaan yang Sering Diajukan

Seberapa Unggul Fable 5.1 Dibandingkan Fable 5?

Perbedaannya sangat bervariasi antar tugas. Terminal-Bench-Science naik 27.9 poin persentase, AutomationBench naik 14.3 poin persentase; pada HLE dengan penggunaan alat hanya naik 1.2 poin persentase. Peningkatan terbesar tunggal tidak dapat mewakili semua tugas.

Apakah Fable 5.1 Lebih Cepat dari Opus 5?

Dalam tabel latensi relatif resmi, Fable 5.1 termasuk "lebih lambat" dan Opus 5 "sedang". Sebagian mitra mengamati Fable 5.1 lebih cepat pada keseluruhan tugas karena memakai lebih sedikit token dan lebih sedikit pengerjaan ulang. Kedua kesimpulan ini tidak mengukur hal yang sama.

Apakah Fable 5.1 Lebih Cocok untuk Pemrograman daripada GPT-5.6 Sol?

Dalam tabel rilis Anthropic, Fable 5.1 lebih tinggi pada Terminal-Bench-Science, Terminal-Bench, AutomationBench, dan CursorBench; tetapi model yang berbeda menggunakan harness Agen, effort, alat, dan harga yang berbeda, sehingga hal ini tidak dapat dijadikan dasar untuk menyatakan bahwa semua repositori nyata dimenangkan Fable. Anda dapat merujuk Tutorial konfigurasi konteks 1M GPT-5.6 Sol, lalu melakukan pengujian A/B dengan tugas representatif Anda sendiri.

Mengapa Fable 5.1 Tiba-tiba Berpindah ke Opus?

Sebagian permintaan keamanan siber dan ilmu hayati akan dirutekan ke Opus oleh safeguards. Perpindahan model tidak selalu berarti gangguan; Anthropic menyatakan permintaan yang dialihkan semacam ini tidak ditagih dengan harga Fable.

Apakah Fable 5.1 Memiliki Tanda Air?

Ada mekanisme content provenance yang bersifat statistik, tetapi tidak menambahkan label kasatmata pada permukaan teks. Ini tidak sama dengan tanda air terlihat di sudut gambar.

Ringkasan

Kemajuan paling jelas Claude Fable 5.1 terkonsentrasi pada riset ilmiah, tugas terminal, dan alur kerja bisnis lintas aplikasi: model ini lebih mampu mengeksekusi secara berkelanjutan, memulihkan kegagalan, memverifikasi hasil, dan juga menurunkan biaya tugas panjang melalui pembacaan cache yang lebih murah. Namun, harganya tetap mahal, latensi satu putaran cenderung lebih lambat, dan membawa perubahan kompatibilitas terkait thinking blocks, pemaksaan pemanggilan alat, serta pengeditan riwayat.

Pertanyaan yang tepat untuk memilihnya bukanlah "apakah ia peringkat pertama dalam skor", melainkan: apakah tugas Anda cukup panjang, cukup kompleks, dan apakah biaya kegagalan serta pengerjaan ulang cukup tinggi sehingga layak menggunakan Fable 5.1. Jika jawabannya tidak, memulai dari Opus 5 atau Sonnet 5 biasanya lebih tepat.