Claude Fable 5.1:n kattava analyysi: vertailuarvot, parannukset, hinta ja nopeus

Claude Fable 5.1:n täydet tulokset seitsemässä keskeisessä benchmarkissa, yksityiskohtainen vertailu Fable 5:een, Opus 5:een ja GPT-5.6 Soliin, sekä kuvaus 5.1:n pitkistä tehtävistä, työkalujen kutsuista, välimuistikustannuksista, nopeudesta, pakettirajoituksista ja siirtymämuutoksista.

PandaNpcJulkaistu ensimmäisen kerran
Claude Fable 5.1:n kattava analyysi: vertailuarvot, parannukset, hinta ja nopeus

Claude Fable 5.1 julkaistiin virallisesti 1. syyskuuta 2026. Sanotaan heti alkuun: kyseessä ei ole tavallinen mallipäivitys tavalliseen kysymys–vastaus-käyttöön, vaan kallis lippulaivamalli, joka on suunniteltu pitkäkestoiseen ohjelmointiin, monimutkaiseen tutkimukseen, sovellusten välisiin työkalukutsuihin ja valvomattomiin agentteihin. Kaikissa seitsemässä keskeisessä vertailuarvossa, jotka Anthropic on julkaissut, Fable 5.1 ylittää Fable 5:n; mutta sen API-yksikköhinta on silti kaksi kertaa Opus 5:n hinta, ja virallisesti sen suhteellinen viive on merkitty ”hitaammaksi”.

Jos tehtäväsi on vain muuttaa yhtä tiedostoa, kirjoittaa lyhyt teksti tai vastata tavallisiin kysymyksiin, Anthropic suosittelee edelleen aloittamista Opus 5:stä. Fable 5.1 sopii paremmin pitkäketjuisiin tehtäviin, joita tavalliset mallit eivät pysty suorittamaan vakaasti edes korkealla effort-tasolla. Tässä artikkelissa viralliset julkaisutiedot, kunkin vertailuarvon merkitys, 5.1:n konkreettiset parannukset, hinta, nopeus ja siirtymärajoitukset on koottu yhteen, jotta katse ei jäisi vain yhteen ”kuka voitti” -tuloskaavioon.

Fable 5.1:n tekniset tiedot yhdellä silmäyksellä

Ominaisuus Claude Fable 5.1 Claude Opus 5 Claude Sonnet 5
Konteksti-ikkuna 1M tokenia 1M tokenia 1M tokenia
Suurin lähtömäärä 128K tokenia 128K tokenia 128K tokenia
Syötteen hinta $10 / MTok $5 / MTok $2 / MTok
Lähdön hinta $50 / MTok $25 / MTok $10 / MTok
Suhteellinen viive Hitaampi Keskitasoa Nopea
Thinking Adaptive, aina päällä Adaptive Adaptive
Oletus-effort High High High
Luotettavan tiedon katkaisu kesäkuu 2026 toukokuu 2026 tammikuu 2026

Tässä mainittu ”hitaampi” on peräisin Anthropicin malliluettelosta, ja se tarkoittaa suhteellista viivetasoa, ei kiinteää token-määrää sekunnissa. Se, kuinka kauan tehtävän suorittaminen todellisuudessa kestää, riippuu myös effort-tasosta, työkalukutsukierrosten määrästä, välimuistin osumasuhteesta, kontekstin pituudesta ja epäonnistuneiden uudelleenyritysten määrästä.

Fable 5.1:n pitkäkestoinen agenttityönkulku suunnittelusta todentamiseen
Fable 5.1 ei ole tarkoitettu kertakäyttöisiin vastauksiin, vaan pitkiin tehtäviin, joissa suunnitellaan, suoritetaan, palaudutaan virheistä, todennetaan ja raportoidaan jatkuvasti.

Fable 5.1:n keskeisten vertailuarvojen täydellinen taulukko

Alla oleva taulukko on suoraan Anthropicin 1. syyskuuta 2026 julkaiseman sivun päätaulukko. Väärinkäsitysten välttämiseksi prosenttiosuudet, GDPval-AA:n raakapisteet, OSWorldin partial- ja strict-tulokset sekä HLE:n tulokset työkaluilla ja ilman työkaluja on eritelty omille riveilleen. Kunkin vertailuarvon virallinen englanninkielinen nimi on säilytetty, ja suomenkielinen nimi on merkitty seuraavalle riville.

Osaamisalue Vertailuarvo Fable 5.1 Fable 5 Opus 5 GPT-5.6 Sol 5.1 verrattuna Fable 5:een
Agenttivetoinen tieteellinen tutkimus Terminal-Bench-Science 0.1
Agenttivetoisen tieteellisen tutkimuksen päätevertailuarvo
52,6 % 24,7 % 29,0 % 22,4 % +27,9 prosenttiyksikköä
Agenttivetoinen pääteohjelmointi Terminal-Bench 4.0
Agenttivetoisen pääteohjelmoinnin vertailuarvo
55,8 % 42,0 % 52,3 % 37,3 % +13,8 prosenttiyksikköä
Ammatillinen tietotyö GDPval-AA v2
Todellisen taloudellisen arvon ammatillisten tehtävien vertailuarvo
1853 1723 1824 1711 +130 pistettä
Tietokoneen käyttö OSWorld 2.0 — Partial
Todellisen tietokoneen käytön vertailuarvo: osittaisen suorituksen pisteet
77,9 % 72,9 % 75,4 % — +5,0 prosenttiyksikköä
Tietokoneen käyttö OSWorld 2.0 — Strict
Todellisen tietokoneen käytön vertailuarvo: tiukka suoritusaste
41,7 % 36,1 % 39,6 % — +5,6 prosenttiyksikköä
Monitieteinen päättely Humanity's Last Exam — No tools
Ihmiskunnan viimeinen tentti: ilman työkaluja
60,9 % 57,8 % 56,6 % — +3,1 prosenttiyksikköä
Monitieteinen päättely Humanity's Last Exam — With tools
Ihmiskunnan viimeinen tentti: työkalujen kanssa
65,0 % 63,8 % 63,6 % — +1,2 prosenttiyksikköä
Liiketoiminnan työnkulut AutomationBench
Sovellusten välisten liiketoiminnan automaatiotyönkulkujen vertailuarvo
31,4 % 17,1 % 26,9 % 19,6 % +14,3 prosenttiyksikköä
Agenttivetoinen ohjelmointi CursorBench 3.2.0
Todellisten monitiedostoisten ohjelmointitehtävien vertailuarvo
73,4 % 70,5 % 70,0 % 67,2 % +2,9 prosenttiyksikköä

— tarkoittaa, että Anthropicin päätaulukossa ei ole annettu vastaavaa tulosta, ei sitä, etteikö malli pystyisi suorittamaan tehtävää. Terminal-Bench 4.0:ssa Mythos 5.1, jolla on vähemmän rajoituksia ja joka on avoin vain luotetulle ohjelmalle, sai 60,9 %; tämä artikkeli keskittyy tavallisten käyttäjien käytettävissä olevaan Fable 5.1:een, eikä Mythosin tuloksia sekoiteta Fable-sarakkeeseen.

Mitä Terminal-Bench-Science 0.1 mittaa?

Terminal-Bench-Science 0.1 sisältää 70 todellista tutkimustyönkulkua viideltä pääalueelta: elämäntieteet, fysikaaliset tieteet, maatieteet, matematiikka ja tekniikka. Tehtävät eivät ole monivalintakysymyksiä, vaan agentin on suoritettava päätteessä data-analyysiä, tilastollista päättelyä, simulointia, optimointia, lauseiden todistamista, kuvien rekonstruointia tai tieteellistä koneoppimista ja tarkistettava tuotokset toistettavilla testeillä.

Fable 5.1:n 52,6 % verrattuna Fable 5:n 24,7 %:iin virallisissa toistokokeissa on 27,9 prosenttiyksikön parannus, joka on koko taulukon selvimmin erottuva harppaus. Virallisesti on kuitenkin ilmoitettu kunkin mallin keskivirheeksi noin ±3,5–4,5 prosenttiyksikköä, joten yhtä desimaalia ei pidä tulkita ehdottoman tarkkana sijoituksena.

Mitä Terminal-Bench 4.0 ja CursorBench 3.2.0 mittaavat?

Terminal-Bench antaa agentin käsitellä monimutkaisia tehtäviä aidossa pääteympäristössä, ja keskeistä on, ymmärtääkö se ympäristöä, kutsuuko se työkaluja, muokkaako se tiedostoja ja läpäiseekö se lopulta todennuksen. Fable 5.1 sai 55,8 %, mikä on 13,8 prosenttiyksikköä enemmän kuin Fable 5:llä ja myös enemmän kuin Opus 5:n 52,3 %.

CursorBench 3.2 on peräisin oikeiden Cursor-istuntojen epäselvistä, monitiedostoisista tehtävistä; versio 3.2 lisäsi ohjeiden noudattamista ja edistyneiden työkalujen käyttöä mittaavia tehtäviä. Fable 5.1 Max saa 73,4 %, eikä ero ole yhtä dramaattinen kuin Terminal-Bench-Sciencessä, mutta se käyttää keskimäärin 72 060 tokenia tehtävää kohden ja maksaa 9,64 dollaria; Fable 5 Max käyttää 103 525 tokenia ja maksaa 17,32 dollaria. Tässä kiinnostavampaa on tokenien ja kustannusten väheneminen samankaltaisia tehtäviä suoritettaessa kuin itse 2,9 prosenttiyksikköä.

Mitä GDPval-AA v2 mittaa?

GDPval-AA v2 käyttää 220:aa alan ammattilaisten suunnittelemaa tehtävää, jotka kattavat 44 ammattia ja 9 toimialaa, ja arvioi mallin kykyä käsitellä todellista, taloudellisesti arvokasta tietotyötä. Sen 1853 on kokonaispistemäärä, ei 1853 %. Tulos osoittaa, että Fable 5.1 ylittää Fable 5:n ammattimaisissa asiakirjoissa, analyyseissä ja tuotoksissa ja ylittää myös Opus 5:n hieman.

Miksi OSWorld 2.0 antaa kaksi pistemäärää?

OSWorld 2.0 sisältää 108 pitkäkestoista tietokoneen käytön työnkulkua, ja kunkin tehtävän ihmisen suoritusajan mediaani on noin 1,6 tuntia. Partial antaa osittaisen suorituksen pisteitä useiden tarkistuspisteiden perusteella; Strict merkitsee onnistumiseksi vain täyden tavoitteen saavuttamisen.

Siksi Fable 5.1:n 77,9 %:n partial-tulos ja 41,7 %:n strict-tulos eivät ole ristiriidassa: se suorittaa usein suurimman osan vaiheista, mutta osa tehtävistä ei silti valmistu päästä päähän. Tämä muistuttaa myös siitä, että tietokoneagentin ”näyttää koko ajan toimivalta” ei tarkoita, että tehtävä olisi onnistunut.

Mitä Humanity's Last Exam mittaa?

Humanity's Last Exam on luonut Center for AI Safety yhdessä Scale AI:n kanssa, ja se sisältää 2 500 monialaista asiantuntijatason kysymystä, joihin on vaikea vastata yksinkertaisella haulla. Fable 5.1 on ilman työkaluja 3,1 prosenttiyksikköä Fable 5:tä korkeampi; kun työkaluja saa käyttää, ero on vain 1,2 prosenttiyksikköä. Se on todellakin vahvempi, mutta kaikki vertailuarvot eivät osoita kaksinkertaista kasvua.

Mitä AutomationBench mittaa?

AutomationBench tarkistaa, pystyykö agentti suorittamaan myynnin, markkinoinnin, operatiivisen toiminnan, asiakaspalvelun, talouden ja henkilöstöhallinnon työnkulkuja simuloitujen SaaS-työkalujen, kuten CRM:n, sähköpostin, kalenterin, viestien ja projektinhallinnan, välillä. Fable 5.1 parani 17,1 %:sta 31,4 %:iin, mikä on noin 84 %:n suhteellinen parannus. Tämä osoittaa, että 5.1 on edistynyt olennaisesti monisovellustilojen hallinnassa ja pitkävaiheisten tehtävien suorittamisessa; mutta 31,4 % osoittaa myös, että tällainen valvomaton liiketoiminnan automaatio on edelleen kaukana ratkaistusta.

Fable 5.1:n osaamisen kattavuusmatriisi seitsemässä keskeisessä vertailuarvossa
Seitsemän vertailuarvoa kattavat tieteellisen tutkimuksen, pääteohjelmoinnin, ammatillisen tietotyön, tietokoneen käytön, monitieteisen päättelyn, liiketoimintaprosessit ja monitiedostoisen ohjelmoinnin.

Mitä parannuksia Fable 5.1 tuo Fable 5:een verrattuna

1. Pitkäkestoisissa tehtävissä ei yhtä helposti oikaista

Anthropic asemoi Fable 5.1:n pitkän aikajänteen agenttimalliksi: ensin suunnitellaan, sitten käytetään työkaluja, virheistä palaudutaan, tulokset todennetaan ja edistymisestä raportoidaan aktiivisesti. Se painottaa perimmäisen syyn korjaamista sen sijaan, että se tekisi paikallisia kiertoteitä vain saadakseen yksittäisen testin vihreäksi mahdollisimman nopeasti. Virallisesti listattuja kohdeskenaarioita ovat koodikantojen väliset toiminnallisuudet, koodikatselmointi, suorituskyvyn optimointi, usean päivän autonomiset istunnot, tutkimus, asiakirjat, laskentataulukot ja diat.

2. Matalalla effortilla päästään lähelle edellisen sukupolven kalliita tuloksia

Fable 5.1 tuo kyvyn säätää effort-tasoa viestikohtaisesti. Viralliset kustannuskäyrät osoittavat, että Low- tai Medium-effort voi joissakin tehtävissä yltää Fable 5:n tasolle tai sen yli ja samalla vähentää tokeneita ja kustannuksia. Claude Code käyttää oletuksena High-effortia; Claude.ai ja Cowork käyttävät oletuksena Mediumia. Malleja vertailtaessa effort-taso on ensin varmistettava, eikä eri tasojen tuloksia voi suoraan verrata keskenään.

3. Työkalukutsujen välillä voidaan näyttää luettavaa edistymistä

API sai uuden kokeellisen ominaisuuden display: "updates", jonka avulla malli voi antaa käyttäjälle suunnattuja edistymispäivityksiä työkalukutsujen välillä. Tuntikausia kestävässä tehtävässä tämä auttaa hahmottamaan, mitä malli on tekemässä ja onko se ajautumassa pois tavoitteesta, paremmin kuin pelkät jatkuvasti ilmestyvät työkalu-kortit.

4. Kirjoittaminen, visuaalinen todentaminen ja itse testaaminen ovat kattavampia

Virallisen kuvauksen mukaan 5.1 kirjoittaa aktiivisesti testejä omien muutostensa todentamiseksi ja käyttää visuaalisia kykyjään tarkistaakseen tuotokset suunnittelutavoitteita vasten. Kumppaneiden arvioissa korostuvat myös tiiviimpi edistymisraportointi, moniosaisten kysymysten kattavampi käsittely, kutsuketjujen seuraaminen useiden palveluiden välillä sekä luettavuuden säilyminen pitkän toiminnan jälkeen. Nämä ovat laadullista palautetta, eikä niitä pidä esittää yhtenäisinä vertailuarvojohtopäätöksinä.

5. Turvallisuusrajaukset tarkentuivat, mutta eivät poistuneet

Fable 5.1:n kyberturvallisuutta koskevat suojatoimet tuottavat noin 60 % vähemmän vääriä hälytyksiä kuin Fable 5:n julkaisun aikaan, ja perustason biologiaa ja lääketiedettä koskevat kysymykset johtavat noin 85 % harvemmin siihen, että pyyntö ohjataan rajoitetumpaan malliin. Sitä voidaan nyt käyttää ohjelmistohaavoittuvuuksien löytämiseen, mutta kaksikäyttötehtävät, kuten penetraatiotestaus, hyödyntämiskoodin tuottaminen ja binäärihaavoittuvuuksien skannaus, voidaan edelleen ohjata Opus-malliin. Näin ohjattuja pyyntöjä ei laskuteta Fable-hinnoittelulla.

6. Uusi sisällön alkuperän merkintä

Fable 5.1 ottaa käyttöön content provenance -mekanismin. Tuotettu teksti voi sisältää tilastollisen vesileiman, joka voidaan todentaa Anthropicin sisällöntarkistustyökalulla. Se ei lisää näkyviä merkintöjä itse tekstiin, mutta sisältöalustoille, koulutukseen ja yritysten auditointeihin tämä on uusi käytäntö, joka kannattaa tuntea etukäteen.

Fable 5.1:n kuusi keskeistä parannusta edelliseen sukupolveen verrattuna
5.1:n muutokset keskittyvät pitkiin tehtäviin, matalan effortin tehokkuuteen, edistymisraportointiin, itse todentamiseen, vähäisempiin vääriin hälytyksiin ja sisällön alkuperän merkintöihin.

Miten Fable 5.1:n kustannukset lasketaan?

Laskutuskohde Fable 5.1:n hinta Verrattuna Fable 5:een
Syöte $10 / miljoona tokenia Sama
Lähtö $50 / miljoona tokenia Sama
5 minuutin välimuistin kirjoitus $12,50 / miljoona tokenia Sama taso
1 tunnin välimuistin kirjoitus $20 / miljoona tokenia Sama taso
Välimuistin luku $0,25 / miljoona tokenia 75 % alhaisempi
Batch API 50 % syötteen ja lähdön hinnasta Batch-sääntöjen mukaan

Oletetaan, että pitkä tehtävä lukee yhteensä 10 miljoonaa välimuistista tokenia, tuottaa 200 000 uutta syöttötokenia ja 50 000 lähtötokenia, eikä välimuistin kirjoituksia oteta huomioon:

text
缓存读取:10 × $0.25 = $2.50
新输入:0.2 × $10 = $2.00
输出:0.05 × $50 = $2.50
合计:$7.00

Vastaavasti 10 miljoonan tokenin lukeminen välimuistista maksaa Fable 5:llä noin 10 dollaria, joten pelkästään tässä erässä on 7,50 dollarin ero. Tämän perusteella Anthropic arvioi, että tyypillisen token-perusteisesti laskutettavan tehtävän todellista kustannusta voidaan alentaa noin 25 %, ja erittäin agenttivetoisissa tehtävissä, joissa pitkää kontekstia käytetään toistuvasti uudelleen, alennus voi olla enintään noin 45 %. Tämä ei ole API-hinnaston yleinen alennus, vaan mitä enemmän välimuistiosumia, sitä selvemmät säästöt.

Tilaajat eivät välttämättä hyödy suoraan API:n välimuistin hinnanalennuksesta

Max- sekä Team/Enterprise-pakettien premium-paikat voivat käyttää enintään 50 % viikoittaisesta kiintiöstään Fable-malleihin; Pro ja tavalliset paikat käyttävät alusta alkaen usage credits -hyvityksiä. Tarkat kulutustiedot näkyvät tilin Usage-sivulla. Välimuistin luvun hinnanalennus koskee pääasiassa token-perusteista laskutusta, eikä API:n 75 %:n välimuistialennusta voi suoraan tulkita niin, että Max-paketilla saisi neljä kertaa enemmän.

Fable 5.1:n syötteen, lähdön ja välimuistin kustannusrakenne
Fable 5.1:n syötteen ja lähdön yksikköhinnat eivät muuttuneet; pääasiallinen hinnanalennus tulee välimuistin luvusta, ja mitä enemmän pitkää kontekstia käytetään uudelleen, sitä enemmän siitä hyötyy.

Onko Fable 5.1 oikeasti nopea?

Vastaus on: yksittäisen kierroksen vaste on hitaahko, mutta monimutkaisen tehtävän kokonaissuoritusaika voi olla lyhyempi.

  • Anthropicin malliluettelossa Fable 5.1 on merkitty luokkaan Slower, Opus 5 luokkaan Moderate ja Sonnet 5 luokkaan Fast.
  • Claude Code käyttää oletuksena High-effortia, joka luonnollisesti kuluttaa enemmän päättelyaikaa kuin Low tai Medium.
  • Every kertoo omissa työkuormissaan Fable 5.1:n olevan noin kaksi kertaa nopeampi kuin Opus 5 ja käyttävän puolet vähemmän tokeneita; tämä on kumppanin tekemä testi, ei yleinen nopeustakuu.
  • CursorBenchissä Fable 5.1 Max suorittaa keskimäärin 70 vaihetta ja kuluttaa 72 060 tokenia; Fable 5 Max tekee samat 72 vaihetta, mutta kuluttaa 103 525 tokenia. 5.1:n etu on ennemminkin ”vähemmän harhapolkuja ja vähemmän token-kulutusta”, eikä se välttämättä näy ensimmäisen tokenin nopeutena.

Siksi chat-käytössä, lyhyessä koodissa ja tiheässä vuorovaikutuksessa kannattaa valita ensisijaisesti Sonnet 5 tai Opus 5; koodikantojen väliseen vianetsintään, pitkiin tutkimuksiin ja valvomattomiin tehtäviin, jotka vaativat omaa todentamista, kannattaa harkita Fable 5.1:tä.

Yhteensopivuusmuutokset, jotka on hoidettava ennen Fable 5.1:een päivittämistä

Päivitä Claude Code vähintään versioon 2.1.250

Anthropicin paketti- ja saatavuusseloste edellyttää Claude Code -versiota 2.1.250 tai uudempaa. Jos Fable 5.1 ei näy, tarkista ensin:

bash
claude --version

Päivitä sitten Claude Code virallisella päivitystavalla ja käynnistä istunto uudelleen. Fable 5.1:n API-mallitunnus on:

text
claude-fable-5-1

Pakotettu työkalukutsu (forced tool use) voi aiheuttaa virheen

Jos pyyntö pakottaa mallin kutsumaan tiettyä työkalua, Fable 5.1 voi palauttaa virheen. Ennen siirtymistä on tarkistettava tool_choice ja itse rakennetun agentin pakotetun työkalun käytön prosessit – Fable 5:n toimintaa ei pidä olettaa täysin yhteensopivaksi.

Thinking-lohkoja ei voi siirtää vapaasti mallien välillä

Aikaisemmat mallit eivät osaa lukea Fable 5.1:n thinking-lohkoja. Mallia vaihdettaessa SDK:n tulee käsitellä nämä lohkot virallisten sääntöjen mukaisesti, eikä niitä saa syöttää sellaisenaan toiselle mallille.

Vanhan historian muokkaaminen voi aiheuttaa 400-virheen

Uusilla API-tileillä, jotka on luotu 31. elokuuta 2026 jälkeen, thinking-lohkot ovat voimassa vain siinä alkuperäisessä keskustelun etuliitteessä, jossa ne on luotu. Jos system-, tools- tai aikaisempia viestejä muutetaan ja thinking-lohkoja toistetaan tämän jälkeen, seurauksena voi olla 400-virhe. Virallinen suositus on pitää historia append-only -periaatteella; kun historiaa täytyy tiivistää, koko vanha historia korvataan yhdellä uudella yhteenvedolla, eikä vanhoja kierroksia saa muokata samalla kun alkuperäiset thinking-lohkot säilytetään. Yksityiskohtaiset ohjeet ovat Fable 5.1:n kehote- ja siirtymäoppaassa.

Milloin Fable 5.1 kannattaa valita?

Sopii:

  • pitkäkestoiset tehtävät, jotka ulottuvat useiden repositorioiden, palveluiden tai sovellusten yli;
  • agentit, joiden täytyy toimia tunteja ja palautua virheistä itsenäisesti;
  • tieteellinen tutkimus, monimutkainen data-analyysi ja monivaiheiset ammatilliset tuotokset;
  • vaikeasti toistettavat järjestelmäongelmat, suorituskyvyn optimointi ja perimmäisen syyn selvittäminen;
  • API-työkuormat, joissa pitkää kontekstia käytetään runsaasti uudelleen ja välimuistin lukemisen osuus on suuri.

Ei sovi:

  • yksinkertainen chat, lyhyet tekstit tai pienet yksittäisen tiedoston muutokset;
  • reaaliaikainen vuorovaikutus, joka on erittäin herkkä ensimmäisen tokenin viiveelle;
  • suuren lähtömäärän tehtävät, joilla on kiinteä budjetti mutta ei välimuistin uudelleenkäyttöä;
  • tilanteet, joissa oletusarvoista 30 päivän turvallisuusseurantadatan säilytystä ei voida hyväksyä ja jotka eivät täytä yritysten poikkeusehtoja;
  • työnkulut, joissa halutaan, ettei yksikään kyberturvallisuuteen tai elämäntieteisiin liittyvä pyyntö laukaise siirtymistä rajoitetumpaan malliin.

Pitkäkestoisten tehtävien etäseuranta

Fable 5.1:n arvo tulee esiin usein tunteja tai jopa päiviä kestävissä tehtävissä, mutta se ei tarkoita, että kehittäjän on istuttava koko ajan kehityskoneen ääressä. Varmista ensin, että Fable 5.1 on käytettävissä paikallisessa Claude Code 2.1.250+:ssa, ja tarkastele sitten PandaNpc Agentin avulla saman kehityskoneen Claude Code -istuntoja selaimesta, työpöydältä tai puhelimesta, käsittele vuorovaikutuksia ja jatka komentojen antamista.

Tässä muuttuu vain hallinnan tulopiste; koodi, työkalut ja buildit toimivat edelleen kehityskoneellasi. Lue ensin Claude Coden etäkäyttöopas ja Claude Coden puhelinkäyttöopas, ja kun etäyhteys on varmistettu, voit uskoa pitkän tehtävän Fable 5.1:lle.

Usein kysytyt kysymykset (FAQ)

Kuinka paljon vahvempi Fable 5.1 on kuin Fable 5?

Erot vaihtelevat suuresti tehtävittäin. Terminal-Bench-Science parani 27,9 prosenttiyksikköä ja AutomationBench 14,3 prosenttiyksikköä; HLE parani työkaluja käytettäessä vain 1,2 prosenttiyksikköä. Yksittäistä suurinta parannusta ei voi käyttää kaikkien tehtävien mittarina.

Onko Fable 5.1 nopeampi kuin Opus 5?

Virallisessa suhteellisen viiveen taulukossa Fable 5.1 on ”hitaampi” ja Opus 5 ”keskitasoa”. Osa kumppaneista on havainnut Fable 5.1:n olevan nopeampi kokonaisissa tehtävissä, koska se kuluttaa vähemmän tokeneita ja tekee vähemmän uudelleentyötä. Nämä kaksi väitettä eivät mittaa samaa asiaa.

Sopiiko Fable 5.1 ohjelmointiin paremmin kuin GPT-5.6 Sol?

Anthropicin julkaisutaulukossa Fable 5.1 on korkeammalla Terminal-Bench-Sciencessä, Terminal-Benchissä, AutomationBenchissä ja CursorBenchissä; mutta eri mallit käyttävät erilaisia agenttiympäristöjä (harness), effort-tasoja, työkaluja ja hintoja, joten tämän perusteella ei voi väittää, että Fable voittaisi kaikissa oikeissa repositorioissa. Voit tutustua GPT-5.6 Sol 1M -kontekstin konfigurointioppaaseen ja testata sitten A/B-vertailulla omia edustavia tehtäviäsi.

Miksi Fable 5.1 vaihtuu yhtäkkiä Opus-malliin?

Osa kyberturvallisuuteen ja elämäntieteisiin liittyvistä pyynnöistä ohjataan suojatoimien kautta Opus-malliin. Mallin vaihtuminen ei välttämättä tarkoita vikaa; Anthropic on ilmoittanut, ettei tällaisia reititettyjä pyyntöjä laskuteta Fable-hinnoittelulla.

Onko Fable 5.1:ssä vesileima?

Kyllä, siinä on tilastollinen content provenance -mekanismi, mutta se ei lisää näkyviä tunnisteita tekstin pintaan. Se ei ole sama asia kuin kuvan kulmassa oleva näkyvä vesileima.

Yhteenveto

Claude Fable 5.1:n selvimmät parannukset keskittyvät tieteelliseen tutkimukseen, pääteohjelmointitehtäviin ja sovellusten välisiin liiketoiminnan työnkulkuihin: se pystyy toimimaan pitkäjänteisemmin, palautumaan virheistä, todentamaan tuloksia, ja se alentaa myös pitkien tehtävien kustannuksia halvempien välimuistin lukujen ansiosta. Se on kuitenkin edelleen kallis, sen yksittäisen kierroksen viive on hitaahko, ja se tuo mukanaan yhteensopivuusmuutoksia thinking-lohkoihin, pakotettuihin työkalukutsuihin ja historian muokkaamiseen.

Oikea kysymys valinnan taustalla ei ole ”onko se vertailuarvojen ykkönen”, vaan: onko tehtäväsi riittävän pitkä, riittävän monimutkainen ja ovatko epäonnistumisen ja uudelleentyön kustannukset niin korkeat, että Fable 5.1:n käyttö on perusteltua. Jos vastaus on kieltävä, aloittaminen Opus 5:stä tai Sonnet 5:stä on yleensä sopivampaa.