Gemini 4 Argon, GPT-6 Astra, Claude Fable 5.1 – miten valita? Saatavuus, hinta ja käyttötapojen vertailu

Gemini 4 Argon rajoitetusti saatavilla; GPT-6 Astra, Claude Fable 5.1 tarjolla, valitse tehtävän ja tilauksen mukaan; API-/tilaushinnat erikseen, virallista dataa, ei saman ehdoin testattu.

PandaNpcJulkaistu ensimmäisen kerran
Käsitteellinen kansikuva: pöydällä oleva kysymyskortti kysyy, mikä kolmesta mallista kannattaa valita; tämä ei ole tuotteen käyttöliittymä.
Vertaile kolmea mallia virallisten julkisten tietojen pohjalta: saatavuus, hinta ja sopivuus tehtävään. Tämä ei ole mallien välinen vertailutesti samoissa olosuhteissa.

Tietojen tarkistus: 30. syyskuuta 2026 (UTC). PandaNpc tarjoaa AI Agent -palveluita, ja tämä liittyy mallivalintaan. Tässä artikkelissa kootaan kolmen yrityksen julkisia tietoja ja annetaan tehtäväkohtaisia valintasuosituksia; emme ole vielä saaneet käyttöoikeutta Gemini 4 Argonin kokeiluun, emmekä ole tehneet kolmen mallin vertailukelpoista testausta samoissa olosuhteissa. Jäljempänä "sopiva" viittaa viralliseen asemointiin ja tämänhetkiseen saatavuuteen, ei siihen, että olisimme testanneet, kuka on vahvempi.

Johtopäätös ensin: jos tarvitset mallia jo tänään, valitse GPT-6 Astran ja Claude Fable 5.1:n välillä tehtävän ja nykyisen tilauksesi perusteella; Gemini 4 Argon on tällä hetkellä avoinna vain harvoille luotetuille testaajille, eivätkä tavalliset käyttäjät voi vielä pitää sitä kolmantena aina valittavissa olevana vaihtoehtona. Jos teet ohjelmistojen välistä työtä, monimutkaista aineiston järjestelyä tai vaativaa ohjelmointia, voit kokeilla ensin Astraa; pitkäkestoiseen ohjelmointiin, suurten projektien tai monimutkaisten asiakirjojen toistuvaan lukemiseen voit kokeilla ensin Fable 5.1:tä. Kun Argon on yleisesti saatavilla, vertaa samoilla tehtävillä todellista suorituslaatua ja kokonaiskustannuksia.

Katso kannen alkuperäiskokoinen PNG (1672×941)

Katso ensin, voiko sitä käyttää: kolme mallia ei ole samalla lähtöviivalla

Malli Virallinen julkaisupäivä Kuka voi käyttää 30. syyskuuta mennessä Mitä se tarkoittaa tavalliselle lukijalle
Gemini 4 Argon 2026-09-30 Avataan ensin Google Fairwind -projektin luotetuille kyberturvapuolustajille ja testaajille; laajempi avaaminen kehittäjille, yrityksille ja kuluttajille odottaa myöhempiä vaiheita Se, että näet tänään "julkaistu", ei tarkoita, että Gemini-tilisi tai API:si voisi jo valita Argonin
GPT-6 Astra 2026-09-03 Otettu vaiheittain käyttöön ChatGPT:n maksaville käyttäjille ja API-käyttäjille; tarkka käyttökiintiö riippuu tilauksesta ja tilistä Voit tarkistaa mallilistasi ja käyttökiintiösi ja aloittaa todellisen tehtävän heti
Claude Fable 5.1 2026-09-01 Saatavilla Claude-maksutilauksissa ja Claude API:ssa, mutta esimerkiksi Pro-tilauksissa voidaan tarvita erillisiä käyttöhyvityksiä Tarkista ensin tilauksesi Fable-käyttösäännöt ja päätä vasta sitten, päivitätkö vai maksatko erikseen

Googlen Gemini 4 Argon -ilmoitus kertoo, että käyttöönotto on tällä hetkellä suppea ja että tulevaisuudessa sitä on tarkoitus laajentaa maksavista API-käyttäjistä ja Google AI Ultra -tilaajista alkaen; tavallisille käyttäjille ei ole ilmoitettu varmaa käyttöönottopäivää. OpenAI:n Astra-ilmoitus ja Anthropicin Fable 5.1 -kuvaus kertovat kumpikin nykyisestä saatavuusalueesta. Tässä mainittu Astra on OpenAI:n malli, ei Googlen Project Astra -tutkimusprojekti.

Parametrien vertailu: älä sekoita "kuinka paljon voi lukea" ja "kuinka paljon voi kirjoittaa" toisiinsa

Syötekontekstin ikkuna kertoo, kuinka paljon aineistoa mallille voi antaa yhdellä kertaa; maksimituotos kertoo, kuinka paljon sisältöä se voi enintään tuottaa yhdellä kertaa. Näitä kahta lukua ei voi vaihtaa keskenään, eikä pelkkien lukujen perusteella voi arvioida vastauksen laatua. Seuraavat tiedot ovat tiettyjen malliversioiden tietoja, jotka on tarkistettu 30. syyskuuta 2026, eivät Gemini-, GPT- tai Claude-perheiden yleisiä spesifikaatioita.

Parametri Gemini 4 Argon GPT-6 Astra Claude Fable 5.1
Syötekontekstin ikkuna Virallista ylärajaa ei ole julkaistu 1 050 000 tokenia 1 000 000 tokenia
Yhden kerran enimmäistuotos Googlen ilmoituksen mukaan 1 000 000 tokenia; tavalliset käyttäjät eivät voi vielä vahvistaa 128 000 tokenia 128 000 tokenia
Mallille annettava syöte Ilmoitus esittelee multimodaalisuutta ja pitkien videoiden ymmärrystä, mutta täydellistä API-syötetyyppien luetteloa ei ole julkaistu Teksti, kuvat Teksti, kuvat
Nykyinen virallinen käyttökanava Fairwind-luotetut testaajat; laajan saatavuuden ajankohtaa ei ole julkaistu ChatGPT-maksutilillä käyttöönoton etenemisen ja tilauksen mukaan; OpenAI API Claude-maksutuotteet ja Claude API; esimerkiksi Pro-tilauksissa on lisähyvitysehtoja

Lähteet: Googlen Gemini 4 Argon -ilmoitus, OpenAI:n GPT-6 Astra -mallisivu, Anthropicin Claude Fable 5.1 -mallisivu ja Anthropicin tilaustuki. Googlen ilmoituksessa "miljoona" tarkoittaa tuotoksen ylärajaa, eikä sitä pidä tulkita niin, että Argonille olisi julkaistu "miljoonan tokenin syötekontekstin ikkuna". Argonin täysi julkinen mallikortti ja tavallisten käyttäjien testit odottavat vielä julkaisua; taulukon "ei julkaistu" ei tarkoita "ei tällaista ominaisuutta".

Yllä oleva taulukko vertaa julkisia spesifikaatioita, ei suorituskyvyn voittajaa: se, että sisältöä mahtuu enemmän, ei välttämättä tarkoita tarkempaa vastausta. Vasta seuraava taulukko sisältää suorituskykyvertailujen tulokset.

Virallisten benchmark-tulosten vertailu: katso yksittäisiä tehtäviä, älä laske "yleisvoittajaa"

Google DeepMind julkaisi Gemini 4 Argon -virallisella mallisivulla neljän mallin benchmark-taulukon. Tässä poimitaan vain tässä artikkelissa käsitellyt kolme saraketta: Argon, GPT-6 Astra ja Claude Fable 5.1; alkuperäinen taulukko sisältää myös Claude Opus 5.5:n. Seuraavat tulokset ovat Googlen viralliselta verkkosivulta, joka luettiin 30. syyskuuta 2026 klo 23:42 UTC, ja Googlen kokoamia, eivät PandaNpcn vertailukelpoisia testejä samoissa olosuhteissa. Paitsi riveillä, joissa mainitaan F1, läpäisyprosentti tai osittainen pistemäärä, arvot noudattavat alkuperäisen taulukon prosentteja; kullakin rivillä lihavoidaan korkeampi arvo vain näiden kolmen mallin osalta. "—" tarkoittaa, että alkuperäisessä taulukossa ei ole vertailukelpoista tulosta, ei nollaa.

Osaamisalue Benchmark (testikohde) Gemini 4 Argon GPT-6 Astra Claude Fable 5.1
Tietotyö Vals Index 68.9% 63.1% 65.8%
Tietotyö AutomationBench 51.3% 41.4% 31.4%
Tietotyö Vals Finance Agent v2 65.4% 53.5% 58.9%
Tietotyö Harvey's Legal Agent Benchmark 19.6% 5.4% 6.7%
Automaattinen ohjelmointi DeepSWE v1.1 77.9% 74.1% 67.4%
Automaattinen ohjelmointi FrontierSWE v2 55.0% 65.5% 56.3%
Automaattinen ohjelmointi Vibe Code Bench 91.9% 89.6% 90.3%
Automaattinen ohjelmointi Terminal-bench 4.0 57.4% 58.2% 57.9%
Koneoppimisen insinöörityö PostTrainBench 45.3% 44.3% 40.2%
Tiede ja matematiikka Terminal-Bench Science 0.1 57.6% 68.1% 52.6%
Tiede ja matematiikka LABBench 2 88.8% 85.4% 68.6%
Tiede ja matematiikka RiemannBench 76.0% 72.0% 65.6%
Pitkä teksti GraphWalks (≤128K, BFS F1) 99.7% 98.7% 91.4%
Pitkä teksti GraphWalks (256K–1M, BFS F1) 84.2% 71.8% 65.0%
Tietokoneen käyttö Agent's Last Exam (läpäisyprosentti) 39.5% 34.2% —
Tietokoneen käyttö OSWorld-2.0 (offline-osajoukko, osittainen pistemäärä) 69.2% 72.6% —
Kuvan ja tekstin ymmärtäminen Chartography 71.6% 71.0% 46.2%
Videon ymmärtäminen LVBench 91.7% 87.5% 79.7%
Defensiivinen tietoturva CWE-bench v1 68.0% 68.0% 58.0%

Miten tätä taulukkoa käytetään? Jos teet tietotyötä, katso ensin Vals Indexiä ja Finance Agentiä; jos kirjoitat koodia, katso samalla DeepSWEä, FrontierSWEä ja Terminal-benchia, älä valitse vain yhtä riviä: Argon johtaa DeepSWEssä, mutta Astra on korkeampi FrontierSWEssä ja Terminal-benchissa. Tietokoneen käytössä on erityisen tärkeää huomata, että Fablen kaksi riviä tässä Googlen taulukossa ovat puuttuvia, eikä sen perusteella voi sanoa, ettei se osaa käyttää tietokonetta. CWE-bench osoittaa, että Argon ja Astra ovat kolmesta tasoissa; sekään ei ole tae todellisesta turvallisuustyöstä.

Testauskäytäntö: Googlen arviointimenetelmäkuvaus kertoo, että Argonin tulokset ovat yleensä yhdestä yrityksestä ja korkeimmasta ajatteluasetuksesta; muiden mallien tiedot tulevat useimmiten kunkin toimittajan omina ilmoituksina tai julkisista listoista, ja niissä voidaan käyttää kunkin korkeinta tai saatavilla olevaa ajatteluasetusta. Osa projekteista on Googlen itse ajamia, osa kolmansilta osapuolilta, eivätkä työkaluympäristöt ja otantamenetelmät ole kaikkialla samoja. Esimerkiksi DeepSWEn ja Terminal-benchin Argon-tulokset ovat Googlen itse tekemiä, kun taas muille malleille käytetään julkisia tuloksia; LVBenchissä eri malleille poimitaan eri määrä videokehyksiä. GraphWalks-rivillä käytetään BFS F1:tä, ja OSWorld-rivi edustaa vain offline-osajoukon "osittaista pistemäärää". Rivejä ei voi laskea yhteen eikä keskiarvoistaa, eikä tämän perusteella voi väittää kokonaisvaltaista ykkössijaa yhtenäisissä testausolosuhteissa. Tämän menetelmä-PDF:n tulosivulla sanotaan lisäksi "lokakuuhun 2026 mennessä", mikä ei vastaa sitä ajankohtaa, jolloin luimme taulukon 30. syyskuuta; tarkkaa arvioinnin valmistumispäivää ei voitu vahvistaa. Tässä artikkelissa ainoastaan siirretään näkyviin tulokset, jotka olivat tuolloin virallisella sivustolla; emme päättele, milloin arviointi valmistui, emmekä esitä sitä omana toistamanamme tuloksena.

Miten hintoja verrataan: kuukausimaksut ja API-kustannukset on erotettava toisistaan

Jos haluat käyttää mallia vain chat-tuotteessa tai ohjelmointityökalussa, katso ensin tilausta ja käyttökiintiötä. Yhdysvaltain julkisissa hinnoissa ChatGPT Plus on $20/kk, ja Pro jaetaan $100, $200, $500/kk jne. tasoihin; Astran tarkka käyttömäärä vaihtelee tilauksen ja tehtävän mukaan. OpenAI:n ChatGPT Work/Codex -hinta- ja käyttömääräseloste muistuttaa selvästi: API:n miljoonan tokenin hintaa ei voi käyttää arvioimaan, kuinka monta tehtävää tilauksen sisällä voi tehdä.

Claude Pron Yhdysvaltain kuukausihinta on $20, ja Max alkaa $100/kk:sta (Clauden virallinen hinnasto). Se, että "Prossa voi valita Fable 5.1:n", ei kuitenkaan tarkoita, että Fable sisältyisi Pron tavalliseen kiintiöön: Anthropicin Fable-tilaussäännöt kertovat, että Prossa ja Team-standardipaikoilla Fable 5.1:n käyttö vaatii erillisiä usage credits -hyvityksiä; Maxissa ja premium-paikoilla sitä voi käyttää osana viikoittaista kiintiötä. Google ei ole vielä ilmoittanut tavallisten käyttäjien Argon-tilauksen todellista hintaa tai käyttöönottopäivää, eikä Google AI Ultran nykyistä kuukausimaksua voi pitää "tänään ostettavan Argonin" hintana.

Jos maksat API:n kautta käytön mukaan, vasta seuraava on standarditekstihinnoittelu, jota voi lukea samassa yksikössä. Syöte tarkoittaa sisältöä, jonka annat mallin luettavaksi, ja tuotos tarkoittaa sen tuottamaa vastausta. Yksikkö on kaikkialla Yhdysvaltain dollarin hinta miljoonaa tokenia kohden (token on yksikkö, jolla teksti ja muu sisältö jaetaan laskutuksessa); taulukon Argon on Googlen ilmoittama tuleva julkaisuhinta, ei tänään jo maksamamme todellinen lasku.

Malli Tavallinen syöte Tavallinen tuotos Toistuvan sisällön välimuistiluku Tila
Gemini 4 Argon Ensijulkaisun suunniteltu $2; kampanja-ajan jälkeen $4 Ensijulkaisun suunniteltu $10; kampanja-ajan jälkeen $20 Google sanoo, että ensijulkaisun välimuistisyöte on 95 % tavallista syötehintaa edullisempi; tarkat käyttöönottosäännöt odottavat vahvistusta Ei vielä laajasti saatavilla
GPT-6 Astra $10 $50 $1 Nykyinen API-standardihinta
Claude Fable 5.1 $10 $50 $0.25 Nykyinen API-standardihinta

Tiedot ovat peräisin Googlen Argon-julkaisuilmoituksesta, OpenAI:n Astra-mallin hintasivulta ja Anthropicin Fable 5.1 -mallisivulta. Hinnat eivät sisällä lisätyökaluja, alueita, nopeustasoja tai alustakohtaisia eroja; kun Astran yksittäinen syöte ylittää 272K tokenia, koko pyynnön syötteen ja välimuistin hinta laskutetaan 2-kertaisena ja tuotos 1,5-kertaisena. Välimuistihinta koskee vain sisältöä, joka todella osuu välimuistiin; koko tehtävää ei voi arvioida välimuistihinnalla. Vaikka Argonin suunniteltu yksikköhinta olisi kahta muuta alhaisempi, ilman saman tehtävän onnistumisprosenttia ja käyttömäärätietoja ei voi väittää, että se olisi halvin yhden tehtävän suorittamisessa.

Käsitteellinen kaavio: sovellustilaus ja API:n käyttömääräinen laskutus ovat kaksi eri lähtökohtaa

Kuva: AI:n luoma havainnollistus laskutusperiaatteista, ei tuotelasku; tilauksen kuukausimaksua ei voi laskea yhteen API-yksikköhinnan kanssa. Katso alkuperäiskokoinen kuva (1672×941).

Miten valita tehtävän mukaan? Käytä ensin malleja, jotka ovat jo käytettävissäsi

Jos tehtävä ulottuu useisiin ohjelmistoihin tai vaatii verkkosivujen selailua, käyttöliittymän käyttöä ja monimutkaista harkintaa: kokeile ensin GPT-6 Astraa. OpenAI listaa tietokoneen käytön, selailun, vaativan ohjelmoinnin ja ammattimaiset asiakirjat sen keskeisiksi kyvyiksi. Jos sinulla on jo sopiva maksullinen ChatGPT-tili tai API-oikeudet, voit antaa sille todellisen tehtävän jo tänään ja katsoa, täyttääkö tulos vaatimukset. OpenAI:n mallikuvaus.

Jos tehtävä on useita tunteja kestävä ohjelmointi, koodikatselmointi tai suurten asiakirjojen käsittely: kokeile ensin Claude Fable 5.1:tä. Anthropic asemoi sen pitkäkestoisiin autonomisiin tehtäviin, monimutkaiseen ohjelmointiin ja tutkimukseen. Jos sinulla on jo Claude Code -työnkulku, voit jatkaa tutuilla työkaluilla, mutta varmista ensin, veloitetaanko tilauksesta erikseen käyttöhyvityksiä; jos ajat tällaisia tehtäviä paljon joka päivä, vertaa sitten Maxin ja API:n todellisia kustannuksia. Anthropicin mallikuvaus.

Jos haluat kokeilla Gemini 4 Argon: varmista ensin, oletko saanut virallisen käyttöoikeuden. Googlen ilmoittamiin suuntiin kuuluvat monimutkainen ohjelmointi, yritystietotyö ja defensiivisen tietoturvan tehtävät, ja se on ilmoittanut suunnitellut hinnat; nämä ovat huomionarvoisia, mutta eivät vielä korvaa tavallisten käyttäjien käytännön kokemusta. Jos sinulla ei ole käyttöoikeutta, ei suositella muuttamaan käynnissä olevaa työnkulkua Argonin "odotetun halvemmuuden" vuoksi. Googlen virallinen ilmoitus.

Nämä suositukset eivät tarkoita, että "jos malli on hyvä yhdessä tehtävätyypissä, se sopii vain siihen". Jos kaikki kolme ovat tulevaisuudessa saatavilla, varmin valintatapa on: ota sama todellinen tehtävä, anna samat aineistot ja hyväksymiskriteerit sekä kirjaa erikseen, suoritettiinko se, kuinka paljon tarvittiin ihmisen uudelleentyötä, kuinka kauan kului ja mitkä olivat kokonaiskustannukset. Yksi hieno demo tai eri valmistajien omat benchmark-tulokset eivät suoraan todista, että sinun tehtäväsi saa saman tuloksen.

Käsitteellinen kaavio: varmista ensin käytettävyys, sovita sitten tehtävään ja kokeile lopuksi pienessä mittakaavassa

Kuva: AI:n luoma havainnollistus valintapolusta: katso ensin tilin ja alueen saatavuus, sitten tehtävän tarpeet ja lopuksi varmista omalla pienellä tehtävällä. Kuvassa oleva "tässä artikkelissa ei tehdä mitään vertailevaa testausta" tarkoittaa, että emme ole itse ajaneet vertailukelpoisia testejä samoissa olosuhteissa; yllä oleva benchmark-taulukko on siirretty Googlen julkaisemista tiedoista. Katso alkuperäiskokoinen kuva (1672×941).

Jos tehtäväsi on saada kaksi ohjelmointiavustajaa jakamaan työt, katso Claude Coden ja Codexin yhteistyöopas; jos haluat antaa tietyn kysymyksen kirjautuneelle ChatGPT Pro -sivulle, katso Codexin ja Claude Coden ohje ChatGPT Prolta kysymiseen. Nämä kaksi opasta käsittelevät työnkulun toimintaa eivätkä tarkoita, että Gemini 4 Argon olisi liitetty PandaNpciin.

Usein kysytyt kysymykset (FAQ)

Gemini 4 Argon on jo virallisesti julkaistu, miksi en löydä sitä?

"Julkaisu" tarkoittaa, että Google on ilmoittanut mallista ja avannut sen rajatulle joukolle; virallinen ilmoitus ei ole vielä antanut yhtenäistä käyttöönottopäivää kaikille kehittäjille ja tavallisille kuluttajille. Tarkista ensin käyttämäsi Gemini-tuotteen ja tilin virallinen malliluettelo, äläkä pidä huhuissa mainittua "Gemini 4 Prota" Argonin käytettävissä olevana sisäänkäyntinä.

Onko Astra Googlen Project Astra?

Ei. Tässä artikkelissa GPT-6 Astra on OpenAI:n malli; Google Project Astra on toinen tutkimusprojekti, eikä sitä pidä sekoittaa kolmen mallin hintataulukkoon.

Jos tilasin Claude Pron, voinko käyttää Fable 5.1:tä tilauksen kiintiössä?

Ei välttämättä. Anthropicin nykyinen tilauskuvaus kertoo, että Fable 5.1:n käyttö Prossa vaatii usage credits -hyvityksiä, kun taas esimerkiksi Maxissa sitä voi käyttää rajatun viikoittaisen kiintiön puitteissa. Katso ennen maksua oma "käyttömäärä/hyvitykset"-sivusi.

Voiko yllä olevien hintojen perusteella suoraan päätellä, mikä on kannattavin?

Ei. API-taulukko vertaa vain listahintoja; tehtävän suorittamiseen vaikuttavat myös syötteen pituus, osuvatko toistuvat sisällöt välimuistiin, työkalukustannukset, ajokertojen määrä ja uudelleentyö. Erityisesti Argon ei ole vielä laajasti saatavilla, joten emme voi antaa omaa "kustannusta onnistunutta tehtävää kohden".