GPT-6 Sol vs Claude Opus 5.5: hinta, testitulokset ja ohjelmointitehtävät – miten valita?

Yleisissä API-ohjelmointitehtävissä kannattaa ensin kokeilla mallia GPT-6 Sol; vaativissa tehtävissä voi verrata mallia Claude Opus 5.5 ja sen jälkeen ottaa GPT-6 Astra ja Claude Fable 5.1 käyttöön vaativan tason vaihtoehtoina. Tässä artikkelissa tarkistetaan neljän mallin viralliset tekniset tiedot, välimuisti- ja Batch-hinnoittelu sekä samalla menetelmällä tehdyt kolmannen osapuolen vertailutulokset, ja tarjotaan viisi uudelleenlaskettavaa kustannusskenaariota.

PandaNpcJulkaistu ensimmäisen kerran
GPT-6 Sol vs Claude Opus 5.5: hinta, testitulokset ja ohjelmointitehtävät – miten valita?

Katso johtopäätös ensin: Tavalliset API-ohjelmointitehtävät kannattaa aloittaa kokeilemalla GPT-6 Solia. Sen vakio-syöte-/tulostehinta on $2/$10 miljoonaa tokenia kohden, eli kumpikin puolet Claude Opus 5.5:stä; Artificial Analysisin (AA) saman arviointijärjestelmän korkeimmassa konfiguraatiossa Opus 5.5:n kokonaisindeksi on 58 ja Solin 48. Kyse ei ole siitä, että ne olisivat ”samalla hinnalla vahvempia”: vertaa ensin omilla repositoriotehtävilläsi kertaläpäisyprosenttia, kierrosten määrää, tokenien kokonaismäärää ja manuaalista uudelleentyöstöä ja päätä sitten, maksatko Opusin korkeammista tuloksista. Vaikeammissa pitkän aikavälin tehtävissä voi kokeilla ylempänä GPT-6 Astraa tai Claude Fable 5.1:tä; neljän mallin yksikköhinnat ja kyvykkyys eivät ole samassa järjestyksessä.

Ylläpidämme PandaNpc:tä, joka tukee Codexia ja Claude Codea, joten meillä on tuotteen käyttötapaus; tässä artikkelissa ei ole tehty neljän mallin samasta tehtävästä käytännön testiä, emmekä esitä jäljempänä olevia julkisia arviointeja omina testeinämme. Hinnat tarkoittavat mallin API-kustannuksia, eivät työkalun tilaushintaa. Tiedot on tarkistettu 23. syyskuuta 2026, ja kaikki valuutat ovat Yhdysvaltain dollareita.

Neljän mallin tekniset tiedot: erottele ensin kapasiteetti, tuloste ja oletusasetukset

Mobiililukemisen helpottamiseksi alla oleva taulukko on ryhmitelty OpenAI:n ja Anthropicin mukaan; ”suurin tuloste” on yhden vastauksen yläraja, ja konteksti on ikkuna, jossa syöte ja tuloste ovat yhteensä käytettävissä, eikä se tarkoita, että joka kerta voitaisiin tuottaa yhtä pitkä tuloste. API-mallin ID:t voi käyttää suoraan laskutuksen taiviointiasetusten tarkistamiseen.

OpenAI:n tekniset tiedot GPT-6 Sol GPT-6 Astra
API-mallin ID gpt-6-sol gpt-6-astra
Virallinen asemointi Kustannusten ja kyvykkyyden tasapaino Monimutkaisimmat päästä päähän -tehtävät
Konteksti-ikkuna 1 050 000 tokenia 1 050 000 tokenia
Yhden vastauksen enimmäistuloste 128 000 tokenia 128 000 tokenia
Syöte-/tulostemodaalisuus Teksti, kuva → teksti Teksti, kuva → teksti
Päättelyn effort none / low / medium / high / xhigh / max low / medium / high / xhigh / max
Oletus-effort medium Ei mainittu virallisella mallisivulla
Tietämyksen katkaisupäivä 2026-04-20 2026-04-30
Saatavuus API saatavilla API saatavilla
API-mallin ID
GPT-6 Sol
gpt-6-sol
GPT-6 Astra
gpt-6-astra
Virallinen asemointi
GPT-6 Sol
Kustannusten ja kyvykkyyden tasapaino
GPT-6 Astra
Monimutkaisimmat päästä päähän -tehtävät
Konteksti-ikkuna
GPT-6 Sol
1 050 000 tokenia
GPT-6 Astra
1 050 000 tokenia
Yhden vastauksen enimmäistuloste
GPT-6 Sol
128 000 tokenia
GPT-6 Astra
128 000 tokenia
Syöte-/tulostemodaalisuus
GPT-6 Sol
Teksti, kuva → teksti
GPT-6 Astra
Teksti, kuva → teksti
Päättelyn effort
GPT-6 Sol
none / low / medium / high / xhigh / max
GPT-6 Astra
low / medium / high / xhigh / max
Oletus-effort
GPT-6 Sol
medium
GPT-6 Astra
Ei mainittu virallisella mallisivulla
Tietämyksen katkaisupäivä
GPT-6 Sol
2026-04-20
GPT-6 Astra
2026-04-30
Saatavuus
GPT-6 Sol
API saatavilla
GPT-6 Astra
API saatavilla

Tiedot: GPT-6 Solin virallinen mallisivu, GPT-6 Astran virallinen mallisivu.

Anthropicin tekniset tiedot Claude Opus 5.5 Claude Fable 5.1
API-mallin ID claude-opus-5-5 claude-fable-5-1
Virallinen asemointi Pitkän aikavälin agent-ohjelmointi ja tietotyö Vaativampi päättely ja pitkän aikavälin agent-työ
Konteksti-ikkuna 1 000 000 tokenia 1 000 000 tokenia
Yhden vastauksen enimmäistuloste 128 000 tokenia; Batch beta voi yltää 300 000:een 128 000 tokenia
Syöte-/tulostemodaalisuus Teksti, kuva → teksti Teksti, kuva → teksti
Päättelytapa adaptive thinking, aina päällä adaptive thinking, aina päällä
Oletus-effort medium high
Tietämyksen katkaisupäivä 2026-06 2026-06
Saatavuus Claude API saatavilla Claude API saatavilla
API-mallin ID
Claude Opus 5.5
claude-opus-5-5
Claude Fable 5.1
claude-fable-5-1
Virallinen asemointi
Claude Opus 5.5
Pitkän aikavälin agent-ohjelmointi ja tietotyö
Claude Fable 5.1
Vaativampi päättely ja pitkän aikavälin agent-työ
Konteksti-ikkuna
Claude Opus 5.5
1 000 000 tokenia
Claude Fable 5.1
1 000 000 tokenia
Yhden vastauksen enimmäistuloste
Claude Opus 5.5
128 000 tokenia; Batch beta voi yltää 300 000:een
Claude Fable 5.1
128 000 tokenia
Syöte-/tulostemodaalisuus
Claude Opus 5.5
Teksti, kuva → teksti
Claude Fable 5.1
Teksti, kuva → teksti
Päättelytapa
Claude Opus 5.5
adaptive thinking, aina päällä
Claude Fable 5.1
adaptive thinking, aina päällä
Oletus-effort
Claude Opus 5.5
medium
Claude Fable 5.1
high
Tietämyksen katkaisupäivä
Claude Opus 5.5
2026-06
Claude Fable 5.1
2026-06
Saatavuus
Claude Opus 5.5
Claude API saatavilla
Claude Fable 5.1
Claude API saatavilla

Tiedot: Opus 5.5:n virallinen mallisivu, Fable 5.1:n virallinen mallisivu. Opusin 300K-tuloste koskee vain määritettyä Batch beta -versiota ja output-300k-2026-03-24 -otsaketta, ei tavallisten vuorovaikutteisten pyyntöjen ylärajaa.

Neljän mallin laskutus: tavallinen syöte, välimuistiin kirjoitus ja osuma ovat eri tokeneita

Alla olevat hinnat ovat Yhdysvaltain dollareita miljoonaa tokenia kohden, ja ne ovat kyseisen token-luokan yksikköhintoja. Tavalliseen syötteeseen ei lisätä erikseen ”välimuistiin kirjoituksen maksua”; vain välimuistiin ensimmäistä kertaa kirjoitetuista tokeneista käytetään kirjoitushintaa. Välimuistiosuman jälkeen laskutus tapahtuu lukuhinnan mukaan, ja tuloste veloitetaan edelleen erikseen. Molemmilla on 50 %:n Batch-syöte-/tulostealennus, mutta Batch on asynkroninen käsittely, eikä sovi ohjelmointikeskusteluun, joka vaatii välitöntä palautetta.

OpenAI:n vakio-API GPT-6 Sol GPT-6 Astra
Tavallinen syöte $2.00 $10.00
Välimuistiin kirjoitus $2.50 $12.50
Välimuistin luku $0.20 $1.00
Tuloste $10.00 $50.00
Batch-syöte/-tuloste $1.00 / $5.00 $5.00 / $25.00
Syöte yli 272K Koko pyynnön syöte- ja välimuistimaksut ×2, tulostemaksu ×1,5 Koko pyynnön syöte- ja välimuistimaksut ×2, tulostemaksu ×1,5
Tavallinen syöte
GPT-6 Sol
$2.00
GPT-6 Astra
$10.00
Välimuistiin kirjoitus
GPT-6 Sol
$2.50
GPT-6 Astra
$12.50
Välimuistin luku
GPT-6 Sol
$0.20
GPT-6 Astra
$1.00
Tuloste
GPT-6 Sol
$10.00
GPT-6 Astra
$50.00
Batch-syöte/-tuloste
GPT-6 Sol
$1.00 / $5.00
GPT-6 Astra
$5.00 / $25.00
Syöte yli 272K
GPT-6 Sol
Koko pyynnön syöte- ja välimuistimaksut ×2, tulostemaksu ×1,5
GPT-6 Astra
Koko pyynnön syöte- ja välimuistimaksut ×2, tulostemaksu ×1,5

Lähteet: Sol, Astra, OpenAI:n hinnasto, OpenAI:n välimuistiselitys. Yli 272K ei tarkoita, että vain ylimenevä osa hinnoitellaan korotetusti; rajan ylitys lasketaan koko pyynnön syöte-tokenien perusteella, mukaan lukien välimuistiin liittyvät syötteet.

Anthropicin vakio-API Claude Opus 5.5 Claude Fable 5.1
Tavallinen syöte $4.00 $10.00
5 minuutin välimuistiin kirjoitus $5.00 $12.50
1 tunnin välimuistiin kirjoitus $8.00 $20.00
Välimuistin luku $0.20 $0.25
Tuloste $20.00 $50.00
Batch-syöte/-tuloste $2.00 / $10.00 $5.00 / $25.00
1M pitkä konteksti Vakioyksikköhinta, ei >200K lisämaksua Vakioyksikköhinta, ei >200K lisämaksua
Tavallinen syöte
Claude Opus 5.5
$4.00
Claude Fable 5.1
$10.00
5 minuutin välimuistiin kirjoitus
Claude Opus 5.5
$5.00
Claude Fable 5.1
$12.50
1 tunnin välimuistiin kirjoitus
Claude Opus 5.5
$8.00
Claude Fable 5.1
$20.00
Välimuistin luku
Claude Opus 5.5
$0.20
Claude Fable 5.1
$0.25
Tuloste
Claude Opus 5.5
$20.00
Claude Fable 5.1
$50.00
Batch-syöte/-tuloste
Claude Opus 5.5
$2.00 / $10.00
Claude Fable 5.1
$5.00 / $25.00
1M pitkä konteksti
Claude Opus 5.5
Vakioyksikköhinta, ei >200K lisämaksua
Claude Fable 5.1
Vakioyksikköhinta, ei >200K lisämaksua

Lähteet: Opus 5.5, Fable 5.1, Anthropicin hinnat ja Batch-/välimuistisäännöt, pitkän kontekstin kuvaus. Anthropic sallii nimenomaisesti Batch- ja välimuistialennusten yhdistämisen; välimuistiosuman on täytettävä vastaava voimassaoloaika ja saman etuliitteen ehdot.

Neljän mallin tarkat tulokset samassa arviointijärjestelmässä

Alla oleva taulukko on kokonaan peräisin Artificial Analysis Intelligence Index v4.3.2 -versiosta. Testiasetukset ovat GPT-6 Sol max, GPT-6 Astra max, Claude Opus 5.5 ja Fable 5.1 kaikki adaptive reasoning max effort -tilassa ja default fallback käytössä. Ne eivät ole neljän mallin oletusasetukset; erityisesti Opus 5.5:n oletus on medium ja Fable 5.1:n oletus high; vaikka eri mallit olisi merkitty max-tilaan, todellinen päättely-tokenien kulutus vaihtelee. AA yhdenmukaistaa tehtävät ja käyttää omaa harnessiaan, joten tuloksia voi verrata rinnakkain tämän testikonfiguraation sisällä; valmistajien julkaisutilaisuuksien tuloks ei voi sekoittaa tähän taulukon. Linkit: Sol–Opus-alunperäinen vertailu, AstraFable-alunperäinen vertailu, AA:n menetelmä.

AA:n kokonais- ja insinöörityötehtävät Sol Opus 5.5 Astra Fable 5.1
Kokonaisindeksi v4.3.2 (pistettä) 48 58 53 53
Terminal-Bench 4.0 (läpäisysentti) 44% 60% 59% 52%
AutomationBench-AA (onnistumisprosentti) 62% 70% 68% 59%
SciCode (läpäisyprosentti) 58% 67% 56% 63%
AA-LCR v1.1 pitkä konteksti (läpäisyprosentti) 84% 85% 81% 85%
Kokonaisindeksi v4.3.2 (pistettä)
Sol
48
Opus 5.5
58
Astra
53
Fable 5.1
53
Terminal-Bench 4.0 (läpäisysentti)
Sol
44%
Opus 5.5
60%
Astra
59%
Fable 5.1
52%
AutomationBench-AA (onnistumisprosentti)
Sol
62%
Opus 5.5
70%
Astra
68%
Fable 5.1
59%
SciCode (läpäisyprosentti)
Sol
58%
Opus 5.5
67%
Astra
56%
Fable 5.1
63%
AA-LCR v1.1 pitkä konteksti (läpäisyprosentti)
Sol
84%
Opus 5.5
85%
Astra
81%
Fable 5.1
85%

Jokaisen rivin arvot ovat peräisin edellä mainituilta kahdelta AA:n saman version mallivertailusivulta ja Astra–Fable-sivulta. Esimerkiksi AA:n omassa Terminal-Bench 4.0 -harnessissa Opus 5.5 on 16 prosenttiyksikköä Solia korkeampi; tätä ei voi laskea yhteen Anthropicin verkkosivun 66,4 %:n kanssa, koska jälkimmäisen ajoasetukset ovat erilaiset.

AA:n tieto- ja asiantuntijatehtävät Sol Opus 5.5 Astra Fable 5.1
AA-Briefcase v1.1 (Elo) 1483 1822 1569 1678
GDPval-AA v2.1 (Elo) 1487 1846 1542 1735
Humanity's Last Exam (läpäisyprosentti) 48% 61% 55% 59%
GDP.pdf (kokonaisläpäisyprosentti) 25% 26% 31% 26%
CritPt (läpäisyprosentti) 31% 32% 32% 30%
AA-Omniscience (indeksipisteet, ei prosentti) 27 46 43 43
AA-Briefcase v1.1 (Elo)
Sol
1483
Opus 5.5
1822
Astra
1569
Fable 5.1
1678
GDPval-AA v2.1 (Elo)
Sol
1487
Opus 5.5
1846
Astra
1542
Fable 5.1
1735
Humanity's Last Exam (läpäisyprosentti)
Sol
48%
Opus 5.5
61%
Astra
55%
Fable 5.1
59%
GDP.pdf (kokonaisläpäisyprosentti)
Sol
25%
Opus 5.5
26%
Astra
31%
Fable 5.1
26%
CritPt (läpäisyprosentti)
Sol
31%
Opus 5.5
32%
Astra
32%
Fable 5.1
30%
AA-Omniscience (indeksipisteet, ei prosentti)
Sol
27
Opus 5.5
46
Astra
43
Fable 5.1
43

Jokaisen rivin arvojen lähde: AA Sol–Opus, AA Astra–Fable. 1–2 prosenttiyksikön pieniä eroja ei pidä tulkita vakaaksi voitoksi tai häviöksi; Elo, indeksipisteet ja läpäisyprosentti eivät myöskään ole sama yksikkö.

AA:n testikustannukset ja käyttö Sol Opus 5.5 Astra Fable 5.1
Keskimääräinen kustannus indeksitehtävää kohden $1.06 $5.98 $3.26 $7.63
Keskimääräinen tulostetokenien määrä tehtävää kohden 31K 119K 27K 78K
josta päättelytokeneita 21K 84K 17K 47K
Keskimääräinen kustannus indeksitehtävää kohden
Sol
$1.06
Opus 5.5
$5.98
Astra
$3.26
Fable 5.1
$7.63
Keskimääräinen tulostetokenien määrä tehtävää kohden
Sol
31K
Opus 5.5
119K
Astra
27K
Fable 5.1
78K
josta päättelytokeneita
Sol
21K
Opus 5.5
84K
Astra
17K
Fable 5.1
47K

Lähteet ovat edelleen AA Sol–Opus ja AA Astra–Fable. Tehtäväkustannus on AA:n testikäytön painotettu keskiarvo, ei tarjoushinta ”yhden vaatimuksen valmiiksi saamisesta” sinun repositoriosi kaltaisessa ympäristössä. Opusin max-konfiguraatio kuluttaa enemmän tuloste- ja päättely-tokeneita, mikä on yksi syy siihen, että laskuerot ylittävät yksikköhintaerot.

Kahden valmistajan viralliset kaaviot: voivat vahvistaa kunkin omat johtopäätökset, mutta niistä ei saa saman kentän voittajaa

OpenAI:n DeepSWE v1.1 -kaaviossa GPT-6 Sol max on 68,8 %, ja kaaviossa Claude Fable 5 xhigh on 69,9 %; siinä ei ole Opus 5.5:tä. Vaaka-akseli on kustannus tehtävää kohden logaritmisella asteikolla. Kaaviossa oleva Opus 5 ei myöskään ole Opus 5.5. Se osoittaa, että Solilla on OpenAI:n julkaisemissa asetuksissa lähelle huippuluokan malleja yltävä ohjelmointiagentin tulos, mutta se ei korvaa neljän mallin saman kentän testiä.

OpenAI:n virallinen DeepSWE v1.1 -kaavio: GPT-6 Sol max on 68,8 %, kaaviossa ei ole Opus 5.5:tä

Kuva 1: OpenAI《Introducing GPT-6 Sol and Luna》 ”Coding”, 2026-09-22. Mallit ja effort määräytyvät kuvaselitteen ja alkuperäisen tekstin alaviitteiden mukaan. Avaa koko alkuperäinen kuva ja katso pienet tekstit.

Anthropicin Terminal-Bench 4.0 -kaaviossa Claude Opus 5.5 xhigh on 66,4 %. Kaavion GPT-6 Astra 57,9 % käyttää high-asetusta, ei GPT-6 Solia. Käyrässä on lisäksi oletus-effortin pisteitä, mutta niiden sijaintia ei voi pitää xhigh-pisteinä. Tämän valmistajan harness eroaa AA:n yllä olevan taulukon Terminal-Bench 4.0:sta, joten 66,4 %:sta ei voi vähentää AA:n Solille antamaa 44 %:a.

Anthropicin virallinen Terminal-Bench 4.0 -kaavio: Opus 5.5 xhigh on 66,4 %, kaaviossa ei ole GPT-6 Solia

Kuva 2: Anthropic《Claude Opus 5.5》 ”Coding”, 2026-09-22. Vaaka-akseli on kustannus yritystä kohden logaritmisella asteikolla; kaavion tasot, tilastolliset välit ja rajoitukset ovat alkuperäistekstissä. Avaa koko alkuperäinen kuva ja katso pienet tekstit.

Lisäksi on valmistajien yksipuolisesti julkaisemia tuloksia, joita ei pidä vähentää suoraan toisistaan: OpenAI raportoi Solin xhigh-asetuksella AutomationBench 1.0.6 -tulokseksi 33,2 %, max-asetuksella Agents' Last Exam V1 -tulokseksi 56,4 % ja xhigh-asetuksella OSWorld 2.0 offline -tulokseksi 60,5 %, lähde sama OpenAI:n julkaisusivu; Anthropic raportoi Opus 5.5:n FrontierCode v1.1 Main -tulokseksi 54,4 %, CursorBench 4.0 -tulokseksi 57,8 %, GDPval-AA v2.1 -tulokseksi 1846 Elo ja Humanity's Last Exam with tools -tulokseksi 67,7 %, lähde sama Anthropicin julkaisusivu. Näiden kohteiden versioiden, työkalujen, effortin tai harnessin ei ole vahvistettu olevan yhteneviä toisen osapuolen kanssa, joten emme luettele, ”kuinka paljon edellä” ne ovat. Julkaisemattomia neljän mallin saman menetelmän arvoja ei voi arvailla.

Paljonko samasta tehtävämäärästä joutuu maksamaan? Viisi uudelleenlaskettavaa esimerkkiä

Alla syöte jaetaan kolmeen toisensa poissulkevaan token-luokkaan: tavallinen, ensimmäinen välimuistiin kirjoitus ja myöhempi välimuistin luku, minkä jälkeen lisätään tuloste. Jokainen rivi on yksi pyyntö, eikä sisällä työkalukutsuja, alustan lisämaksuja tai ylimääräisiä kierroksia; tulosteet ovat kaikki alle tavallisen pyynnön 128K-ylärajan. Hinnat on laskettu yllä olevien virallisten hintojen mukaan, joten voit korvata token-määrät omilla käyttölokiesi luvuilla.

Skenaario ja token-käyttö Sol Opus 5.5 Astra Fable 5.1
A Tavallinen: 100K uutta syötettä + 50K tulostetta $0.70 $1.40 $3.50 $3.50
B Ensimmäinen välimuistiin kirjoitus: 200K kirjoitusta + 50K uutta syötettä + 20K tulostetta $0.80 $1.60 (5m) / $2.20 (1h) $4.00 $4.00 (5m) / $5.50 (1h)
C Myöhempi osuma: 200K välimuistin lukua + 50K uutta syötettä + 20K tulostetta $0.34 $0.64 $1.70 $1.55
D A:n Batch-asynkroninen versio: 100K uutta syötettä + 50K tulostetta $0.35 $0.70 $1.75 $1.75
E Pitkä syöte: 300K uutta syötettä + 20K tulostetta $1.50 $1.60 $7.50 $4.00
A Tavallinen: 100K uutta syötettä + 50K tulostetta
Sol
$0.70
Opus 5.5
$1.40
Astra
$3.50
Fable 5.1
$3.50
B Ensimmäinen välimuistiin kirjoitus: 200K kirjoitusta + 50K uutta syötettä + 20K tulostetta
Sol
$0.80
Opus 5.5
$1.60 (5m) / $2.20 (1h)
Astra
$4.00
Fable 5.1
$4.00 (5m) / $5.50 (1h)
C Myöhempi osuma: 200K välimuistin lukua + 50K uutta syötettä + 20K tulostetta
Sol
$0.34
Opus 5.5
$0.64
Astra
$1.70
Fable 5.1
$1.55
D A:n Batch-asynkroninen versio: 100K uutta syötettä + 50K tulostetta
Sol
$0.35
Opus 5.5
$0.70
Astra
$1.75
Fable 5.1
$1.75
E Pitkä syöte: 300K uutta syötettä + 20K tulostetta
Sol
$1.50
Opus 5.5
$1.60
Astra
$7.50
Fable 5.1
$4.00

Laskentaesimerkki: A:n Sol = 0,1 × $2 + 0,05 × $10 = $0.70. B:n Opus 5m = 0,2 × $5 + 0,05 × $4 + 0,02 × $20 = $1.60; C:n Opus = 0,2 $0.20 + 0,05 × $4 + 0,02 × $20 = $0.64. E:n Sol-syöte 300K ylittää jo 272K, joten koko pyynnölle lasketaan $4 syöte ja $15 tuloste; Astraa vastaa $20/$75. Opus 5.5:n / Fable 5.1:n 1M-konteksti säilyttää vakioyksikköhinnan. B ja C ovat eri pyyntöjä: ensin kirjoitus, sitten luku; C:ssä on varmistettava, että välimuisti on vielä voimassa. OpenAI:n välimuistin säilytysaika ja Anthropicin 5m/1h-laskutusmekanismi eroavat toisistaan, eikä B:n kirjoitusmaksua pidä virheellisesti lisätä C:n jokaiseen pyyntöön. Perusteet: OpenAI:n kahden mallin hinnat, Anthropicin hintasäännöt.

Miten työnjako tehdään käytännön ohjelmointityönkulussa?

Anna Solinitaa päivittäinen iterointi ensin. Vaatimusten pilkkominen, pienet muutokset olemassa olevaan repositorioon, testikorjkset ja erissä tarkistettavat työtattaa antaa ensin Solin hoidettavaksi ja sen jälkeen kirjata tehtävien onnistumprosentti, uudelleentyöstökerrat ja tokenien kokonaismäärä. Sen alhainen yksikköhinta on suorin A–D:n kaltaisissa esimerkeissä, joissa ei ylitetä 272K:ta; erittäin pitkissä pyynnöissä hintaetu pienenee.

Opus 5.5 hoitaa agenttitehtävät, joita on vaikea saada kerralla valmiiksi. AA:n saman kentän testissä se saa korkeampia tuloksia kokonaisindeksissä, terminaalitehtävissä ja tietotyössä, mutta max-konfiguraatiossa keskimääräinen kustannus tehtävää kohden on myös selvästi korkeampi. Voit ensin muodostaa paikallisen perustason oletusasetuksella medium tai todellisuudessa käyttämälläsi effortilla ja sitten nostaa tasoa vaikeille tehtäville. Älä pidä AA:n max-tulosta oletuskokemuksena.

Astra ja Fable 5.1 ovat ylätason vaihtoehtoja. Astra on kilpailukykyinen AA:n AutomationBench-AA-, Terminal-Bench 4.0- ja GDP.pdf-tuloksissa, ja Fable 5.1 on vahvempi joissakin pitkän aikavälin tietotyön mittareissa, mutta niiden $10/$50-perussyyöte-/tulostehinta on selvästi Solia korkeampi. Fable 5.1:n välimuistin luku on $0.25, mikä on alhaisempi kuin Astran $1.00; jos suurta etuliitettä luetaan toistuvasti, kustannusjärjestys voi muuttua. Vaikeissa tehtävissä kannattaa tehdä neljän mallin pienotoshyväksyntä samalle repositoriovaatimukselle ja valita ”onnistuneesti valmiiksi saadun ja yhdistettävissä olevan tehtävän kustannuksen” eikä yksittäisen listasijoituksen perusteella.

PandaNpc:ssä Codex ja Claude Code ovat kaksi käytettävissä olevaa Agent Engineä. Sisäänkäynnin valinnassa on otettava huomioon myös olemassa olevat tilauksesi tai API-kanavasi, työkaluoikeudet, repositorion konteksti ja tiimin tarkistusprosessi; mallin API-hintaa ei voi suoraan muuntaa työkalun tilauskiintiöksi. Tässä artikkelissa esitetään julkisia teknisiä tietoja ja arviointeja, eikä siinä väitetä, että PandaNpcin sisällä olisi tehty neljän mallin käytännön rankingia.

FAQ

Onko Sol varmasti puolet halvempi kuin Opus 5.5? Vain vakio-API:n syöte- ja tulosteyksikköhinnat ovat kumpikin puolet. Yli 272K:n syöte, välimuistin kirjoitus ja luku, todelliset päättely-tokenit, kierrokset ja työkalumaksut muuttavat koko tehtävän laskua. Yllä oleva skenaario E on jo tuonut molempien kertahinnan lähelle toisiaan: $1.50 ja $1.60.

Voivatko valmistajien kaksi ohjelmointikaaviota todistaa, kuka voittaa? Eivät. OpenAI:n kaaviossa ei ole Opus 5.5:tä, Anthropicin kaaviossa ei ole Solia, ja vertailukohdat ja harnessit ovat erilaiset. Jos haluat nähdä neljän mallin saman kentän tulokset, katso AA v4.3.2:n kiinteän konfiguraation taulukkoa; jos haluat päättää oman työkalusi valinnasta, sinun on ajettava uudelleen omat repositoriotehtäväsi.

Voiko välimuistin ja Batchin yhdistää? Anthropicin hintadokumentaatio tukee niiden yhdistämistä nimenomaisesti; se, osuuko välimuisti, riippuu etuliitteestä, voimassaoloajasta ja pyyntöasetuksista. OpenAI:n kahden mallin Batch on 50 % vakiohinnasta; tarkista tarkka lasku kyseisen API-käyttöhistorian mukaan.