GPT-6 Sol vs Claude Opus 5.5: ราคา คะแนน และงานเขียนโค้ดควรเลือกอย่างไร?

งานเขียนโปรแกรมผ่าน API ทั่วไป แนะนำให้ลอง GPT-6 Sol ก่อน; งานที่ซับซ้อนอาจเปรียบเทียบกับ Claude Opus 5.5 แล้วจึงนำ GPT-6 Astra และ Claude Fable 5.1 มาเป็นตัวเลือกสำหรับงานยาก บทความนี้ตรวจสอบสเปกอย่างเป็นทางการของทั้งสี่โมเดล ราคาแคชและ Batch คะแนนทดสอบจากบุคคลที่สามแบบเกณฑ์เดียวกัน และให้สถานการณ์ค่าใช้จ่ายที่คำนวณซ้ำได้ 5 ชุด

PandaNpcเผยแพร่ครั้งแรกเมื่อ
GPT-6 Sol vs Claude Opus 5.5: ราคา คะแนน และงานเขียนโค้ดควรเลือกอย่างไร?

สรุปก่อน: งานเขียนโค้ด API ทั่วไปสามารถลอง GPT-6 Sol ก่อนได้ ราคาอินพุต/เอาต์พุตมาตรฐานของมันคือ $2/$10 ต่อล้านโทเค็น ซึ่งเป็นครึ่งหนึ่งของ Claude Opus 5.5; ภายใต้การกำหนดค่าสูงสุดของระบบการประเมินเดียวกันของ Artificial Analysis (AA) ดัชนีรวมของ Opus 5.5 คือ 58 และ Sol คือ 48 ทั้งสองไม่ใช่ความสัมพันธ์แบบ "ราคาเดียวกันแต่แข็งแกร่งกว่า": ก่อนอื่นให้ใช้งานในที่เก็บโค้ดของคุณเองเปรียบเทียบอัตราการผ่านในครั้งเดียว จำนวนรอบ โทเค็นรวม และการแก้ไขด้วยมนุษย์ แล้วจึงตัดสินใจว่าจะจ่ายสำหรับคะแนนที่สูงกว่าของ Opus หรือไม่ งานระยะยาวที่ยากกว่าสามารถลอง GPT-6 Astra หรือ Claude Fable 5.1 ได้ ราคาต่อหน่วยและความสามารถของทั้งสี่โมเดลไม่ได้เรียงลำดับเดียวกัน

เราดำเนินการ PandaNpc ที่รองรับ Codex และ Claude Code ดังนั้นจึงมีกรณีการใช้งานผลิตภัณฑ์; บทความนี้ไม่ได้ทำการทดสอบจริงกับทั้งสี่โมเดลโจทย์เดียวกัน และไม่นำการประเมินสาธารณะด้านล่างมาแอบอ้างว่าเป็นการทดสอบจริงของเว็บไซต์นี้ ราคาหมายถึงค่าใช้จ่าย API ของโมเดล ไม่ใช่ราคาสมัครสมาชิกเครื่องมือ ข้อมูลตรวจสอบ ณ วันที่ 23 กันยายน 2026 สกุลเงินเป็นดอลลาร์สหรัฐ

ข้อมูลจำเพาะของทั้งสี่โมเดล: แยกแยะความจุ เอาต์พุต และระดับเริ่มต้นก่อน

เพื่อความสะดวกในการอ่านบนมือถือ ตารางด้านล่างจัดกลุ่มตาม OpenAI และ Anthropic; "เอาต์พุตสูงสุด" คือ ขีดจำกัดการตอบกลับครั้งเดียว คอนเท็กซ์คือหน้าต่างที่ใช้ได้รวมอินพุตและเอาต์พุต ไม่ได้หมายความว่าทุกครั้งจะให้ความยาวเท่ากัน API model ID สามารถใช้ตรวจสอบบิลหรือการตั้งค่าการประเมินได้โดยตรง

ข้อมูลจำเพาะ OpenAI GPT-6 Sol GPT-6 Astra
API model ID gpt-6-sol gpt-6-astra
ตำแหน่งอย่างเป็นทางการ สมดุลระหว่างต้นทุนและความสามารถ งานแบบ end-to-end ที่ซับซ้อนที่สุด
หน้าต่างคอนเท็กซ์ 1,050,000 token 1,050,000 token
เอาต์พุตสูงสุดต่อครั้ง 128,000 token 128,000 token
รูปแบบอินพุต/เอาต์พุต ข้อความ, รูปภาพ → ข้อความ ข้อความ, รูปภาพ → ข้อความ
การอนุมาน effort none / low / medium / high / xhigh / max low / medium / high / xhigh / max
effort เริ่มต้น medium ไม่ได้ระบุในหน้าอย่างเป็นทางการของโมเดล
วันสิ้นสุดความรู้ 2026-04-20 2026-04-30
สถานะการเปิดให้ใช้ API ใช้ได้ API ใช้ได้
API model ID
GPT-6 Sol
gpt-6-sol
GPT-6 Astra
gpt-6-astra
ตำแหน่งอย่างเป็นทางการ
GPT-6 Sol
สมดุลระหว่างต้นทุนและความสามารถ
GPT-6 Astra
งานแบบ end-to-end ที่ซับซ้อนที่สุด
หน้าต่างคอนเท็กซ์
GPT-6 Sol
1,050,000 token
GPT-6 Astra
1,050,000 token
เอาต์พุตสูงสุดต่อครั้ง
GPT-6 Sol
128,000 token
GPT-6 Astra
128,000 token
รูปแบบอินพุต/เอาต์พุต
GPT-6 Sol
ข้อความ, รูปภาพ → ข้อความ
GPT-6 Astra
ข้อความ, รูปภาพ → ข้อความ
การอนุมาน effort
GPT-6 Sol
none / low / medium / high / xhigh / max
GPT-6 Astra
low / medium / high / xhigh / max
effort เริ่มต้น
GPT-6 Sol
medium
GPT-6 Astra
ไม่ได้ระบุในหน้าอย่างเป็นทางการของโมเดล
วันสิ้นสุดความรู้
GPT-6 Sol
2026-04-20
GPT-6 Astra
2026-04-30
สถานะการเปิดให้ใช้
GPT-6 Sol
API ใช้ได้
GPT-6 Astra
API ใช้ได้

แหล่งข้อมูล: หน้าอย่างเป็นทางการของ GPT-6 Sol, หน้าอย่างเป็นทางการของ GPT-6 Astra

ข้อมูลจำเพาะ Anthropic Claude Opus 5.5 Claude Fable 5.1
API model ID claude-opus-5-5 claude-fable-5-1
ตำแหน่งอย่างเป็นทางการ งานเขียนโค้ดและงานความรู้ของ agent ระยะยาว งานการอนุมานที่ยากขึ้นและงาน agent ระยะยาว
หน้าต่างคอนเท็กซ์ 1,000,000 token 1,000,000 token
เอาต์พุตสูงสุดต่อครั้ง 128,000 token; Batch beta ถึง 300,000 128,000 token
รูปแบบอินพุต/เอาต์พุต ข้อความ, รูปภาพ → ข้อความ ข้อความ, รูปภาพ → ข้อความ
วิธีการอนุมาน adaptive thinking เปิดตลอดเวลา adaptive thinking เปิดตลอดเวลา
effort เริ่มต้น medium high
วันสิ้นสุดความรู้ 2026-06 2026-06
สถานะการเปิดให้ใช้ Claude API ใช้ได้ Claude API ใช้ได้
API model ID
Claude Opus 5.5
claude-opus-5-5
Claude Fable 5.1
claude-fable-5-1
ตำแหน่งอย่างเป็นทางการ
Claude Opus 5.5
งานเขียนโค้ดและงานความรู้ของ agent ระยะยาว
Claude Fable 5.1
งานการอนุมานที่ยากขึ้นและงาน agent ระยะยาว
หน้าต่างคอนเท็กซ์
Claude Opus 5.5
1,000,000 token
Claude Fable 5.1
1,000,000 token
เอาต์พุตสูงสุดต่อครั้ง
Claude Opus 5.5
128,000 token; Batch beta ถึง 300,000
Claude Fable 5.1
128,000 token
รูปแบบอินพุต/เอาต์พุต
Claude Opus 5.5
ข้อความ, รูปภาพ → ข้อความ
Claude Fable 5.1
ข้อความ, รูปภาพ → ข้อความ
วิธีการอนุมาน
Claude Opus 5.5
adaptive thinking เปิดตลอดเวลา
Claude Fable 5.1
adaptive thinking เปิดตลอดเวลา
effort เริ่มต้น
Claude Opus 5.5
medium
Claude Fable 5.1
high
วันสิ้นสุดความรู้
Claude Opus 5.5
2026-06
Claude Fable 5.1
2026-06
สถานะการเปิดให้ใช้
Claude Opus 5.5
Claude API ใช้ได้
Claude Fable 5.1
Claude API ใช้ได้

แหล่งข้อมูล: หน้าอย่างเป็นทางการของ Opus 5.5, หน้าอย่างเป็นทางการของ Fable 5.1 เอาต์พุต 300K ของ Opus ใช้ได้เฉพาะกับ Batch beta ที่กำหนดและ header output-300k-2026-03-24 เท่านั้น ไม่ใช่ขีดจำกัดของคำขอแบบโต้ตอบทั่วไป

การคิดค่าบริการของทั้งสี่โมเดล: อินพุตทั่วไป การเขียนแคช และการเข้าถึงแคชเป็นโทเค็นที่แตกต่างกัน

ตารางด้านล่างทั้งหมดเป็น ราคาดอลลาร์ต่อล้านโทเค็น ซึ่งเป็นราคาต่อหน่วยของประเภทโทเค็นนั้นๆ อินพุตทั่วไปจะไม่บวก "ค่าธรรมเนียมการเขียนแคช" เพิ่มเติม; เฉพาะโทเค็นที่เขียนเข้าแคชครั้งแรกเท่านั้นที่ใช้ราคาการเขียน หลังจากการเข้าถึงแคชจะคิดตามราคาการอ่าน เอาต์พุตยังคงคิดแยก ทั้งสองบริษัทมีส่วนลด Batch 50% สำหรับอินพุต/เอาต์พุต แต่ Batch เป็นการประมวลผลแบบอะซิงโครนัส ไม่เหมาะสำหรับการสนทนาเขียนโค้ดที่ต้องการผลตอบรับทันที

API มาตรฐาน OpenAI GPT-6 Sol GPT-6 Astra
อินพุตทั่วไป $2.00 $10.00
การเขียนแคช $2.50 $12.50
การอ่านแคช $0.20 $1.00
เอาต์พุต $10.00 $50.00
อินพุต/เอาต์พุต Batch $1.00 / $5.00 $5.00 / $25.00
อินพุตเกิน 272K คำขอทั้งครั้งค่าอินพุตและแคช ×2 ค่าเอาต์พุต ×1.5 คำขอทั้งครั้งค่าอินพุตและแคช ×2 ค่าเอาต์พุต ×1.5
อินพุตทั่วไป
GPT-6 Sol
$2.00
GPT-6 Astra
$10.00
การเขียนแคช
GPT-6 Sol
$2.50
GPT-6 Astra
$12.50
การอ่านแคช
GPT-6 Sol
$0.20
GPT-6 Astra
$1.00
เอาต์พุต
GPT-6 Sol
$10.00
GPT-6 Astra
$50.00
อินพุต/เอาต์พุต Batch
GPT-6 Sol
$1.00 / $5.00
GPT-6 Astra
$5.00 / $25.00
อินพุตเกิน 272K
GPT-6 Sol
คำขอทั้งครั้งค่าอินพุตและแคช ×2 ค่าเอาต์พุต ×1.5
GPT-6 Astra
คำขอทั้งครั้งค่าอินพุตและแคช ×2 ค่าเอาต์พุต ×1.5

แหล่งที่มา: Sol, Astra, ตารางราคา OpenAI, คำอธิบายแคช OpenAI การเกิน 272K ไม่ได้บวกเพิ่มเฉพาะส่วนที่เกิน; การคิดค่าบริการว่าข้ามเส้นหรือไม่คำนวณจาก โทเค็นอินพุตของทั้งคำขอ รวมถึงอินพุตที่เกี่ยวข้องกับแคช

API มาตรฐาน Anthropic Claude Opus 5.5 Claude Fable 5.1
อินพุตทั่วไป $4.00 $10.00
การเขียนแคช 5 นาที $5.00 $12.50
การเขียนแคช 1 ชั่วโมง $8.00 $20.00
การอ่านแคช $0.20 $0.25
เอาต์พุต $20.00 $50.00
อินพุต/เอาต์พุต Batch $2.00 / $10.00 $5.00 / $25.00
คอนเท็กซ์ยาว 1M ราคาต่อหน่วยมาตรฐาน ไม่มีส่วนเพิ่ม >200K ราคาต่อหน่วยมาตรฐาน ไม่มีส่วนเพิ่ม >200K
อินพุตทั่วไป
Claude Opus 5.5
$4.00
Claude Fable 5.1
$10.00
การเขียนแคช 5 นาที
Claude Opus 5.5
$5.00
Claude Fable 5.1
$12.50
การเขียนแคช 1 ชั่วโมง
Claude Opus 5.5
$8.00
Claude Fable 5.1
$20.00
การอ่านแคช
Claude Opus 5.5
$0.20
Claude Fable 5.1
$0.25
เอาต์พุต
Claude Opus 5.5
$20.00
Claude Fable 5.1
$50.00
อินพุต/เอาต์พุต Batch
Claude Opus 5.5
$2.00 / $10.00
Claude Fable 5.1
$5.00 / $25.00
คอนเท็กซ์ยาว 1M
Claude Opus 5.5
ราคาต่อหน่วยมาตรฐาน ไม่มีส่วนเพิ่ม >200K
Claude Fable 5.1
ราคาต่อหน่วยมาตรฐาน ไม่มีส่วนเพิ่ม >200K

แหล่งที่มา: Opus 5.5, Fable 5.1, ราคาและกฎ Batch/แคชของ Anthropic, คำอธิบายคอนเท็กซ์ยาว Anthropic อนุญาตให้ใช้ส่วนลด Batch และแคชร่วมกันได้อย่างชัดเจน; การเข้าถึงแคชต้องเป็นไปตามอายุการใช้งานและเงื่อนไขคำนำหน้าที่เหมือนกัน

คะแนนเฉพาะของทั้งสี่โมเดลภายใต้ระบบการประเมินเดียวกัน

ตารางด้านล่างทั้งหมดมาจาก Artificial Analysis Intelligence Index v4.3.2 การตั้งค่าการทดสอบคือ GPT-6 Sol max, GPT-6 Astra max, Claude Opus 5.5 และ Fable 5.1 ใช้ adaptive reasoning max effort และเปิดใช้ default fallback ทั้งหมด พวกมันไม่ใช่ระดับเริ่มต้นของทั้งสี่โมเดล โดยเฉพาะ Opus เริ่มต้นที่ medium, Fable เริ่มต้นที่ high; แม้โมเดลต่างกันจะระบุ max เหมือนกัน ปริมาณโทเค็นการอนุมานจริงก็ต่างกัน AA ใช้งานและ harness ของตนเอง ดังนั้นจึงสามารถดูผลลัพธ์ตามขวางภายในค่าการทดสอบนี้; คะแนนจากการเปิดตัวของผู้ผลิตไม่สามารถปนเข้าในตารางนี้ได้ ลิงก์: การเปรียบเทียบดั้งเดิม Sol–Opus, การเปรียบเทียบดั้งเดิม Astra–Fable, วิธีการของ AA

งานวิศวกรรมและภาพรวม AA Sol Opus 5.5 Astra Fable 5.1
ดัชนีรวม v4.3.2 (คะแนน) 48 58 53 53
Terminal-Bench 4.0 (อัตราการผ่าน) 44% 60% 59% 52%
AutomationBench-AA (อัตราความสำเร็จ) 62% 70% 68% 59%
SciCode (อัตราการผ่าน) 58% 67% 56% 63%
AA-LCR v1.1 คอนเท็กซ์ยาว (อัตราการผ่าน) 84% 85% 81% 85%
ดัชนีรวม v4.3.2 (คะแนน)
Sol
48
Opus 5.5
58
Astra
53
Fable 5.1
53
Terminal-Bench 4.0 (อัตราการผ่าน)
Sol
44%
Opus 5.5
60%
Astra
59%
Fable 5.1
52%
AutomationBench-AA (อัตราความสำเร็จ)
Sol
62%
Opus 5.5
70%
Astra
68%
Fable 5.1
59%
SciCode (อัตราการผ่าน)
Sol
58%
Opus 5.5
67%
Astra
56%
Fable 5.1
63%
AA-LCR v1.1 คอนเท็กซ์ยาว (อัตราการผ่าน)
Sol
84%
Opus 5.5
85%
Astra
81%
Fable 5.1
85%

แหล่งที่มาของค่าตัวเลขแต่ละแถวคือ หน้าเปรียบเทียบโมเดลเวอร์ชันเดียวกันของ AA ทั้งสองหน้าและ หน้า Astra–Fable ตัวอย่างเช่นใน Terminal-Bench 4.0 harness ของ AA เอง Opus 5.5 สูงกว่า Sol 16 เปอร์เซ็นต์; ซึ่งไม่สามารถนำไปคำนวณรวมกับ 66.4% บนเว็บไซต์ Anthropic ได้ เพราะการตั้งค่าการทำงานต่างกัน

งานความรู้และงานวิชาชีพ AA Sol Opus 5.5 Astra Fable 5.1
AA-Briefcase v1.1 (Elo) 1483 1822 1569 1678
GDPval-AA v2.1 (Elo) 1487 1846 1542 1735
Humanity's Last Exam (อัตราการผ่าน) 48% 61% 55% 59%
GDP.pdf (อัตราการผ่านทั้งหมด) 25% 26% 31% 26%
CritPt (อัตราการผ่าน) 31% 32% 32% 30%
AA-Omniscience (คะแนนดัชนี ไม่ใช่เปอร์เซ็นต์) 27 46 43 43
AA-Briefcase v1.1 (Elo)
Sol
1483
Opus 5.5
1822
Astra
1569
Fable 5.1
1678
GDPval-AA v2.1 (Elo)
Sol
1487
Opus 5.5
1846
Astra
1542
Fable 5.1
1735
Humanity's Last Exam (อัตราการผ่าน)
Sol
48%
Opus 5.5
61%
Astra
55%
Fable 5.1
59%
GDP.pdf (อัตราการผ่านทั้งหมด)
Sol
25%
Opus 5.5
26%
Astra
31%
Fable 5.1
26%
CritPt (อัตราการผ่าน)
Sol
31%
Opus 5.5
32%
Astra
32%
Fable 5.1
30%
AA-Omniscience (คะแนนดัชนี ไม่ใช่เปอร์เซ็นต์)
Sol
27
Opus 5.5
46
Astra
43
Fable 5.1
43

แหล่งที่มาของค่าตัวเลขแต่ละแถว: AA Sol–Opus, AA Astra–Fable ความแตกต่างเล็กน้อย 1–2 เปอร์เซ็นต์ไม่ควรตีความเป็นชัยชนะที่แน่นอน; Elo, คะแนนดัชนี และอัตราการผ่านก็ไม่ใช่หน่วยเดียวกัน

ต้นทุนและปริมาณการใช้ในการทดสอบ AA Sol Opus 5.5 Astra Fable 5.1
ต้นทุนเฉลี่ยต่องานดัชนี $1.06 $5.98 $3.26 $7.63
โทเค็นเอาต์พุตเฉลี่ยต่องาน 31K 119K 27K 78K
โดยเป็นโทเค็นการอนุมาน 21K 84K 17K 47K
ต้นทุนเฉลี่ยต่องานดัชนี
Sol
$1.06
Opus 5.5
$5.98
Astra
$3.26
Fable 5.1
$7.63
โทเค็นเอาต์พุตเฉลี่ยต่องาน
Sol
31K
Opus 5.5
119K
Astra
27K
Fable 5.1
78K
โดยเป็นโทเค็นการอนุมาน
Sol
21K
Opus 5.5
84K
Astra
17K
Fable 5.1
47K

แหล่งที่มายังคงเป็น AA Sol–Opus และ AA Astra–Fable ต้นทุนต่องานเป็นค่าเฉลี่ยถ่วงน้ำหนักจากการใช้ในการทดสอบ AA ไม่ใช่ราคาเสนอสำหรับ "ทำงานหนึ่งความต้องการ" ในที่เก็บโค้ดของคุณ การกำหนดค่า max ของ Opus ใช้โทเค็นเอาต์พุตและการอนุมานมากกว่า ซึ่งเป็นหนึ่งในสาเหตุที่ทำให้ช่องว่างของบิลมากกว่าช่องว่างของราคาต่อหน่วย

แผนภูมิจากเว็บไซต์ทางการของทั้งสองบริษัท: ยืนยันข้อสรุปของแต่ละฝ่ายได้ แต่ไม่สามารถประกอบเป็นผลแพ้ชนะในสนามเดียวกันได้

แผนภูมิ DeepSWE v1.1 ของ OpenAI แสดง GPT-6 Sol max ที่ 68.8% ในแผนภูมิ Claude Fable 5 xhigh อยู่ที่ 69.9%; ไม่มี Opus 5.5 แกนนอนคือต้นทุนต่องาน สเกลลอการิทึม ในแผนภูมิ Opus 5 ก็ไม่ใช่ Opus 5.5 เช่นกัน มันแสดงว่า Sol ภายใต้การตั้งค่าที่ OpenAI เปิดเผยมีคะแนนตัวแทนเขียนโค้ดใกล้เคียงโมเดลระดับสูง แต่ไม่สามารถแทนการทดสอบสี่โมเดลในสนามเดียวกันได้

แผนภูมิ DeepSWE v1.1 อย่างเป็นทางการของ OpenAI: GPT-6 Sol max อยู่ที่ 68.8% ในแผนภูมิไม่มี Opus 5.5

รูปที่ 1: OpenAI "Introducing GPT-6 Sol and Luna" "Coding", 2026-09-22 โมเดลและ effort ให้ยึดตามคำอธิบายในแผนภูมิและเชิงอรรถต้นฉบับ เปิดภาพต้นฉบับเต็มเพื่อดูตัวอักษรเล็ก

แผนภูมิ Terminal-Bench 4.0 ของ Anthropic แสดง Claude Opus 5.5 xhigh ที่ 66.4% ในแผนภูมิ GPT-6 Astra 57.9% ใช้ high ไม่ใช่ GPT-6 Sol เส้นโค้งมีจุดของ effort เริ่มต้นด้วย แต่ไม่สามารถนำตำแหน่งนั้นมาเป็นคะแนน xhigh ได้ harness ของผู้ผลิตที่นี่แตกต่างจาก Terminal-Bench 4.0 ในตาราง AA ด้านบน ไม่สามารถนำ 66.4% ลบด้วย 44% ที่ AA ให้ Sol ได้

แผนภูมิ Terminal-Bench 4.0 อย่างเป็นทางการของ Anthropic: Opus 5.5 xhigh อยู่ที่ 66.4% ในแผนภูมิไม่มี GPT-6 Sol

รูปที่ 2: Anthropic "Claude Opus 5.5" "Coding", 2026-09-22 แกนนอนคือต้นทุนต่อการลองแต่ละครั้ง สเกลลอการิทึม; ระดับที่แสดง ช่วงสถิติ และข้อจำกัดดูได้ในต้นฉบับ เปิดภาพต้นฉบับเต็มเพื่อดูตัวอักษรเล็ก

ยังมีคะแนนที่ผู้ผลิตแต่ละรายเปิดเผยฝ่ายเดียวแต่ไม่ควรนำมาลบกันโดยตรง: OpenAI รายงาน Sol xhigh ใน AutomationBench 1.0.6 อยู่ที่ 33.2%, max ใน Agents' Last Exam V1 อยู่ที่ 56.4%, xhigh ใน OSWorld 2.0 offline อยู่ที่ 60.5% แหล่งที่มาเดียวกันกับ หน้าเผยแพร่ OpenAI; Anthropic รายงาน Opus 5.5 ใน FrontierCode v1.1 Main 54.4%, CursorBench 4.0 57.8%, GDPval-AA v2.1 1846 Elo, Humanity's Last Exam with tools 67.7% แหล่งที่มาเดียวกันกับ หน้าเผยแพร่ Anthropic เวอร์ชัน เครื่องมือ effort หรือ harness ของรายการเหล่านี้ไม่ได้รับการยืนยันว่าตรงกับอีกฝ่าย จึงไม่ระบุว่า "นำอยู่เท่าไร" ค่าที่ไม่ได้เปิดเผยของสี่โมเดลในเกณฑ์เดียวกันไม่สามารถคาดเดาเพิ่มได้

งานปริมาณเดียวกันต้องจ่ายเท่าไร? ห้าตัวอย่างที่คำนวณซ้ำได้

ด้านล่างแบ่งอินพุตออกเป็นสามประเภทโทเค็นที่ไม่ทับซ้อนกัน: อินพุตทั่วไป การเขียนแคชครั้งแรก และการอ่านแคชในภายหลัง แล้วบวกเอาต์พุต แต่ละแถวเป็น คำขอหนึ่งครั้ง ไม่รวมการเรียกเครื่องมือ ค่าธรรมเนียมแพลตฟอร์มเพิ่มเติม หรือรอบเพิ่มเติม; เอาต์พุตทั้งหมดต่ำกว่าขีดจำกัด 128K ของคำขอทั่วไป ราคาคำนวณตามราคาอย่างเป็นทางการด้านบน ดังนั้นสามารถแทนจำนวนโทเค็นตามบันทึกการใช้งาน (usage log) ของคุณได้

สถานการณ์และปริมาณโทเค็น Sol Opus 5.5 Astra Fable 5.1
A ทั่วไป: อินพุตใหม่ 100K + เอาต์พุต 50K $0.70 $1.40 $3.50 $3.50
B เขียนแคชครั้งแรก: เขียน 200K + อินพุตใหม่ 50K + เอาต์พุต 20K $0.80 $1.60 (5m) / $2.20 (1h) $4.00 $4.00 (5m) / $5.50 (1h)
C เข้าถึงแคชในภายหลัง: อ่านแคช 200K + อินพุตใหม่ 50K + เอาต์พุต 20K $0.34 $0.64 $1.70 $1.55
D เวอร์ชันอะซิงโครนัส Batch ของ A: อินพุตใหม่ 100K + อาต์พุต 50K $0.35 $0.70 $1.75 $1.75
E อินพุตยาว: อินพุตใหม่ 300K + เอาต์พุต 20K $1.50 $1.60 $7.50 $4.00
A ทั่วไป: อินพุตใหม่ 100K + เอาต์พุต 50K
Sol
$0.70
Opus 5.5
$1.40
Astra
$3.50
Fable 5.1
$3.50
B เขียนแคชครั้งแรก: เขียน 200K + อินพุตใหม่ 50K + เอาต์พุต 20K
Sol
$0.80
Opus 5.5
$1.60 (5m) / $2.20 (1h)
Astra
$4.00
Fable 5.1
$4.00 (5m) / $5.50 (1h)
C เข้าถึงแคชในภายหลัง: อ่านแคช 200K + อินพุตใหม่ 50K + เอาต์พุต 20K
Sol
$0.34
Opus 5.5
$0.64
Astra
$1.70
Fable 5.1
$1.55
D เวอร์ชันอะซิงโครนัส Batch ของ A: อินพุตใหม่ 100K + อาต์พุต 50K
Sol
$0.35
Opus 5.5
$0.70
Astra
$1.75
Fable 5.1
$1.75
E อินพุตยาว: อินพุตใหม่ 300K + เอาต์พุต 20K
Sol
$1.50
Opus 5.5
$1.60
Astra
$7.50
Fable 5.1
$4.00

ตัวอย่างการคำนวณ: A ของ Sol = 0.1×$2 + 0.05×$10 = $0.70 B ของ Opus 5m = 0.2×$5 + 0.05×$4 + 0.02×$20 = $1.60; C ของ Opus = 0.2×$0.20 + 0.05×$4 + 0.02×$20 = $0.64 อินพุตของ Sol ใน E 300K เกิน 272K แล้ว คิดทั้งครั้งที่อินพุต $4 เอาต์พุต $15; Astra เทียบเท่าคือ $20/$75 คอนเท็กซ์ 1M ของ Opus/Fable คงราคาต่อหน่วยมาตรฐาน B กับ C เป็นคำขอที่เขียนก่อนแล้วอ่านทีหลังที่แตกต่างกัน; C ต้องแน่ใจว่าแคชยังมีผลอยู่ ระยะเวลาเก็บแคชของ OpenAI กับกลไกคิดค่าบริการ 5m/1h ของ Anthropic ต่างกัน ไม่สามารถนำค่าธรรมเนียมการเขียนของ B ไปบวกผิดกับทุกคำขอของ C ได้ หลักฐาน: ราคาสองโมเดลของ OpenAI, กฎราคาของ Anthropic

เมื่อนำไปใช้ในเวิร์กโฟลว์การเขียนโค้ดจริง จะแบ่งงานอย่างไร?

Sol ใช้สำหรับการวนซ้ำประจำวันก่อน การแบ่งย่อยความต้องการ การแก้ไขเล็กน้อยในที่เก็บโค้ดที่มีอยู่ แพตช์การทดสอบ และงานที่ตรวจสอบซ้ำเป็นชุดได้ ให้ Sol จัดการก่อน แล้วบันทึกอัตราความสำเร็จของงาน จำนวนครั้งที่ต้องแก้ไขใหม่ และโทเค็นรวม ราคาต่อหน่วยต่ำของมันตรงไปตรงมาที่สุดในตัวอย่าง A–D ที่ไม่เกิน 272K; ข้อได้เปรียบด้านราคาของคำขอยาวมากจะลดลง

Opus 5.5 จัดการงานตัวแทนที่ยากต่อการบรรจบในครั้งเดียว การทดสอบในสนามเดียวกันของ AA ให้คะแนนสูงกว่าในงานภาพรวม เทอร์มินัล และงานความรู้ แต่ภายใต้การกำหนดค่า max ต้นทุนเฉลี่ยต่องานก็สูงขึ้นอย่างชัดเจนเช่นกัน สามารถสร้างพื้นฐานในเครื่องด้วย medium เริ่มต้นหรือ effort ที่คุณใช้จริงก่อน แล้วจึงเพิ่มระดับสำหรับโจทย์ยาก อย่านำผลลัพธ์ max ของ AA มาเป็นประสบการณ์เริ่มต้น

Astra กับ Fable 5.1 เป็นระดับที่สูงขึ้น Astra มีผลงานที่แข่งขันได้ใน AutomationBench-AA, Terminal-Bench 4.0 และ GDP.pdf ของ AA ส่วน Fable 5.1 แข็งแกร่งกว่าในบางตัวชี้วัดของงานความรู้ระยะยาว แต่ราคาอินพุต/เอาต์พุตพื้นฐาน $10/$50 ของทั้งสองสูงกว่า Sol อย่างมีนัยสำคัญ การอ่านแคชของ Fable อยู่ที่ $0.25 ต่ำกว่าของ Astra ที่ $1.00; หากอ่านคำนำหน้าขนาดใหญ่ซ้ำ ลำดับต้นทุนอาจเปลี่ยน สำหรับงานยากแนะนำให้ทำการตรวจรับตัวอย่างเล็กของทั้งสี่โมเดลกับความต้องการในที่เก็บโค้ดเดียวกัน เลือกตาม "ต้นทุนของงานที่ทำสำเร็จและรวมได้" ไม่ใช่เลือกตามคะแนนจากตารางเดียว

ใน PandaNpc, Codex และ Claude Code เป็น Agent Engine สองแบบที่ใช้ได้ เมื่อเลือกทาง้องดูการสมัครสมาชิกหรือช่อง API ที่คุณมีอยู่ สิทธิ์เครื่องมือ คอนเท็กซ์ในที่เก็บโค้ด และกระบวนการตรวจสอบของทีมด้วย; ราคา API ของโมเดลไม่สามารถแปลงเป็นโควตาการสมัครสมาชิกเครื่องมือได้โดยตรง บทความนี้แสดงข้อมูลจำเพาะและการประเมินที่เปิดเผยต่อสาธารณะ ไม่ได้อ้างอิงอันดับการทดสอบจริงของทั้งสี่โมเดลภายใน PandaNpc

คำถามที่พบบ่อย (FAQ)

Sol ถูกกว่า Opus 5.5 ครึ่งหนึ่งเสมอหรือไม่? เฉพาะราคาต่อหน่วยอินพุตและเอาต์พุตของ API มาตรฐานเท่านั้นที่เป็นครึ่งหนึ่ง การเกิน 272K อินพุต การเขียน/อ่านแคช โทเค็นการอนุมานจริง จำนวนรอบ และค่าธรรมเนียมเครื่องมือ ล้วนเปลี่ยนบิลของงานทั้งงานได้ สถานการณ์ E ด้านบนทำให้ราคาต่อครั้งของทั้งสองใกล้กันเป็น $1.50 และ $1.60 แล้ว

แผนภูมิเขียนโค้ดอย่างเป็นทางการสองภาพพิสูจน์ได้ไหมว่าใครชนะ? ไม่ได้ แผนภูมิ OpenAI ไม่มี Opus 5.5 แผนภูมิ Anthropic ไม่มี Sol และเกณฑ์มาตรฐานกับ harness ก็ต่างกัน หากต้องการดูผลลัพธ์สี่โมเดลในสนามเดียวกัน ให้ดูตารางการกำหนดค่าคงที่ของ AA v4.3.2; หากต้องการตัดสินใจเลือกเครื่องมือของตนเอง ต้องรันงานในที่เก็บโค้ดของคุณเองซ้ำ

แคชกับ Batch ใช้ร่วมกันได้ไหม? เอกสารราคาของ Anthropic รองรับการใช้ร่วมกันอย่างชัดเจน; การเข้าถึงแคชจริงหรือไม่ขึ้นอยู่กับคำนำหน้า อายุการใช้งาน และการตั้งค่าคำขอ Batch ของสองโมเดล OpenAI เป็น 50% ของอัตรามาตรฐาน สำหรับบิลที่เฉพาะเจาะจงโปรดตรวจสอบกับบันทึกการใช้งาน API ที่เกี่ยวข้อง

GPT-6 Astra เทียบกับ Claude Fable 5.1: เปรียบเทียบการเขียนโปรแกรม Agent ราคา และคะแนน Benchmark

GPT-6 Astra เทียบกับ Claude Fable 5.1: เปรียบเทียบการเขียนโปรแกรม Agent ราคา และคะแนน Benchmark

GPT-6 Astra และ Claude Fable 5.1 เปิดให้ใช้งานสาธารณะแล้ว ทั้งคู่เป็นโมเดลเรือธงที่ราคา 10 ดอลลาร์ต่ออินพุต 1 ล้าน token และ 50 ดอลลาร์ต่อเอาต์พุต 1 ล้าน token แต่ต่างก็มีข้อแลกเปลี่ยนในด้านการเขียนโปรแกรม การควบคุมคอมพิวเตอร์ งานระยะยาว ต้นทุนแคช และบริบท บทความนี้เปรียบเทียบเป็นรายข้อโดยใช้เกณฑ์ร่วมกัน และให้วิธีเลือกโมเดลตามประเภทงาน

อ่านบทความ →
Codex เปิดใช้งาน GPT-5.6 Sol 1M บริบท: บทช่วยสอนการกำหนดค่า 3 บรรทัดใน `config.toml`

Codex เปิดใช้งาน GPT-5.6 Sol 1M บริบท: บทช่วยสอนการกำหนดค่า 3 บรรทัดใน `config.toml`

GPT-5.6 Sol รองรับบริบท 1.05 ล้าน token อย่างเป็นทางการ เพียงเพิ่มการกำหนดค่า 3 บรรทัดที่ด้านบนของ config.toml ของ Codex ก็สามารถรันด้วยหน้าต่าง 1 ล้าน และบีบอัดประวัติอัตโนมัติที่ประมาณ 9 แสน token พร้อมการกำหนดค่าแบบถาวร คำสั่งครั้งเดียว การตรวจสอบ และการแจ้งเตือนค่าใช้จ่าย

อ่านบทความ →
Claude Fable 5.1 เจาะลึกทุกมุม: เกณฑ์มาตรฐาน การปรับปรุง ราคา และความเร็ว

Claude Fable 5.1 เจาะลึกทุกมุม: เกณฑ์มาตรฐาน การปรับปรุง ราคา และความเร็ว

ผลคะแนนเต็มรูปแบบของ Claude Fable 5.1 บนเกณฑ์มาตรฐานหลัก 7 ประเภท เทียบรายการกับ Fable 5, Opus 5, GPT-5.6 Sol พร้อมอธิบายงานระยะยาว การเรียกใช้เครื่องมือ ค่าใช้จ่ายแคช ความเร็ว ข้อจำกัดของแพ็กเกจ และการเปลี่ยนแปลงการย้ายระบบของ 5.1

อ่านบทความ →