GPT-6 Sol vs Claude Opus 5.5: цены, результаты тестов и как выбирать для задач программирования?
Для обычных задач программирования через API сначала попробуйте GPT-6 Sol; для сложных задач можно сравнить с Claude Opus 5.5, а GPT-6 Astra и Claude Fable 5.1 рассматривать как варианты повышенной сложности. В этой статье сверяются официальные спецификации четырёх моделей, цены на кэширование и Batch, сопоставимые сторонние бенчмарки, а также приводятся пять сценариев затрат с воспроизводимым расчётом.

Сначала вывод: для обычных задач программирования через API можно сначала попробовать GPT-6 Sol. Его стандартная цена ввода/вывода $2/$10 за миллион токенов, то есть вдвое меньше, чем у Claude Opus 5.5; в конфигурации самого высокого уровня в рамках одной системы оценки Artificial Analysis (AA) сводный индекс Opus 5.5 составляет 58, а Sol — 48. Это не отношение «та же цена, но мощнее»: сначала сравните на задачах из собственного репозитория долю успешных прохождений с первого раза, число раундов, общее количество токенов и объём ручных доработок, а затем решайте, платить ли за более высокие результаты Opus. Для более сложных длительных задач можно подняться до GPT-6 Astra или Claude Fable 5.1; цена и возможности четырёх моделей располагаются не в одном и том же порядке.
Мы развиваем PandaNpc, поддерживающий Codex и Claude Code, поэтому у нас есть продуктовый сценарий использования; в этой статье мы не проводили собственный тест четырёх моделей на одних и тех же задачах и не выдаём приведённые ниже публичные оценки за наши собственные измерения. Под ценой понимается стоимость API модели, а не цена подписки на инструмент. Данные проверены 23 сентября 2026 года, все суммы — в долларах США.
Характеристики четырёх моделей: сначала разберёмся с объёмом, выводом и режимами по умолчанию
Для удобства чтения на смартфоне таблица ниже сгруппирована по OpenAI и Anthropic; «максимальный вывод» — это верхний предел для одного ответа, а контекст — окно, доступное суммарно для ввода и вывода, и он не означает, что каждый раз можно выдать такой же объём. ID модели API можно напрямую использовать для сверки счёта или конфигурации оценки.
| Характеристики OpenAI | GPT-6 Sol | GPT-6 Astra |
|---|---|---|
| ID модели API | gpt-6-sol |
gpt-6-astra |
| Официальное позиционирование | Баланс стоимости и возможностей | Самые сложные сквозные задачи |
| Окно контекста | 1 050 000 токенов | 1 050 000 токенов |
| Макс. вывод за один ответ | 128 000 токенов | 128 000 токенов |
| Модальности ввода/вывода | Текст, изображения → текст | Текст, изображения → текст |
| Reasoning effort | none / low / medium / high / xhigh / max | low / medium / high / xhigh / max |
| Effort по умолчанию | medium | Не указан на официальной странице модели |
| Дата отсечения знаний | 2026-04-20 | 2026-04-30 |
| Статус доступности | Доступно через API | Доступно через API |
- GPT-6 Sol
gpt-6-sol- GPT-6 Astra
gpt-6-astra
- GPT-6 Sol
- Баланс стоимости и возможностей
- GPT-6 Astra
- Самые сложные сквозные задачи
- GPT-6 Sol
- 1 050 000 токенов
- GPT-6 Astra
- 1 050 000 токенов
- GPT-6 Sol
- 128 000 токенов
- GPT-6 Astra
- 128 000 токенов
- GPT-6 Sol
- Текст, изображения → текст
- GPT-6 Astra
- Текст, изображения → текст
- GPT-6 Sol
- none / low / medium / high / xhigh / max
- GPT-6 Astra
- low / medium / high / xhigh / max
- GPT-6 Sol
- medium
- GPT-6 Astra
- Не указан на официальной странице модели
- GPT-6 Sol
- 2026-04-20
- GPT-6 Astra
- 2026-04-30
- GPT-6 Sol
- Доступно через API
- GPT-6 Astra
- Доступно через API
Данные: Официальная страница модели GPT-6 Sol, Официальная страница модели GPT-6 Astra.
| Характеристики Anthropic | Claude Opus 5.5 | Claude Fable 5.1 |
|---|---|---|
| ID модели API | claude-opus-5-5 |
claude-fable-5-1 |
| Официальное позиционирование | Долгосрочное agent-программирование и работа со знаниями | Более сложные рассуждения и долгосрочная agent-работа |
| Окно контекста | 1 000 000 токенов | 1 000 000 токенов |
| Макс. вывод за один ответ | 128 000 токенов; в Batch beta — до 300 000 | 128 000 токенов |
| Модальности ввода/вывода | Текст, изображения → текст | Текст, изображения → текст |
| Способ рассуждений | adaptive thinking, всегда включён | adaptive thinking, всегда включён |
| Effort по умолчанию | medium | high |
| Дата отсечения знаний | 2026-06 | 2026-06 |
| Статус доступности | Доступно через Claude API | Доступно через Claude API |
- Claude Opus 5.5
claude-opus-5-5- Claude Fable 5.1
claude-fable-5-1
- Claude Opus 5.5
- Долгосрочное agent-программирование и работа со знаниями
- Claude Fable 5.1
- Более сложные рассуждения и долгосрочная agent-работа
- Claude Opus 5.5
- 1 000 000 токенов
- Claude Fable 5.1
- 1 000 000 токенов
- Claude Opus 5.5
- 128 000 токенов; в Batch beta — до 300 000
- Claude Fable 5.1
- 128 000 токенов
- Claude Opus 5.5
- Текст, изображения → текст
- Claude Fable 5.1
- Текст, изображения → текст
- Claude Opus 5.5
- adaptive thinking, всегда включён
- Claude Fable 5.1
- adaptive thinking, всегда включён
- Claude Opus 5.5
- medium
- Claude Fable 5.1
- high
- Claude Opus 5.5
- 2026-06
- Claude Fable 5.1
- 2026-06
- Claude Opus 5.5
- Доступно через Claude API
- Claude Fable 5.1
- Доступно через Claude API
Данные: Официальная страница модели Opus 5.5, Официальная страница модели Fable 5.1. Вывод 300K у Opus применяется только к указанной Batch beta и header output-300k-2026-03-24, а не является пределом для обычных интерактивных запросов.
Тарификация четырёх моделей: обычный ввод, запись в кэш и попадание в кэш — это разные токены
Все значения в таблице ниже — цена в долларах США за миллион токенов для соответствующей категории токенов. К обычному вводу дополнительно не прибавляется «плата за запись в кэш»; по цене записи тарифицируются только токены, впервые записываемые в кэш. После попадания в кэш плата взимается по цене чтения, а вывод по-прежнему оплачивается отдельно. У обеих компаний есть 50% скидка на ввод/вывод в Batch, но Batch обрабатывается асинхронно и не подходит для диалогов программирования, где нужна мгновенная обратная связь.
| OpenAI стандартный API | GPT-6 Sol | GPT-6 Astra |
|---|---|---|
| Обычный ввод | $2.00 | $10.00 |
| Запись в кэш | $2.50 | $12.50 |
| Чтение из кэша | $0.20 | $1.00 |
| Вывод | $10.00 | $50.00 |
| Batch ввод/вывод | $1.00 / $5.00 | $5.00 / $25.00 |
| Ввод свыше 272K | Весь запрос: плата за ввод и кэш ×2, за вывод ×1,5 | Весь запрос: плата за ввод и кэш ×2, за вывод ×1,5 |
- GPT-6 Sol
- $2.00
- GPT-6 Astra
- $10.00
- GPT-6 Sol
- $2.50
- GPT-6 Astra
- $12.50
- GPT-6 Sol
- $0.20
- GPT-6 Astra
- $1.00
- GPT-6 Sol
- $10.00
- GPT-6 Astra
- $50.00
- GPT-6 Sol
- $1.00 / $5.00
- GPT-6 Astra
- $5.00 / $25.00
- GPT-6 Sol
- Весь запрос: плата за ввод и кэш ×2, за вывод ×1,5
- GPT-6 Astra
- Весь запрос: плата за ввод и кэш ×2, за вывод ×1,5
Источники: Sol, Astra, Таблица цен OpenAI, Документация OpenAI по кэшированию. Превышение 272K не означает наценку только на превышающую часть; переход через порог для тарификации рассчитывается по входным токенам всего запроса, включая связанный с кэшем ввод.
| Anthropic стандартный API | Claude Opus 5.5 | Claude Fable 5.1 |
|---|---|---|
| Обычный ввод | $4.00 | $10.00 |
| Запись в кэш на 5 минут | $5.00 | $12.50 |
| Запись в кэш на 1 час | $8.00 | $20.00 |
| Чтение из кэша | $0.20 | $0.25 |
| Вывод | $20.00 | $50.00 |
| Batch ввод/вывод | $2.00 / $10.00 | $5.00 / $25.00 |
| Дный контекст 1M | Стандар цена, без наценки >200K | Стандартная цена, без наценки >200K |
- Claude Opus 5.5
- $4.00
- Claude Fable 5.1
- $10.00
- Claude Opus 5.5
- $5.00
- Claude Fable 5.1
- $12.50
- Claude Opus 5.5
- $8.00
- Claude Fable 5.1
- $20.00
- Claude Opus 5.5
- $0.20
- Claude Fable 5.1
- $0.25
- Claude Opus 5.5
- $20.00
- Claude Fable 5.1
- $50.00
- Claude Opus 5.5
- $2.00 / $10.00
- Claude Fable 5.1
- $5.00 / $25.00
- Claude Opus 5.5
- Стандар цена, без наценки >200K
- Claude Fable 5.1
- Стандартная цена, без наценки >200K
чники: Opus 5.5, Fable 5.1, Правила цен Anthropic и Batch/кэширования, Документация по длинному контексту. Anthropic явно разрешает сочетать скидки Batch и кэширования; попадание в кэш должно соответствовать применимому сроку действия и условию одинакового префикса.
Конкретные результаты четырёх моделей в одной системе оценки
Все значения в таблицах ниже взяты из Artificial Analysis Intelligence Index v4.3.2. Конфигурация тестирования: GPT-6 Sol max, GPT-6 Astra max, Claude Opus 5.5 и Fable 5.1 — все с adaptive reasoning max effort и включённым default fallback. Это не режимы по умолчанию для четырёх моделей, особенно если учесть, что у Opus по умолчанию medium, а у Fable — high; даже если у разных моделей указан max, фактический расход токенов на рассуждения различается. AA использует единые задачи и собственный harness, поэтому результаты можно сравнивать по горизонтали в рамках этой тестовой конфигурации; результаты с презентаций производителей нельзя подмешивать в эту таблицу. Ссылки: Исходное сравнение Sol–Opus, Исходное сравнение Astra–Fable, Методология AA.
| AA: сводная оценка и инженерные задачи | Sol | Opus 5.5 | Astra | Fable 5.1 |
|---|---|---|---|---|
| Сводный индекс v4.3.2 (баллы) | 48 | 58 | 53 | 53 |
| Terminal-Bench 4.0 (доля прохождения) | 44% | 60% | 59% | 52% |
| AutomationBench-AA (успешность) | 62% | 70% | 68% | 59% |
| SciCode (доля прохождения) | 58% | 67% | 56% | 63% |
| AA-LCR v1.1 длинный контекст (доля прохождения) | 84% | 85% | 81% | 85% |
- Sol
- 48
- Opus 5.5
- 58
- Astra
- 53
- Fable 5.1
- 53
- Sol
- 44%
- Opus 5.5
- 60%
- Astra
- 59%
- Fable 5.1
- 52%
- Sol
- 62%
- Opus 5.5
- 70%
- Astra
- 68%
- Fable 5.1
- 59%
- Sol
- 58%
- Opus 5.5
- 67%
- Astra
- 56%
- Fable 5.1
- 63%
- Sol
- 84%
- Opus 5.5
- 85%
- Astra
- 81%
- Fable 5.1
- 85%
Источник значений по каждой строке — две указанные выше страницы сравнения моделей одной версии AA и страница Astra–Fable. Например, в собственном harness AA для Terminal-Bench 4.0 Opus 5.5 опережает Sol на 16 процентных пунктов; это нельзя смешивать с 66,4% с официального сайта Anthropic, где используются другие настройки запуска.
| AA: знания и профессиональные задачи | Sol | Opus 5.5 | Astra | Fable 5.1 |
|---|---|---|---|---|
| AA-Briefcase v1.1 (Elo) | 1483 | 1822 | 1569 | 1678 |
| GDPval-AA v2.1 (Elo) | 1487 | 1846 | 1542 | 1735 |
| Humanity's Last Exam (доля прохождения) | 48% | 61% | 55% | 59% |
| GDP.pdf (общая доля прохождения) | 25% | 26% | 31% | 26% |
| CritPt (доля прохождения) | 31% | 32% | 32% | 30% |
| AA-Omniscience (баллы индекса, не проценты) | 27 | 46 | 43 | 43 |
- Sol
- 1483
- Opus 5.5
- 1822
- Astra
- 1569
- Fable 5.1
- 1678
- Sol
- 1487
- Opus 5.5
- 1846
- Astra
- 1542
- Fable 5.1
- 1735
- Sol
- 48%
- Opus 5.5
- 61%
- Astra
- 55%
- Fable 5.1
- 59%
- Sol
- 25%
- Opus 5.5
- 26%
- Astra
- 31%
- Fable 5.1
- 26%
- Sol
- 31%
- Opus 5.5
- 32%
- Astra
- 32%
- Fable 5.1
- 30%
- Sol
- 27
- Opus 5.5
- 46
- Astra
- 43
- Fable 5.1
- 43
Источник значений по каждой строке: AA Sol–Opus, AA Astra–Fable. Небольшую разницу в 1–2 процентных пункта не стоит трактовать как устойчивую победу; Elo, баллы индекса и доля прохождения — тоже не одинаковые единицы измерения.
| Затраты и объём в тестах AA | Sol | Opus 5.5 | Astra | Fable 5.1 |
|---|---|---|---|---|
| Средняя стоимость одной задачи индекса | $1.06 | $5.98 | $3.26 | $7.63 |
| Среднее число выходных токенов на задачу | 31K | 119K | 27K | 78K |
| В том числе reasoning-токены | 21K | 84K | 17K | 47K |
- Sol
- $1.06
- Opus 5.5
- $5.98
- Astra
- $3.26
- Fable 5.1
- $7.63
- Sol
- 31K
- Opus 5.5
- 119K
- Astra
- 27K
- Fable 5.1
- 78K
- Sol
- 21K
- Opus 5.5
- 84K
- Astra
- 17K
- Fable 5.1
- 47K
Источники те же: AA Sol–Opus и AA Astra–Fable. Стоимость задачи — это взвешенное среднее по использованию в тестах AA, а не расценки за «выполнение одного требования» в вашем репозитории. Конфигурация max у Opus расходует больше выходных токенов и токенов рассуждений; это одна из причин, почему разница в счёте превышает разницу в цене за единицу.
Графики с официальных сайтов обеих компаний: подтверждают их собственные выводы, но не складываются в сравнение на одном поле
На графике DeepSWE v1.1 от OpenAI GPT-6 Sol max показывает 68,8%, а Claude Fable 5 с xhigh — 69,9%; Opus 5.5 там нет. По горизонтальной оси — стоимость одной задачи, логарифмическая шкала. Opus 5 на графике — тоже не Opus 5.5. Это показывает, что Sol в настройках, опубликованных OpenAI, достигает результатов программирующего агента, близких к моделям верхнего уровня, но не заменяет тест четырёх моделей на одном поле.

Рис. 1: OpenAI, «Introducing GPT-6 Sol and Luna» раздел «Coding», 2026-09-22. Модели и effort — согласно легенде и сноскам в оригинале. Открыть полное изображение, чтобы рассмотреть мелкий текст.
На графике Terminal-Bench 4.0 от Anthropic Claude Opus 5.5 xhigh показывает 66,4%. Указанный на графике GPT-6 Astra с 57,9% использует high, а не GPT-6 Sol. На кривой также есть точки для effort по умолчанию, но их положение нельзя принимать за оценку для xhigh. Здешний harness производителя отличается от Terminal-Bench 4.0 в таблице AA выше, поэтому нельзя вычитать 44%, которые AA даёт Sol, из 66,4%.

Рис. 2: Anthropic, «Claude Opus 5.5» раздел «Coding», 2026-09-22. По горизонтальной оси — стоимость одной попытки, логарифмическая шкала; показанные режимы, статистические интервалы и ограничения см. в оригинале. Открыть полное изображение, чтобы рассмотреть мелкий текст.
Есть также результаты, опубликованные только одной из сторон, которые не следует напрямую вычитать: OpenAI сообщает для Sol xhigh в AutomationBench 1.0.6 — 33,2%, для max в Agents' Last Exam V1 — 56,4%, для xhigh в OSWorld 2.0 offline — 60,5%, источник тот же — страница публикации OpenAI; Anthropic сообщает для Opus 5.5 FrontierCode v1.1 Main — 54,4%, CursorBench 4.0 — 57,8%, GDPval-AA v2.1 — 1846 Elo, Humanity's Last Exam with tools — 67,7%, источник тот же — страница публикации Anthropic. Не подтверждено, что версии, инструменты, effort или harness в этих проектах совпадают с другой стороной, поэтому мы не указываем, «на сколько впереди». Неопубликованные значения четырёх моделей в одинаковых условиях нельзя додумывать.
Сколько это стоит при одном и том же объёме задач? Пять примеров, которые можно пересчитать
Ниже ввод разделён на три взаимоисключающие категории токенов: обычный, первая запись в кэш и последующее чтение из кэша, — плюс вывод. Каждая строка — это один запрос, без вызовов инструментов, платформенных надбавок или дополнительных раундов; вывод во всех случаях ниже предела 128K для обычного запроса. Цены рассчитаны по официальным тарифам выше, поэтому количество токенов можно заменить на данные из собственного журнала usage.
| Сценарий и расход токенов | Sol | Opus 5.5 | Astra | Fable 5.1 |
|---|---|---|---|---|
| A Обычный: 100K нового ввода + 50K вывода | $0.70 | $1.40 | $3.50 | $3.50 |
| B Первая запись в кэш: 200K записи + 50K нового ввода + 20K вывода | $0.80 | $1.60 (5m) / $2.20 (1h) | $4.00 | $4.00 (5m) / $5.50 (1h) |
| C Последующее попадание: 200K чтения из кэша + 50K нового ввода + 20K вывода | $0.34 | $0.64 | $1.70 | $1.55 |
| D Асинхронная Batch-версия A: 100K нового ввода + 50K вывода | $0.35 | $0.70 | $1.75 | $1.75 |
| Eлинный ввод: 300K нового ввода + 20K вывода | $1.50 | $1.60 | $7.50 | $4.00 |
- Sol
- $0.70
- Opus 5.5
- $1.40
- Astra
- $3.50
- Fable 5.1
- $3.50
- Sol
- $0.80
- Opus 5.5
- $1.60 (5m) / $2.20 (1h)
- Astra
- $4.00
- Fable 5.1
- $4.00 (5m) / $5.50 (1h)
- Sol
- $0.34
- Opus 5.5
- $0.64
- Astra
- $1.70
- Fable 5.1
- $1.55
- Sol
- $0.35
- Opus 5.5
- $0.70
- Astra
- $1.75
- Fable 5.1
- $1.75
- Sol
- $1.50
- Opus 5.5
- $1.60
- Astra
- $7.50
- Fable 5.1
- $4.00
Примеры расчёта: A для Sol = 0.1×$2 + 0.05×$10 = $0.70. B для Opus 5m = 0.2×$5 + 0.05×$4 + 0.02×$20 = $1.60; C для Opus = 0.2×$0.20 + 0.05×$4 + 0.02×$20 = $0.64. В E ввод Sol 300K уже превышает 272K, весь запрос считается по $4 за ввод и $15 за вывод; для Astra соответственно $20/$75. У Opus/Fable контекст 1M сохраняет стандартную цену. B и C — разные запросы: сначала запись, затем чтение; в C нужно убедиться, что кэш ещё действителен. Срок хранения кэша у OpenAI и механизм тарификации 5m/1h у Anthropic различаются, поэтому плату за запись из B нельзя по ошибке добавлять к каждому запросу C. Основания: Цены двух моделей OpenAI, Правила цен Anthropic.
Как распределить роли в реальном рабочем процессе программирования?
Sol сначала выполняет повседневные итерации. Разбор требований, небольшие изменения в существующем репозитории, патчи тестов и работу, которую можно массово проверять, сначала поручайте Sol, а затем фиксируйте долю успешных задач, число доработок и общее количество токенов. Его низкая цена наиболее заметна в примерах A–D, где не превышен порог 272K; на сверхдлинных запросах ценовое преимущество уменьшается.
Opus 5.5 берёт на себя agent-задачи, которые трудно свести к решению с первого раза. В тестах AA на одном поле он показывает более высокие результаты в сводной оценке, терминале и работе со знаниями, но в конфигурации max средняя стоимость одной задачи тоже заметно выше. Сначала можно построить локальную базовую линию на medium по умолчанию или на том effort, который вы реально используете, а затем повышать уровень для сложных задач. Не воспринимайте результаты AA с max как опыт по умолчанию.
Astra и Fable 5.1 — это ступени для более сложных задач. Astra конкурентоспособна в AutomationBench-AA, Terminal-Bench 4.0 и GDP.pdf от AA, а Fable 5.1 сильнее по некоторым показателям длительной работы со знаниями, но базовая цена ввода/вывода $10/$50 у обеих значительно выше, чем у Sol. Чтение из кэша у Fable стоит $0.25, ниже $1.00 у Astra; если многократно читать большой префикс, порядок по стоимости может измениться. Для сложных задач рекомендуется провести приёмку на небольшой выборке из четырёх моделей на одних и тех же требованиях из вашего репозитория и выбирать по «стоимости успешно выполненной и готовой к слиянию задачи», а не по баллам одного рейтинга.
В PandaNpc Codex и Claude Code — два доступных Agent Engine. При выборе точки входа также учитывайте уже имеющуюся у вас подписку или канал API, права инструментов, контекст репозитория и процесс проверки в команде; цену API модели нельзя напрямую пересчитывать в лимит подписки на инструмент. В этой статье показаны публичные характеристики и оценки, и мы не заявляем о рейтинге четырёх моделей по фактическим тестам внутри PandaNpc.
FAQ
Sol обязательно вдвое дешевле Opus 5.5? Только цена ввода и вывода в стандартном API вдвое ниже. Ввод свыше 272K, запись и чтение кэша, фактические токены рассуждений, число раундов и плата за инструменты могут изменить счёт за задачу целиком. В сценарии E выше цена одного запроса у них сблизилась до $1.50 и $1.60.
Могут ли два официальных графика по программированию доказать, кто победил? Нет. На графике OpenAI нет Opus 5.5, на графике Anthropic нет Sol, к тому же различаются бенчмарки и harness. Чтобы увидеть результаты четырёх моделей на одном поле, смотрите таблицу фиксированной конфигурации AA v4.3.2; чтобы выбрать инструмент для себя, нужно заново прогнать задачи из собственного репозитория.
Можно ли сочетать кэш и Batch? Документация по ценам Anthropic явно поддерживает сочетание; фактическое попадание в кэш зависит от префикса, срока действия и настроек запроса. У обеих моделей OpenAI Batch стоит 50% от стандартного тарифа; конкретный счёт сверяйте по записям использования соответствующего API.
Связанные руководства

GPT-6 Astra против Claude Fable 5.1: программирование, Agent, цены и сравнение бенчмарков
GPT-6 Astra и Claude Fable 5.1 уже публично доступны, и обе являются флагманскими моделями по 10 долларов за миллион токенов на входе и 50 долларов на выходе, но у каждой есть свои компромиссы в программировании, работе с компьютером, длительных задачах, стоимости кэша и контексте. В этой статье проводится поэлементное сравнение на общем бенчмарке и даётся метод выбора модели в зависимости от задачи.
Читать статью →
Codex: включаем GPT-5.6 Sol 1M контекст — руководство по настройке из 3 строк в `config.toml`
GPT-5.6 Sol официально поддерживает контекст в 1,05 млн токенов. Достаточно добавить 3 строки конфигурации в начало config.toml в Codex, чтобы работать с окном в 1 млн токенов и автоматически сжимать историю примерно при 900 тыс. токенов. Прилагаются постоянная конфигурация, разовая команда, проверка и напоминание о стоимости.
Читать статью →
Claude Fable 5.1 — полный разбор: бенчмарки, улучшения, цена и скорость
Полные результаты Claude Fable 5.1 по 7 основным категориям бенчмарков, по пунктам сравнение с Fable 5, Opus 5 и GPT-5.6 Sol, а также описание длительных задач, вызова инструментов, стоимости кэша, скорости, ограничений тарифных планов и изменений миграции в версии 5.1.
Читать статью →