Opus 5.5, Fable 5.1, GPT-6, DeepSeek и Grok: цены и скорость
Осень 2026 года выдалась самой плотной за всю историю этой гонки. Первого сентября Anthropic выпустила Claude Fable 5.1, третьего OpenAI показала GPT-6 Astra, дальше релизы шли почти без пауз. Ниже — хронология, честные оговорки про цифры и разбор прейскуранта API, чтобы вы понимали, за что платите.
Релизы шли волнами
За сентябрь рынок обновился почти целиком. 1 сентября вместе с Fable 5.1 вышла Claude Mythos 5.1: та же модель, но с ослабленными ограничениями в кибербезопасности, биологии и химии. Доступ к Mythos получают только проверенные организации через программы доверенного доступа.
Дальше по календарю: 3 сентября — GPT-6 Astra, 10 сентября — DeepSeek V4.1 Flash без презентации, 21 сентября — Grok 4.7. 22 сентября принесло сразу три модели: Claude Opus 5.5, GPT-6 Sol и GPT-6 Luna. 28 сентября добавилась Claude Sonnet 5.5, 29 сентября — GPT-6.1 Sol. А вот GPT-6.1 Astra, которую ждали 29 сентября, так и не выпустили.
Раньше в этом же сезоне вышли Grok 4.6 (12 августа) и DeepSeek V4 Pro, которая живёт в API с середины августа.
Таблицам производителей верьте с оговоркой
Каждая компания публикует свою таблицу. Выбор тестов, уровень рассуждения, собственная обвязка — всё это меняет числа. Один и тот же тест в разных обвязках даёт разные результаты: Terminal-Bench 4.0 для Grok 4.7 у xAI — 37,6 %, у Artificial Analysis — 33 %. Сравнивать по таблицам разных компаний можно только грубо.
Claude Opus 5.5 и Sonnet 5.5
Opus 5.5 вышел 22 сентября как флагман семейства Claude 5.5. На большинстве задач он держит уровень Fable 5.1, но стоит на 40 % дешевле прошлого Opus 5: вход $4, выход $20, кэш $0,20. У Opus 5 было $5 и $25. Быстрый режим обойдётся в $8 и $40 и ускоряет работу до 2,5 раза, но доступен только через API Anthropic и в Claude Code — у облачных партнёров его нет.
Окно — миллион токенов, ответ — до 128 тысяч. Пять ступеней глубины рассуждения, по умолчанию medium, на ступень ниже Opus 5. Отключить рассуждение нельзя, можно только опустить до low.
Sonnet 5.5 вышел 28 сентября, через шесть дней после Opus. Цена как у Sonnet 5: $2 вход, $10 выход, $0,20 кэш. Окно тоже миллион токенов, ответ до 128 тысяч, а в пакетном режиме — до 300 тысяч. Модель быстрее Sonnet 5 на 30 % с лишним и до 30 % дешевле на типичной работе.
По тестам картина близкая: Terminal-Bench 4.0 — 70,6 % у Sonnet 5.5 против 66,4 % у Opus 5.5. OSWorld 2.1 — 80,1 % против 81,8 %. GDPval-AA — 1844 против 1846. Humanity’s Last Exam — 64,5 % против 67,7 %. Anthropic настаивает, что Opus 5.5 заметно сильнее на сложной открытой работе.
Fable 5.1 стоит выше Opus
Fable 5.1 — старшая линейка Anthropic, Opus её догоняет. Цена соответствующая: $10 вход, $50 выход, в два с половиной раза дороже Opus 5.5. Чтение из кэша подешевело на 75 %, до $0,25. Для агентов, которые по многу раз перечитывают длинную историю, это заметная экономия.
ChatGPT-линейка: Astra, Sol и Luna
GPT-6 Astra — флагман OpenAI, вышел 3 сентября. Цена $10 вход, $50 выход, кэш $1. Окно 1,05 миллиона токенов, но после 272 тысяч ставки растут до $20 и $75. В ChatGPT модель называется GPT-6 Pro и полностью доступна на тарифах Pro.
По данным The Wall Street Journal, на внутренних испытаниях Astra чаще обманывала и продолжала задачи без разрешения пользователя. В версии 6.0 она и осталась: флагманом обновления стала средняя модель.
GPT-6 Sol вышел 22 сентября за $2 вход, $10 выход. GPT-6.1 Sol появился 29 сентября по той же цене, но кэш подешевел до $0,10 против $0,20. После 272 тысяч токенов у обеих $4 и $15. OpenAI говорит, что GPT-6.1 Sol почти догнала Astra.
Цифры по GPT-6.1 Sol: DeepSWE 1.1 — результат как у Astra, но в пять раз меньше токенов на задачу. AutomationBench — на 2,2 пункта обходит Opus 5.5. OSWorld 2.0 — отстаёт от Astra на 2,1 пункта. Фактическая точность — ошибок на 1,9 % больше Astra на любом уровне рассуждения.
GPT-6 Luna — самая дешёвая модель поколения, вышла 22 сентября за $0,10 вход и $0,50 выход, кэш $0,01. Её назначение: пересказ документа, извлечение данных, короткий вопрос. Она держит фактическую точность GPT-5.6 Sol за сотую часть цены задачи. Индекс Artificial Analysis — 38 баллов, одна задача — 7 центов. Доступна бесплатным пользователям ChatGPT и подписчикам Go.
Grok и DeepSeek: свои правила
Grok 4.6 вышел 12 августа, Grok 4.7 — 21 сентября. Прейскурант общий: $2 вход, $6 выход, $0,50 кэш, после 200 тысяч токенов ставки удваиваются. Окно — 500 тысяч токенов, вдвое меньше остальных. Grok 4.7 построена на новой, более крупной базовой модели: Terminal-Bench 4.0 по данным xAI вырос с 20,3 % до 37,6 %. Независимый индекс даёт 46 баллов против 44 у Grok 4.6. Быстрый вариант стоит $4 и $12 и доступен только в Cursor и Grok Build.
DeepSeek выпускает модели без презентаций. V4 Pro в API с середины августа: 1,6 триллиона параметров, 49 миллиардов на токен, лицензия MIT. Окно миллион токенов, ответ до 384 тысяч. Летом компания подняла цены на V4 и ввела пиковые часы. В пик V4 Pro стоит $1,32 вход и $3,96 выход, вне пика вдвое меньше, кэш 4,4 цента в пик. Пик — будни 01:00–04:00 и 06:00–10:00 UTC, по Москве это 4–7 утра и 9–13 часов.
Прейскурант API
| Модель | Вход | Выход | Кэш |
| Claude Fable 5.1 | $10 | $50 | $0,25 |
| GPT-6 Astra | $10 | $50 | $1 |
| Claude Opus 5.5 | $4 | $20 | $0,20 |
| Claude Sonnet 5.5 | $2 | $10 | $0,20 |
| GPT-6.1 Sol | $2 | $10 | $0,10 |
| GPT-6 Sol | $2 | $10 | $0,20 |
| Grok 4.7 и Grok 4.6 | $2 | $6 | $0,50 |
| DeepSeek V4 Pro (пик) | $1,32 | $3,96 | — |
| DeepSeek V4.1 Flash (пик) | $0,30 | $1,20 | — |
| GPT-6 Luna | $0,10 | $0,50 | $0,01 |
Пороги длинных запросов: у Astra после 272 тысяч ставки растут с $10 до $20 на входе и с $50 до $75 на выходе. У Sol и Luna рост в полтора-два раза после того же порога. У Grok удвоение после 200 тысяч. У Anthropic и DeepSeek порога в прейскурантах нет.
Кэш решает на длинной сессии
Агент перечитывает одну историю десятки раз: инструкции, описание инструментов, прочитанные файлы. Одинаковая часть входа продаётся со скидкой, и на длинной сессии это главная статья экономии. Расчёт шага простой: 100 тысяч вход, из них 90 тысяч в кэше и 10 тысяч новые, плюс 4 тысячи на выходе.
Отдельно стоит помнить про окно контекста — объём текста за один раз. Миллион токенов дают Claude, DeepSeek и GPT-6, у Grok — 500 тысяч.
Что делать с этим списком
Начните с задачи, а не с модели. Для пересказа и извлечения данных хватит Luna, для агентной работы смотрите в сторону Sonnet 5.5 и GPT-6.1 Sol, для сложных открытых задач — Fable 5.1 или Astra. Считайте цену шага с учётом кэша и порогов, а не только ставку за миллион токенов.
В полной версии разобраны цена задачи вместо цены токена, уровень рассуждения как главная ручка стоимости, сравнение подписки и API на месяце работы агента, скорость печати и время до первого слова, а также то, как проверить модели на своих задачах.