Lab Leadersлаборатория роста бизнеса

Claude Opus 5.5 и GPT-6 вышли в один день: что подешевело и как пересчитать свой счёт

Опубликовано 23 сентября 2026 г.9 мин чтения

22 сентября 2026 года Anthropic выпустила Claude Opus 5.5, а через полтора часа OpenAI представила GPT-6 Sol и GPT-6 Luna. Цена за токен у Opus 5.5 на 20% ниже, чем у Opus 5 ($4 и $20 за миллион токенов на входе и выходе), у новых моделей OpenAI вдвое ниже предшественников. Для бизнеса важнее другое: итоговый счёт теперь сильнее зависит от кэширования и от того, сколько модель «думает», чем от цены в прайсе.

Данные на 23 сентября 2026 года, через сутки после релизов.

Если вы пользуетесь чат-ботом по подписке, для вас почти ничего не поменялось: в списке появилась новая модель, а о смене цен тарифов в анонсах не сказано. Эта новость для тех, кто платит за API, то есть подключает нейросеть к своим сервисам напрямую и платит за каждый обработанный кусок текста: разбор заявок, ответы клиентам, описания товаров, отчёты. Ниже разбираем, что именно подешевело, где цифры из пресс-релиза расходятся с реальным счётом и как пересчитать расходы на своей задаче.

Что вышло 22 сентября?

Два релиза в один день, с разницей около 90 минут, как отметил TechCrunch.

Claude Opus 5.5 от Anthropic. Старшая модель линейки Opus, преемник Opus 5, который вышел в июле. Anthropic заявляет, что новая модель справляется с большинством задач на уровне Claude Fable 5.1, до этого релиза самой сильной модели Anthropic в рейтинге Artificial Analysis, а стоит заметно дешевле. Доступна у Anthropic и в облаках Amazon Web Services, Google Cloud и Microsoft Azure.

GPT-6 Sol и GPT-6 Luna от OpenAI. Sol рассчитана на сложную работу вроде программирования и аналитики, Luna на массовые простые задачи: пересказ документов, извлечение данных, сортировку. Обе заменяют модели серии GPT-5.6. Над ними в линейке OpenAI остаётся GPT-6 Astra, флагман, вышедший в начале сентября: по справке OpenAI для разработчиков он стоит $10 за миллион входных токенов и $50 за миллион выходных (цена на 23 сентября).

Прежде чем смотреть на цены, одно слово. Токен — единица, которой модели меряют текст. По нашей оценке, одна страница русского текста занимает грубо от 700 до 1 500 токенов, в зависимости от модели. Цены ниже указаны за миллион токенов, отдельно за то, что вы отправляете модели (вход), и за то, что она пишет в ответ (выход).

Сколько теперь стоят новые модели?

Сводка по официальным ценам API на 23 сентября 2026 года.

МодельВход, $ за 1 млн токеновВыход, $ за 1 млн токеновБыло у предшественникаИсточник
Claude Opus 5.5420Opus 5: $5 / $25Anthropic, The Decoder
GPT-6 Sol210GPT-5.6 Sol: $4 / $20VentureBeat
GPT-6 Luna0,100,50GPT-5.6 Luna: $0,20 / $1,20VentureBeat
GPT-6 Astra, для сравнения1050для сравнения, на 23.09справка OpenAI API

Кэш стоит отдельной строкой, потому что дальше он решает почти всё. Кэш — это возможность один раз отправить модели длинную постоянную часть запроса (инструкцию, прайс, базу ответов) и дальше платить за её повторное чтение по сниженной цене. У Opus 5.5 чтение из кэша стоит $0,20 за миллион токенов, в 20 раз дешевле обычного входа, а запись в кэш $5. У OpenAI скидка на повторно прочитанные входные токены 90%.

$0,20
чтение из кэша у Claude Opus 5.5 за 1 млн токенов против $4 за обычный вход
Source: Anthropic, страница модели, 22.09.2026

Кто из них сильнее?

По независимому рейтингу Artificial Analysis на 23 сентября первое место занимает Claude Opus 5.5 в режиме максимальных рассуждений: 58 баллов по индексу Intelligence Index. Это сводная оценка по десяти тестам на программирование, рассуждения и знания: чем больше баллов, тем сильнее модель.

Модель (режим)Индекс Artificial Analysis
Claude Opus 5.5 (max)58
Claude Fable 5.1 (max)53
GPT-6 Astra (max)53
GPT-6 Sol (max)48
GPT-6 Luna (max)37

Источник: artificialanalysis.ai, таблица моделей, 23.09.2026.

Две оговорки, которые меняют вывод. Первая: заявления «на уровне Fable 5.1» и «на стандартных настройках итоговая стоимость на 40% ниже Opus 5» принадлежат самой Anthropic. Так же и у OpenAI: фраза «Sol ошибается примерно вдвое реже предшественника» опирается на внутренний тест компании. Независимая проверка пока есть только у рейтинга выше.

Вторая оговорка важнее для денег. Artificial Analysis отмечает, что на максимальном режиме Opus 5.5 тратит заметно больше выходных токенов, чем конкуренты. А Anthropic сама пишет, что режим размышлений у Opus 5.5 больше не отключается. Режим размышлений — это когда модель перед ответом пишет себе черновик рассуждений. Этот черновик вы не читаете, но оплачиваете по цене выходных токенов.

Почему цена за токен не равна вашему счёту?

Потому что счёт равен цене, умноженной на количество токенов, а количество у разных моделей на одной и той же задаче разное. Разберём на условном примере.

Допустим, нейросеть разбирает 1 000 входящих заявок в месяц: читает заявку и инструкцию, решает, горячий это клиент или нет, и пишет короткую сводку менеджеру. На одну заявку уходит 3 000 входных токенов (из них 2 500 занимает одинаковая инструкция с прайсом) и 500 выходных.

ВариантРасчёт за месяцИтого
Opus 5, без кэша3 млн × $5 + 0,5 млн × $25$27,50
Opus 5.5, без кэша3 млн × $4 + 0,5 млн × $20$22,00
Opus 5.5, инструкция в кэше0,5 млн × $4 + 2,5 млн × $0,20 + 0,5 млн × $20≈ $12,50
GPT-6 Sol, без кэша3 млн × $2 + 0,5 млн × $10$11,00
GPT-6 Luna, без кэша3 млн × $0,10 + 0,5 млн × $0,50$0,55

Расчёт условный, по прайсам из таблицы выше. Плата за запись в кэш и выходные токены размышлений не учтены.

Что это значит на цифрах.

Первая: кэш на Opus 5.5 срезал счёт в 1,7 раза сильнее, чем снижение цены за токен. Смена прайса дала экономию $5,50, правильно собранный запрос дал ещё $9,50. Для этого постоянную часть (инструкцию, прайс, примеры) нужно ставить в начало запроса и не менять от заявки к заявке.

Вторая: выходные токены теперь главная статья расходов. В строке с кэшем $10 из $12,50 приходится на ответ модели. Если Opus 5.5 на вашей задаче размышляет ещё на 500 токенов, выход удваивается, и выгода от кэша съедается. Короткий формат ответа и низкий уровень рассуждений для простых задач экономят больше, чем выбор модели.

Третья: без кэша Luna дешевле Opus 5.5 в сорок раз, и даже если кэш включить только у Opus 5.5, разница остаётся почти 23-кратной. Сортировать заявки на «спам / не спам» старшей моделью значит переплачивать за то, что умеет дешёвая.

Что делать бизнесу, который уже работает через API?

Коротко: не переключаться вслепую, а пересчитать на своей задаче. Пять шагов, которые занимают один рабочий вечер.

1. Выгрузите реальные расходы за прошлый месяц. И у Anthropic, и у OpenAI в консоли видно число входных и выходных токенов по дням. Без этих цифр любое сравнение моделей превращается в гадание.

2. Разделите задачи на сложные и массовые. Разбор договора, стратегия, код идут на старшие модели. Сортировка, извлечение полей из заявок, короткие ответы идут на Luna или аналоги младших линеек.

3. Прогоните 20–30 реальных примеров на двух моделях. Сравнивайте не впечатление от ответа, а три числа: сколько ответов пришлось править, сколько выходных токенов ушло, сколько это стоило. Мы в лаборатории считаем именно стоимость одной задачи, доведённой до результата, а не цену за токен.

4. Включите кэширование. Если одна и та же инструкция уходит модели сотни раз в день, это самая дешёвая экономия. У Anthropic кэш настраивается в самом запросе, у OpenAI скидка на повторы срабатывает автоматически на совпадающем начале запроса.

5. Проверьте режим размышлений. У Opus 5.5 его нельзя выключить совсем, но можно понизить уровень. Для рутинных задач низкий уровень обычно даёт тот же результат за меньшие деньги. Проверьте на своих примерах из шага 3.

Как считать, окупится ли нейросеть в процессе вообще, мы подробно разбирали в статье окупается ли внедрение ИИ в бизнесе.

А что меняется для тех, кто пользуется чатом по подписке?

Для подписчиков изменения скромнее. OpenAI начала выкатывать GPT-6 Sol и Luna в ChatGPT Work и Codex для тарифов Plus, Pro, Business, Enterprise и Edu. Пользователи бесплатного тарифа и тарифа Go получили Luna в приложении для компьютера. Anthropic объявила Opus 5.5 доступной на всех своих платформах.

О смене цен подписок в анонсах не говорится. Меняется то, какая модель отвечает, и, возможно, лимиты сообщений. Как устроены лимиты подписки Claude, мы разбирали на примере Claude Fable 5, а практический разбор предыдущей модели есть в статье про Claude Opus 5 для бизнеса.

Отдельно про текст. Anthropic пообещала, что Opus 5.5 пишет естественнее: ставит главное в начало, меньше жаргона, точнее следует инструкциям по стилю. The Decoder связывает это с критикой «клодовского» письма, то есть узнаваемо шаблонного текста прошлых версий. Проверить обещание можно только на своих текстах, и для контента это стоит сделать до смены модели в рабочем процессе.

Кому что выбрать на сентябрь 2026 года?

Упрощённая карта, если решать прямо сейчас.

ЗадачаС чего начать проверкуПочему
Сложная аналитика, договоры, стратегияClaude Opus 5.5Первое место в независимом рейтинге при цене ниже Opus 5
Программирование, агентыOpus 5.5 и GPT-6 Sol параллельноSol вдвое дешевле за токен, Opus 5.5 выше в рейтинге; решает ваш тест
Массовая обработка заявок и текстовGPT-6 Luna или младшие модели других линеекЦена в десятки раз ниже, сложность задачи не требует большего
Уже работает на Opus 5 и всё устраиваетПереход на Opus 5.5 с тестом на 20–30 примерахПрайс ниже, но размышления теперь включены всегда

Если хочется сравнить ещё и с дешёвыми открытыми моделями, посмотрите разбор DeepSeek V4.1 Flash для бизнеса: для части массовых задач это ещё один вариант.

Частые вопросы

Хотите понять, сколько нейросеть будет стоить в вашем процессе?

Записаться на разбор
Полезна ли статья?
Автор
Фёдор Шеришев
Google Ads × AI · основатель Lab Leaders

Основатель Lab Leaders. Google Partners с 2017 года, владелец мебельного производства Ideal Comfort. Строю бизнесы с помощью Google Ads и AI-агентов.

Читать дальше

Sponsored Agents в рекламе ChatGPT: объявление ведёт в разговор с ботом компании

16 сентября OpenAI показала рекламу, которая ведёт не на сайт, а в разговор с ботом компании, и подключила кабинет к HubSpot и Shopify. Разбираем, что уже работает, что пока тест и кому принадлежат данные из разговора.

10 мин

DeepSeek V4.1 Flash: цена, замена V4-Pro с 14 сентября и какие задачи ему можно доверить

DeepSeek выпустил V4.1 Flash с открытыми весами и с 14 сентября перевёл на неё запросы к V4-Pro. Считаем реальную цену задачи и разбираем, что можно отдавать модели.

9 мин

Агентства начали считать ИИ-агентов по токенам: у автоматизации нашлась себестоимость

Агент уже не советует, а сам закупает рекламу, и у этой работы обнаружилась своя себестоимость. Считать её пока никто толком не умеет, а нижняя граница бюджета у такой автоматизации есть.

7 мин

OpenAI отключает Cursor от своих моделей 12 ноября: чему это учит бизнес

OpenAI закрывает Cursor прямой доступ к своим моделям с 12 ноября 2026 года. Причина не техническая: компания заявляет, что не уверена в соблюдении условий новым владельцем. Разбираем, что это значит для тех, кто уже встроил нейросети в рабочие процессы.

9 мин