Lab Leadersлаборатория роста бизнеса

Claude Sonnet 5.5: средняя модель почти догнала флагман, но дешевле она не везде

Опубликовано 29 сентября 2026 г.10 мин чтения

28 сентября 2026 года Anthropic выпустила Claude Sonnet 5.5, вторую модель семейства 5.5 после Opus 5.5. Цена в API не изменилась: $2 за миллион входных токенов и $10 за миллион выходных, вдвое дешевле Opus 5.5. В независимом рейтинге Artificial Analysis новая модель заняла третье место, выше Claude Fable 5.1 и GPT-6 Astra. Но по тому же замеру дешевизна за токен не превращается в дешевизну за задачу: в трёх парах уровней из четырёх Opus 5.5 на ступень ниже сильнее и дешевле Sonnet 5.5. Sonnet 5.5 выигрывает скоростью ответа.

Данные на 29 сентября 2026 года, через сутки после релиза.

Эта новость в первую очередь для тех, кто подключает нейросети к своим процессам через API, то есть платит не за подписку, а за каждый обработанный кусок текста: разбор заявок, ответы клиентам, тексты объявлений, отчёты. Для них главный вопрос недели простой: переводить ли рабочие задачи со старшей модели на среднюю. Короткий ответ: реже, чем подсказывает прайс.

Что вышло 28 сентября?

Claude Sonnet 5.5 относится к средней линейке Anthropic: сильнее младшей Haiku, дешевле старшей Opus. Её выпустили через шесть дней после Opus 5.5, который вышел 22 сентября. Младшая Haiku 5.5, по словам Anthropic, появится «в ближайшие недели».

Что заявляет сама Anthropic на странице модели:

  • цена такая же, как у Sonnet 5: $2 и $10 за миллион входных и выходных токенов; чтение из кэша $0,20, запись в кэш $2,50;
  • ответ генерируется более чем на 30% быстрее, чем у Sonnet 5;
  • одна задача обходится до 30% дешевле, чем на предшественнике, потому что модель тратит меньше токенов;
  • модель доступна в API под именем claude-sonnet-5-5 и в облаках Amazon Web Services, Google Cloud и Microsoft Azure.

Два слова, без которых дальше не обойтись. Токен это единица, которой модели меряют текст; по нашей оценке, страница русского текста занимает грубо от 700 до 1 500 токенов в зависимости от модели. Кэш позволяет один раз отправить модели длинную постоянную часть запроса (инструкцию, прайс, примеры) и дальше платить за её повторное чтение по сниженной цене.

Про бесплатный тариф claude.ai на странице модели ничего не сказано, поэтому утверждать, что Sonnet 5.5 доступна бесплатно, на 29 сентября нельзя.

Сколько стоит Sonnet 5.5 рядом с Opus 5.5?

Прайс на 29 сентября 2026 года по данным Anthropic.

МодельВход, $ за 1 млн токеновВыход, $ за 1 млн токеновЧтение кэшаЗапись в кэш
Claude Sonnet 5.52100,202,50
Claude Opus 5.54200,205

Входная и выходная цена у Sonnet 5.5 та же, что была у Sonnet 5.

Одна деталь, которую легко пропустить: чтение из кэша у Sonnet 5.5 и Opus 5.5 стоит одинаково, $0,20 за миллион токенов. Если большая часть входа в вашей задаче это одна и та же инструкция из кэша, то по входу модели почти сравнялись. Разница в цене остаётся на выходе, то есть на тексте, который модель пишет сама. От его объёма и зависит итоговый счёт.

Где Sonnet 5.5 в рейтинге моделей?

Artificial Analysis, независимая лаборатория, которая гоняет модели по одному набору тестов, на 29 сентября даёт такую картину. Индекс Intelligence Index сводит десять тестов на программирование, рассуждения и знания в одну оценку: чем больше баллов, тем сильнее модель. Модели Claude проверяют на пяти уровнях рассуждений: Low, Medium, High, Xhigh и Max. Рассуждения это черновик, который модель пишет себе перед ответом. Вы его не читаете, но оплачиваете по цене выходных токенов, поэтому чем выше уровень, тем умнее и дороже ответ.

Модель (уровень рассуждений)ИндексМесто
Claude Opus 5.5 (max)581
Claude Opus 5.5 (xhigh)562
Claude Sonnet 5.5 (max)563
Claude Opus 5.5 (high)544
Claude Fable 5.1 (max)535
GPT-6 Astra (max)537
Claude Sonnet 5.5 (xhigh)529

Источник: artificialanalysis.ai, таблица моделей, 29.09.2026. Места 6 и 8 занимают другие режимы Fable 5.1 и GPT-6 Astra.

Средняя модель на максимальном уровне набрала столько же, сколько флагман на уровне ниже. Она обошла Claude Fable 5.1, которая до выхода Opus 5.5 была сильнейшей моделью Anthropic в этом рейтинге, и GPT-6 Astra, действующий флагман OpenAI.

Anthropic публикует и свои тесты. По ним Sonnet 5.5 почти догоняет Opus 5.5 в офисной работе (GDPval-AA: 1 844 против 1 846 баллов) и в работе с компьютером через интерфейс (OSWorld 2.1: 80,1% против 81,8%), а в тесте на работу в командной строке обходит его (Terminal-Bench 4.0: 70,6% против 66,4%). Это цифры самой компании, и в том же тесте Sonnet 5 значится с 10,3%. Такой скачок за одно поколение лучше проверять на своих задачах.

Почему дешёвый токен не делает задачу дешевле?

Потому что счёт равен цене токена, умноженной на число токенов, а число у моделей разное. Artificial Analysis считает не только баллы, но и средневзвешенную стоимость одной задачи своего набора тестов в долларах. Эту цифру и стоит сравнивать, а не прайс.

$7,60 против $5,98
средняя стоимость одной задачи из набора тестов: Sonnet 5.5 и Opus 5.5 на максимальном уровне
Source: Artificial Analysis, 29.09.2026

Вот обе модели на всех пяти уровнях, от дешёвых к дорогим.

Модель (уровень)ИндексСтоимость задачиСкорость, токенов в секунду
Sonnet 5.5 (low)36$0,4185
Opus 5.5 (low)42$0,5574
Sonnet 5.5 (medium)41$0,59107
Sonnet 5.5 (high)47$1,0893
Opus 5.5 (medium)51$1,3475
Opus 5.5 (high)54$1,8275
Sonnet 5.5 (xhigh)52$2,74115
Opus 5.5 (xhigh)56$3,4680
Opus 5.5 (max)58$5,9894
Sonnet 5.5 (max)56$7,60139

Источник: artificialanalysis.ai, таблица моделей, 29.09.2026. Все замеры в режиме «with fallback».

Из таблицы следуют четыре вещи, которых нет в прайсе.

Opus на уровень ниже чаще выгоднее. Opus 5.5 на low (42 балла, $0,55) сильнее и дешевле Sonnet 5.5 на medium (41 балл, $0,59). Opus на high (54 балла, $1,82) сильнее и дешевле Sonnet на xhigh (52 балла, $2,74). Тот же индекс 56 на Opus xhigh стоит $3,46, на Sonnet max $7,60, вдвое дороже. Исключение одно: Opus на medium (51 балл, $1,34) сильнее Sonnet на high (47 баллов, $1,08), но на четверть дороже.

На максимуме Sonnet пишет больше. Чтобы пройти весь набор тестов на уровне max, Sonnet 5.5 выдала 410 миллионов выходных токенов, Opus 5.5 260 миллионов, в 1,6 раза меньше. Из чего именно сложилась итоговая разница в стоимости задачи, Artificial Analysis не раскрывает, поэтому опираемся на итог.

Самая дешёвая точка всё же у Sonnet. Sonnet 5.5 на уровне low стоит $0,41 за задачу. Если качество 36 баллов вашу задачу закрывает, это минимальный счёт из всех вариантов.

Sonnet выигрывает скорость. На среднем уровне она выдаёт 107 токенов в секунду против 75 у Opus, на максимуме 139 против 94. Для чата с клиентом на сайте или помощника менеджера, где человек ждёт ответа, это ощутимо.

Оговорка: набор тестов Artificial Analysis собран из трудных задач на программирование и рассуждения. На вашей работе, например на сортировке заявок или извлечении полей из письма, соотношение может оказаться другим. Таблица показывает, с какой пары начинать проверку, а не что выбрать вслепую.

Какой уровень рассуждений стоит у вас по умолчанию?

С этого вопроса стоит начать: от него счёт зависит больше, чем от выбора модели. По данным Anthropic, в Claude Code (программе Anthropic для работы с кодом) и в приложениях Claude по умолчанию стоит средний уровень (Medium), а в API высокий (High).

Значит, если вы подключили Sonnet 5.5 через API и ничего не настраивали, вы работаете в строке «Sonnet 5.5 (high)»: 47 баллов за $1,08 на задачу. Рядом в таблице стоит Opus 5.5 на уровне medium: 51 балл за $1,34. Разница в цене около четверти, разница в качестве заметная. А «третье место в рейтинге» к вашей настройке не относится: его Sonnet заняла на максимальном уровне.

Ещё одна деталь для тех, у кого Sonnet 5 уже работает в связке с инструментами. Anthropic пишет: если вы запускали Sonnet с выключенными размышлениями, при переходе на 5.5 нужно переключиться на новую настройку размышлений between_tools. Это стоит заложить в план перехода, а не обнаружить по ошибкам в логах.

Что делать бизнесу, который уже работает через API?

Не решать по прайсу. Порядок, который занимает один рабочий вечер:

  1. Выгрузите расходы за прошлый месяц. В консоли Anthropic видно число входных и выходных токенов по дням. Отдельно посмотрите, какая доля приходится на выход: часто это главная статья расходов.
  2. Проверьте, какой уровень рассуждений стоит в ваших запросах. Если он не задан, в API это High.
  3. Сравнивайте пары, а не модели. Для каждой задачи возьмите вашу текущую настройку и соседа из таблицы выше: Sonnet на уровень выше или Opus на уровень ниже. Прогоните 20–30 реальных примеров и сравните три числа: сколько ответов пришлось править, сколько выходных токенов ушло, сколько стоила одна задача.
  4. Там, где человек ждёт ответа, добавьте в сравнение скорость. Чат с клиентом на Sonnet может оказаться оправданным даже при чуть большей цене задачи.
  5. Включите кэш. Если одна инструкция уходит модели сотни раз в день, это самая дешёвая экономия, и у обеих моделей чтение кэша стоит одинаково.

Мы в лаборатории считаем именно стоимость одной задачи, доведённой до результата: только эта цифра сравнима между моделями. Как понять, окупается ли нейросеть в процессе вообще, мы разбирали в статье окупается ли внедрение ИИ в бизнесе. Пересчёт цен после прошлого релиза и таблица с моделями OpenAI есть в разборе Claude Opus 5.5 и GPT-6.

Кому что выбрать на конец сентября 2026 года?

Упрощённая карта, если решать прямо сейчас.

ЗадачаС чего начать проверкуПочему
Чат с клиентом, помощник менеджераSonnet 5.5 на среднем уровне107 токенов в секунду против 75 у Opus на том же уровне
Массовая простая обработка, где хватает базового качестваSonnet 5.5 на уровне lowсамая низкая стоимость задачи в замере, $0,41
Массовая обработка, где важна точностьOpus 5.5 на уровне lowсильнее и дешевле Sonnet 5.5 на medium
Сложная аналитика, договоры, стратегияOpus 5.5 на уровне highсильнее и дешевле Sonnet 5.5 на xhigh
Максимальное качествоOpus 5.5 на уровне maxпервое место в рейтинге и дешевле Sonnet 5.5 на том же уровне
Уже работает Sonnet 5 и всё устраиваетпереход на 5.5 с тестом на 20–30 примерахцена та же, но проверьте настройку размышлений

Если для части массовых задач хочется сравнить ещё и открытые модели, посмотрите разбор DeepSeek V4.1 Flash для бизнеса.

Цикл релизов сжался до недели: Opus 5.5 вышел 22 сентября, Sonnet 5.5 через шесть дней, Haiku 5.5 обещан следом. Любая таблица «какая модель лучше» устаревает быстрее, чем её успевают внедрить. Дольше живёт привычка: держать под рукой 20–30 своих типовых примеров и прогонять на них каждую новую модель, считая стоимость задачи.

Частые вопросы

Хотите понять, какая модель выгоднее в вашем процессе?

Записаться на разбор
Полезна ли статья?
Автор
Фёдор Шеришев
Google Ads × AI · основатель Lab Leaders

Основатель Lab Leaders. Google Partners с 2017 года, владелец мебельного производства Ideal Comfort. Строю бизнесы с помощью Google Ads и AI-агентов.

Читать дальше

Claude Opus 5.5 и GPT-6 вышли в один день: что подешевело и как пересчитать свой счёт

Anthropic и OpenAI в один день снизили цены на старшие модели. Разбираем, что реально подешевело и как пересчитать расходы на своей задаче.

9 мин

Sponsored Agents в рекламе ChatGPT: объявление ведёт в разговор с ботом компании

16 сентября OpenAI показала рекламу, которая ведёт не на сайт, а в разговор с ботом компании, и подключила кабинет к HubSpot и Shopify. Разбираем, что уже работает, что пока тест и кому принадлежат данные из разговора.

10 мин

DeepSeek V4.1 Flash: цена, замена V4-Pro с 14 сентября и какие задачи ему можно доверить

DeepSeek выпустил V4.1 Flash с открытыми весами и с 14 сентября перевёл на неё запросы к V4-Pro. Считаем реальную цену задачи и разбираем, что можно отдавать модели.

9 мин

Агентства начали считать ИИ-агентов по токенам: у автоматизации нашлась себестоимость

Агент уже не советует, а сам закупает рекламу, и у этой работы обнаружилась своя себестоимость. Считать её пока никто толком не умеет, а нижняя граница бюджета у такой автоматизации есть.

7 мин