Claude Sonnet 5.5: когда брать её, а когда Opus
28 сентября Anthropic выпустила Claude Sonnet 5.5. Цена за токены осталась прежней, но одна и та же работа обходится примерно на треть дешевле: модель приходит к результату меньшим числом шагов и тратит меньше токенов. Отвечает она тоже быстрее — больше чем на 30%. В tenzor модель уже доступна, поэтому разберём по-человечески: что она делает лучше и в каких случаях всё же стоит брать Opus.
Что изменилось по сравнению с Sonnet 5
Главная перемена не в баллах, а в поведении. Прошлая версия часто уходила в длинные размышления и ходила кругами на многошаговых задачах. Новая делает меньше лишних заходов.
Самый заметный разрыв — на тестах, где нужно последовательно работать в реальном окружении: открывать файлы, запускать проверки, исправлять найденное. Там результат вырос с 10,3% до 70,6%. Такая разница не про «стала умнее на 20%», а про то, что раньше модель просто не доводила подобные задачи до конца.
На чистом кодировании прибавка спокойнее: 46,2% против 42,4%. И отдельная деталь для любителей показательных проверок: это первая Sonnet, прошедшая Pokémon Red, ориентируясь только по скриншотам.
Почему это заметно по счёту
Цена за миллион токенов не изменилась. Изменилось количество токенов на задачу. Если модель приходит к тому же ответу за пять шагов вместо восьми, вы платите меньше при том же тарифе. Именно поэтому сравнивать модели по тарифу бессмысленно: смотреть надо на списание за готовый результат.
Какая модель Claude под какую работу
| Задача | Что брать |
|---|---|
| Повседневная работа с текстом, письма, разбор документов | Sonnet 5.5 |
| Правки в коде, понятные задачи с ясным результатом | Sonnet 5.5 |
| Длинная работа с множеством шагов и проверок | Sonnet 5.5, при пробуксовке — Opus 5.5 |
| Сложное решение, где нужно взвесить варианты | Opus 5.5 |
| Большой проект целиком, архитектура, неочевидные ошибки | Opus 5.5 |
| Массовая рутина: разметка, короткие ответы, классификация | модель попроще и дешевле |
Простое правило: начинайте с Sonnet 5.5 и переходите на Opus там, где Sonnet начала топтаться на месте. Обратный порядок (сразу брать старшую модель) обходится примерно вдвое дороже и в большинстве повседневных задач не даёт разницы, которую вы заметите.
Где Sonnet почти догнала Opus
На тестах, собранных из настоящей рабочей нагрузки, разрыв между Sonnet 5.5 и Opus 5.5 почти исчез. На задачах в редакторе кода Sonnet идёт второй сразу за Opus.
Практический вывод: модель среднего уровня перестала быть компромиссом. Раньше выбор звучал как «дешевле, но хуже», теперь чаще «дешевле и почти так же», а для многих задач просто «дешевле и достаточно».
Осталась и область, где старшая модель по-прежнему впереди: длинные задачи с неочевидным решением, где важно не выполнить инструкцию, а понять, какая инструкция здесь правильная.
Как получить от неё больше
Несколько вещей, которые заметно влияют на результат.
Формулируйте критерий готовности. «Сделай так, чтобы все проверки прошли» работает лучше, чем «поправь этот файл»: модель сама убеждается, что задача закрыта, а не останавливается на середине.
Просите результат, а не отчёт. Файл, таблицу, готовый текст. Фраза «готово» проверке не поддаётся.
Не тащите в диалог лишнее. Большой документ, приложенный в начале, оплачивается на каждом следующем сообщении. Если он нужен надолго, удобнее завести проект и положить файлы туда.
Не грузите картинки в максимальном разрешении без нужды. У нового поколения крупные изображения обходятся дороже прежнего, а для чтения текста со скана избыточное разрешение ничего не добавляет.
Возвращайтесь к повторяющимся задачам. Один и тот же контекст в продолжающемся диалоге обрабатывается дешевле, чем заново собранный: система кэширует уже разобранное. Отдельно ничего включать не нужно, это работает само.
Сколько это стоит у нас
В tenzor Sonnet 5.5 доступна в чате наравне с остальными моделями Claude и переключается в шапке. Цену в рублях по каждой модели видно в таблице моделей для чата, а фактическое списание за конкретный ответ — в истории расходов.
Самый честный способ выбрать — прогнать свою обычную задачу через Sonnet 5.5 и Opus 5.5 и сравнить не тарифы, а два числа: устроил ли результат и сколько списалось. В большинстве повседневных сценариев разница в результате окажется меньше, чем разница в счёте.
Чем Claude Sonnet 5.5 отличается от Sonnet 5?+
Отвечает более чем на 30% быстрее и тратит заметно меньше токенов на ту же работу, поэтому задача обходится дешевле при прежней цене за токен. Сильнее всего выросли результаты на длинных многошаговых задачах.
Какая модель Claude лучше?+
Зависит от задачи. Sonnet 5.5 подходит для повседневной работы с текстом, документами и понятными правками в коде. Opus 5.5 стоит брать там, где нужно взвешенное решение или работа с большим проектом целиком.
Стала ли Sonnet 5.5 дешевле?+
Цена за миллион токенов осталась прежней. Дешевле стала сама задача, примерно на треть, потому что модель приходит к результату меньшим числом шагов.
Как сократить расходы при работе с Claude?+
Не тащить большие документы через весь диалог, не грузить изображения в избыточном разрешении, отдавать рутину моделям попроще и сравнивать модели по фактическому списанию за результат, а не по тарифу.
Что дальше почитать
- Claude Sonnet 5 и Claude Opus 5 — описания моделей семейства.
- Как выбрать нейросеть под задачу и бюджет — как сравнивать по стоимости результата.
- Что такое кеш промпта — почему продолжение диалога дешевле нового.
Сравните Sonnet и Opus на своей задаче
Возьмите работу, которую делаете каждый день, и прогоните через обе. Смотрите на результат и списание, а не на тариф.
Открыть чат