SWE-2 от Cognition: модель для кода уровня флагманов вчетверо дешевле
Cognition — компания, сделавшая ИИ-разработчика Devin, — выпустила SWE-2, свою самую сильную модель для программирования. Заявка простая: качество, близкое к самым дорогим моделям, примерно за четверть их цены.
За сутки публикация собрала около 400 очков на Hacker News, потому что тема болезненная. Код — это задача, где счёт за модель растёт быстрее всего: одна итерация тянет за собой десяток служебных шагов, и каждый оплачивается.
Цифры релиза
| Что измеряли | Результат SWE-2 |
|---|---|
| Terminal-Bench 2.1 | 92,8% |
| DeepSWE 1.1 | 73,0% |
| FrontierCode 1.1 Main | 50,0% — как у Claude Fable 5.1, но на 64% дешевле |
| Terminal-Bench 4 | 27,3% |
Отдельно интересна не цифра качества, а цифра дисциплины: SWE-2 в среднем тратит на 58% меньше ходов и стоит на 81% дешевле предыдущей SWE-1.7 при более высоком результате. Первую осмысленную правку кода модель делает примерно после 18 шагов разведки против 48 у предшественницы.
Что за этим стоит
Модель построена на открытой Kimi K3 (2,8 триллиона параметров), поверх которой Cognition применила своё дообучение. Заявленный вклад дообучения — 5–6 пунктов на многих бенчмарках.
Главная техническая идея — в том, как модель учили экономить. Вместо отдельных версий «дешёвая» и «думающая» все уровни усилия обучаются за один прогон, а за лишние размышления модель получает штраф, рассчитанный математически. Отсюда и меньшее число ходов: модель не бродит по проекту дольше, чем нужно.
Почему число ходов важнее цены за токен
Когда сравнивают модели для кода, обычно смотрят на цену за миллион токенов. Для чата это разумно, для кода — обманчиво.
Агент, который пишет код, не отвечает одним сообщением. Он читает файлы, запускает тесты, правит, снова запускает. Каждый такой шаг — отдельный оплаченный запрос, и в него уезжает весь накопленный контекст. Поэтому модель, которая вдвое дороже за токен, но приходит к результату втрое быстрее, на практике оказывается дешевле.
Это же объясняет, почему «самая дешёвая» модель в реальной работе иногда выходит самой дорогой: она дольше плутает.
Как выбирать модель под задачу
Практическое правило, которое работает независимо от конкретных названий:
- Простая правка или небольшая страница — берите быструю недорогую модель. Разницы в результате не будет, а платить меньше приятнее.
- Задача с непредсказуемой глубиной — сложная логика, незнакомый проект, много файлов — имеет смысл сразу взять сильную модель. Дешёвая здесь потратит больше денег на попытки.
- Не гоняйте флагман на мелочах. Это самая частая причина, по которой счёт за ИИ выглядит необъяснимо большим.
В tenzor этот выбор оставлен пользователю: когда в чате собирается сайт или приложение, тир модели вы выбираете сами и видите оценку стоимости до запуска. Сравнить модели и цены за тысячу токенов можно в таблице моделей для чата.
Что с доступностью
Пока SWE-2 работает в продуктах самой Cognition: Devin в десктопе, командной строке и вебе. В общедоступных каталогах моделей её на момент публикации нет. Если появится — добавим и расскажем.
Что такое SWE-2?+
Модель для программирования от Cognition, авторов ИИ-разработчика Devin. Вышла 10 сентября 2026 года и показывает 92,8% на Terminal-Bench 2.1 при цене около четверти от самых дорогих моделей.
Она лучше GPT-6 Astra или Claude Fable 5.1?+
По заявленным цифрам она подходит к ним вплотную, а на части бенчмарков сравнивается с Fable 5.1 при цене на 64% ниже. Это замеры самой Cognition, независимых пока нет.
Почему число шагов важнее цены за токен?+
Агент, который пишет код, делает десятки запросов на одну задачу, и в каждый уезжает накопленный контекст. Модель, которая приходит к результату за меньшее число ходов, в итоге обходится дешевле даже при более высокой цене токена.
Можно ли попробовать SWE-2 в tenzor?+
Пока нет: модель доступна только в продуктах Cognition. Появится в общем каталоге — подключим.
Что дальше почитать
- Модели для чата — что доступно сейчас и по какой цене.
- Токены и кредиты: как устроена оплата — почему код стоит дороже переписки.
Соберите приложение в чате
Модель для кода выбираете вы: простую страницу соберёт быстрая, сложное приложение — сильная.
Открыть чат