DeepSeek V4.1 Flash обошла свой же флагман — и стала дешевле
10 сентября DeepSeek официально выпускает V4.1 Flash. Формулировка компании звучит непривычно: новая дешёвая модель, по её словам, обошла собственную флагманскую V4 Pro — по качеству ответов, по скорости и по общему времени работы. И стоит при этом в разы меньше.
Обычно бывает наоборот: дешёвая версия — это компромисс, за экономию платишь качеством. Здесь компания сама предлагает пользователям уйти с дорогой модели на дешёвую.
Что известно на сегодня
Осторожно с деталями: официальной карточки модели и опубликованных бенчмарков ещё нет. Разработчикам открыли временную тестовую версию в API, у неё прямо в названии стоит дата отключения: 10 сентября. И есть заявление компании по итогам внутренних и внешних тестов: V4.1 Flash превзошла V4 Pro по совокупности метрик — качество, стоимость, скорость, общее время обработки запроса.
И есть новый прайс на серию Flash, который вступает в силу с 10 сентября:
| Что считается | Цена за 1 млн токенов (льготные часы) |
|---|---|
| Вход, попадание в кэш | $0,003 |
| Вход, мимо кэша | $0,15 |
| Выход | $0,60 |
В часы пик — вдвое дороже. Для сравнения: прежний тариф Flash за вход мимо кэша был $0,22, за выход — $0,66. То есть модель одновременно стала сильнее и подешевела.
Почему цена входа в кэш такая маленькая
Провайдеры кэшируют начало запроса — системную инструкцию, историю переписки, приложенный документ. Если вы задаёте пятый вопрос по одному и тому же договору, его текст не считается заново по полной цене. Отсюда разница в 50 раз между «попал в кэш» и «не попал».
Почему это важно, даже если вы не пользуетесь DeepSeek
За последний год «дешёвый» тир перестал быть тиром для бедных. Gemini Flash, GPT Luna, Claude Haiku, DeepSeek Flash — это уже не урезанные версии, а модели, которые закрывают большинство повседневных задач: переписка, письма, разбор документов, код средней сложности, перевод.
Дорогие флагманы остаются нужны там, где важна долгая цепочка рассуждений: сложный юридический разбор, нетривиальная математика, большая кодовая база, где надо удержать в голове десятки файлов. Но таких задач у обычного пользователя — меньшинство.
Практический вывод простой: не платите флагманскую цену по привычке. Возьмите свою типовую задачу, прогоните её на дешёвой модели и на дорогой, сравните ответы. В половине случаев разницы вы не увидите, а счёт отличается в разы.
Как это выглядит в деньгах
Считать в долларах за миллион токенов неудобно, поэтому переведём в понятное. Миллион токенов — это примерно 700 тысяч слов, около семи томов «Войны и мира». Обычная переписка в чате — это несколько тысяч токенов на вопрос-ответ.
При новых ценах DeepSeek тысяча токенов выхода стоит доли копейки в закупке. Даже с наценкой сервиса это остаётся суммой, при которой считать каждый вопрос бессмысленно — куда важнее не гонять флагманскую модель на задачах, где хватит дешёвой. Как устроен пересчёт токенов в рубли, мы разбирали в статье Токены и кредиты: как устроена оплата.
Что будет дальше
Если заявка подтвердится опубликованными бенчмарками, у остальных лабораторий останется небольшой выбор: либо снижать цены на свои экономичные модели, либо объяснять, за что берут больше. Похожий сюжет уже был в начале 2026-го, когда DeepSeek уронила цены на рассуждающие модели, и за пару месяцев подтянулись все.
Мы следим за релизом. Если V4.1 Flash окажется тем, чем её описывают, она появится в каталоге моделей tenzor — как и остальные модели, доступной из России, на русском и с оплатой рублёвой картой. Сравнить, что уже есть в чате и сколько стоит тысяча токенов у каждой модели, можно в таблице моделей.
Когда выйдет DeepSeek V4.1 Flash?+
Официальный релиз запланирован на 10 сентября 2026 года по пекинскому времени. До этого модель доступна в API под временным тестовым идентификатором.
Она правда лучше V4 Pro?+
Так утверждает сама DeepSeek по результатам внутренних и внешних тестов. Независимых бенчмарков и карточки модели на момент публикации нет, поэтому окончательные выводы делать рано.
Сколько стоит DeepSeek V4.1 Flash?+
С 10 сентября для серии Flash действует тариф $0,15 за миллион входных токенов мимо кэша и $0,60 за миллион выходных в льготные часы; в часы пик — вдвое дороже.
Чем дешёвая модель отличается от флагманской на практике?+
Флагман лучше держит длинную цепочку рассуждений: сложный анализ, большие кодовые базы, нетривиальная математика. На повседневных задачах — письма, переписка, разбор документов, перевод — разница обычно незаметна.
Что дальше почитать
- Токены и кредиты: как устроена оплата — почему счёт идёт не за сообщения.
- Модели для чата — таблица с ценами за 1000 токенов.
Попробуйте разные модели в чате
Одна и та же задача на дешёвой и на флагманской модели — самый честный способ понять, за что вы платите.
Открыть чат