tenzorНачать
Все статьи

DeepSeek V4.1 Flash обошла свой же флагман — и стала дешевле

10 сентября DeepSeek официально выпускает V4.1 Flash. Формулировка компании звучит непривычно: новая дешёвая модель, по её словам, обошла собственную флагманскую V4 Pro — по качеству ответов, по скорости и по общему времени работы. И стоит при этом в разы меньше.

Обычно бывает наоборот: дешёвая версия — это компромисс, за экономию платишь качеством. Здесь компания сама предлагает пользователям уйти с дорогой модели на дешёвую.

DeepSeek V4.1 Flash — дешёвая модель обошла флагманскую V4 Pro

Что известно на сегодня

Осторожно с деталями: официальной карточки модели и опубликованных бенчмарков ещё нет. Разработчикам открыли временную тестовую версию в API, у неё прямо в названии стоит дата отключения: 10 сентября. И есть заявление компании по итогам внутренних и внешних тестов: V4.1 Flash превзошла V4 Pro по совокупности метрик — качество, стоимость, скорость, общее время обработки запроса.

И есть новый прайс на серию Flash, который вступает в силу с 10 сентября:

Что считаетсяЦена за 1 млн токенов (льготные часы)
Вход, попадание в кэш$0,003
Вход, мимо кэша$0,15
Выход$0,60

В часы пик — вдвое дороже. Для сравнения: прежний тариф Flash за вход мимо кэша был $0,22, за выход — $0,66. То есть модель одновременно стала сильнее и подешевела.

Почему цена входа в кэш такая маленькая

Провайдеры кэшируют начало запроса — системную инструкцию, историю переписки, приложенный документ. Если вы задаёте пятый вопрос по одному и тому же договору, его текст не считается заново по полной цене. Отсюда разница в 50 раз между «попал в кэш» и «не попал».

Почему это важно, даже если вы не пользуетесь DeepSeek

За последний год «дешёвый» тир перестал быть тиром для бедных. Gemini Flash, GPT Luna, Claude Haiku, DeepSeek Flash — это уже не урезанные версии, а модели, которые закрывают большинство повседневных задач: переписка, письма, разбор документов, код средней сложности, перевод.

Дорогие флагманы остаются нужны там, где важна долгая цепочка рассуждений: сложный юридический разбор, нетривиальная математика, большая кодовая база, где надо удержать в голове десятки файлов. Но таких задач у обычного пользователя — меньшинство.

Практический вывод простой: не платите флагманскую цену по привычке. Возьмите свою типовую задачу, прогоните её на дешёвой модели и на дорогой, сравните ответы. В половине случаев разницы вы не увидите, а счёт отличается в разы.

Как это выглядит в деньгах

Считать в долларах за миллион токенов неудобно, поэтому переведём в понятное. Миллион токенов — это примерно 700 тысяч слов, около семи томов «Войны и мира». Обычная переписка в чате — это несколько тысяч токенов на вопрос-ответ.

При новых ценах DeepSeek тысяча токенов выхода стоит доли копейки в закупке. Даже с наценкой сервиса это остаётся суммой, при которой считать каждый вопрос бессмысленно — куда важнее не гонять флагманскую модель на задачах, где хватит дешёвой. Как устроен пересчёт токенов в рубли, мы разбирали в статье Токены и кредиты: как устроена оплата.

Что будет дальше

Если заявка подтвердится опубликованными бенчмарками, у остальных лабораторий останется небольшой выбор: либо снижать цены на свои экономичные модели, либо объяснять, за что берут больше. Похожий сюжет уже был в начале 2026-го, когда DeepSeek уронила цены на рассуждающие модели, и за пару месяцев подтянулись все.

Мы следим за релизом. Если V4.1 Flash окажется тем, чем её описывают, она появится в каталоге моделей tenzor — как и остальные модели, доступной из России, на русском и с оплатой рублёвой картой. Сравнить, что уже есть в чате и сколько стоит тысяча токенов у каждой модели, можно в таблице моделей.

Когда выйдет DeepSeek V4.1 Flash?+

Официальный релиз запланирован на 10 сентября 2026 года по пекинскому времени. До этого модель доступна в API под временным тестовым идентификатором.

Она правда лучше V4 Pro?+

Так утверждает сама DeepSeek по результатам внутренних и внешних тестов. Независимых бенчмарков и карточки модели на момент публикации нет, поэтому окончательные выводы делать рано.

Сколько стоит DeepSeek V4.1 Flash?+

С 10 сентября для серии Flash действует тариф $0,15 за миллион входных токенов мимо кэша и $0,60 за миллион выходных в льготные часы; в часы пик — вдвое дороже.

Чем дешёвая модель отличается от флагманской на практике?+

Флагман лучше держит длинную цепочку рассуждений: сложный анализ, большие кодовые базы, нетривиальная математика. На повседневных задачах — письма, переписка, разбор документов, перевод — разница обычно незаметна.

Что дальше почитать

Попробуйте разные модели в чате

Одна и та же задача на дешёвой и на флагманской модели — самый честный способ понять, за что вы платите.

Открыть чат