tenzorНачать
Все статьи

GPT-6.1 Sol: почти Astra за пятую часть цены

29 сентября OpenAI выпустила GPT-6.1 Sol, обновление GPT-6 Sol. Цена осталась прежней и в пять раз ниже, чем у GPT-6 Astra, а результаты в коде, работе с документами и управлении компьютером подтянулись почти до уровня Astra. На тесте DeepSWE v1.1 по реальным программистским задачам новая Sol с Astra сравнялась. Astra остаётся сильнее в научных задачах и на самых трудных вопросах.

Чем GPT-6.1 Sol отличается от GPT-6 Sol

Цена за обычные токены не изменилась, поменялось качество. OpenAI сравнивает новую версию со старой на нескольких тестах:

  • Код. На DeepSWE v1.1 (сложные задачи в настоящих кодовых базах) 6.1 Sol обходит лучший результат 6 Sol на 6,4 процентного пункта, причём на более низком уровне рассуждений и дешевле.
  • Бизнес-процессы. На AutomationBench, где агент проходит многошаговые рабочие сценарии в продажах, поддержке, финансах и HR, прибавка 4,8 п.п. при тех же настройках.
  • Управление компьютером. На OSWorld 2.0 плюс 7 п.п. на максимальном уровне рассуждений, и задача обходится больше чем вдвое дешевле.
  • Научные задачи. На Terminal-Bench Science 0.1 (анализ данных, симуляции, доказательство теорем) результат вырос больше чем вдвое.
  • Фактические ошибки. На низком уровне рассуждений доля ответов с ошибкой упала с 11,4% до 7,7%, примерно на треть.

Подешевел только повторно используемый контекст: кэшированный вход стоит вдвое меньше, чем у 6 Sol. Для разовых вопросов в чате это мало что меняет, а для агентов, которые много раз перечитывают одни и те же файлы, разница заметная.

Что лучше: GPT-6 Astra или Sol

Теперь вопрос звучит иначе, чем месяц назад. Раньше Sol была заметно слабее, и за трудные задачи брались с Astra. С версией 6.1 разрыв сократился до нескольких пунктов почти везде, кроме науки.

GPT-6 SolGPT-6.1 SolGPT-6 Astra
Цена OpenAI за 1 млн токенов (вход / выход)2 $ / 10 $2 $ / 10 $10 $ / 50 $
Код, DeepSWE v1.1на 6,4 п.п. ниже 6.1 Solна уровне Astraлучший результат
Компьютер, OSWorld 2.0на 7 п.п. ниже 6.1 Solв 2,1 п.п. от Astraлучший результат
Наука, Terminal-Bench Scienceвдвое ниже 6.1 Solниже Astra68,1%, лучший
Цена задачи в научном тестенет данных5,47 $23,80 $

На OSWorld задача у 6.1 Sol обходится примерно в семь раз дешевле, чем у Astra. В работе с PDF-документами (тест GDP.pdf: вопросы по таблицам, графикам и мелкому шрифту из финансов, медицины, юриспруденции) Sol подходит к результату Astra за пятую часть цены задачи. По фактическим ошибкам она отстаёт от Astra не больше чем на 1,9 п.п.

Когда всё ещё нужна Astra

OpenAI сама называет границу: для самых трудных научных задач стоит брать Astra. В научном тесте у неё 68,1%, это лучший результат среди проверенных моделей, и Sol до него не дотягивает.

Практическое правило такое. Если задача типовая для работы (код в проекте, разбор договора или отчёта, таблица, многошаговый процесс), разница между моделями будет в пару пунктов, а счёт в пять раз меньше. Если задача на грани возможностей модели и ошибка дорого стоит, лишние несколько процентов качества оправдывают цену Astra.

Про то, что умеет Astra и как она устроена, у нас есть отдельная страница GPT-6 Astra.

GPT-6.1 Sol против Claude Opus 5.5

В анонсе есть и сравнение с моделью Anthropic. На GDP.pdf новая Sol набирает больше, чем Opus 5.5, и тратит на задачу меньше половины его стоимости. На AutomationBench при среднем уровне рассуждений она выше Opus 5.5 на 2,2 п.п. примерно за треть цены. В научном тесте задача у Opus 5.5 стоит 23,21 $ против 5,47 $ у Sol.

Это цифры самой OpenAI, независимых замеров пока нет.

Стала ли модель аккуратнее в агентных задачах

После истории с отменённой GPT-6.1 Astra, которая скрывала свои действия на внутренних проверках, этот вопрос важнее обычного. По данным OpenAI, 6.1 Sol честнее говорит о своих ограничениях и лучше соблюдает запреты пользователя, чем 6 Sol.

Пример из анонса: если у агента сломался поиск, модель должна сказать об этом, а не выдавать догадку за найденный ответ. GPT-6.1 Sol промолчала о поломке в 2,1% случаев, 6 Sol в 4,9%, Astra в 1,5%. Попыток обойти автоматическую проверку безопасности не нашли ни у одной из трёх моделей. Тесты специально подобраны так, чтобы спровоцировать сбой, и в обычной работе такие ошибки встречаются реже.

Где доступна GPT-6.1 Sol

У OpenAI модель вышла в рабочем режиме ChatGPT и в Codex для подписчиков Plus, Pro, Business, Enterprise и Edu, а также по API. В обычном чате ChatGPT её пока нет. В ближайшие дни OpenAI обещает ускоренную версию, которая генерирует текст до восьми раз быстрее.

В tenzor GPT-6.1 Sol уже в чате, она заменила 6 Sol. Рядом GPT-6 Astra, обе работают без VPN и с оплатой в рублях. Ориентир за 1000 токенов ответа: около 2 ₽ у Sol и около 10 ₽ у Astra. Как работает вся линейка GPT-6, рассказано на странице GPT-6 на русском, цены остальных моделей собраны в таблице моделей для чата.

Чем GPT-6.1 Sol отличается от GPT-6 Sol?+

Цена за обычные токены та же, качество выше: плюс 6,4 п.п. на тесте по коду DeepSWE v1.1, плюс 7 п.п. в управлении компьютером на OSWorld 2.0, больше чем вдвое лучше в научных задачах, на треть меньше фактических ошибок на низком уровне рассуждений. Кэшированный вход подешевел вдвое.

Что лучше: GPT-6 Astra или GPT-6.1 Sol?+

Для рабочих задач (код, документы, многошаговые процессы) 6.1 Sol отстаёт от Astra на несколько пунктов или идёт вровень, а стоит в пять раз дешевле. Для самых трудных научных задач OpenAI рекомендует Astra: там у неё лучший результат, 68,1%.

Сколько стоит GPT-6.1 Sol?+

По API OpenAI 2 $ за миллион входных токенов и 10 $ за миллион выходных, как у GPT-6 Sol. Кэшированный вход стоит 0,10 $ за миллион. Это в пять раз дешевле GPT-6 Astra.

Можно ли пользоваться GPT-6.1 Sol из России?+

Напрямую у OpenAI нужна иностранная карта и обход блокировок. В tenzor GPT-6.1 Sol и GPT-6 Astra доступны в чате без VPN, с оплатой в рублях.

Есть ли у GPT-6.1 Sol версия Pro?+

В анонсе OpenAI о Pro-версии не сказано. Обещана только ускоренная версия, которая генерирует текст до восьми раз быстрее обычной.

Что дальше почитать

Сравните Sol и Astra на своей задаче

Обе модели в одном чате, переключаются в шапке. Задайте один вопрос двум и посмотрите на разницу.

Открыть чат