OpenAI представила GPT-6.1 Sol – обновлённую модель семейства GPT-6, ориентированную на выполнение сложных профессиональных задач. Модель приближается по возможностям к флагманской GPT-6 Astra, но через API стоит в 5 раз дешевле.

Возможности GPT-6.1 Sol

GPT-6.1 Sol стала заметным обновлением GPT-6 Sol в программировании, работе с документами, управлении компьютером и выполнении многоэтапных бизнес-задач. При этом OpenAI позиционирует Astra как более производительную модель для наиболее сложных сценариев.

Улучшилась и фактическая точность. В тесте OpenAI на сложных запросах при низком уровне рассуждений доля ответов хотя бы с одной фактической ошибкой снизилась с 11,4% у GPT-6 Sol до 7,7% у GPT-6.1 Sol, то есть примерно на 32%. Компания предупреждает, что для испытания специально использовались запросы, способные провоцировать ошибки, поэтому эти показатели не отражают частоту галлюцинаций при обычном использовании.

OpenAI также сообщает, что GPT-6.1 Sol лучше соблюдает явно заданные ограничения, реже выполняет неразрешённые действия в агентных сценариях и точнее сообщает пользователю о проблемах с используемыми инструментами.

Результаты в тестах

В DeepSWE v1.1, который проверяет работу ИИ-агентов с реальными кодовыми базами, GPT-6.1 Sol показала результат на уровне GPT-6 Astra примерно при одной пятой стоимости выполнения задачи. По сравнению с лучшим результатом GPT-6 Sol преимущество составило 6,4 процентного пункта при меньших затратах и более низком уровне рассуждений.

ТестРезультат GPT-6.1 SolСравнение
DeepSWE v1.1На уровне GPT-6 AstraПримерно в 5 раз дешевле
AutomationBench 1.0.6На 2,2 п.п. выше Claude Opus 5.5Примерно втрое дешевле
GDP.pdfВыше Claude Opus 5.5Менее половины стоимости
OSWorld 2.0На 2,1 п.п. ниже GPT-6 AstraПримерно в 7 раз дешевле

В AutomationBench 1.0.6 модель на среднем уровне рассуждений опередила Claude Opus 5.5 на 2,2 процентного пункта примерно при втрое меньшей стоимости выполнения задачи. От GPT-6 Sol при тех же настройках новая версия оторвалась на 4,8 процентного пункта.

В GDP.pdf, где модели отвечают на вопросы по сложным профессиональным PDF-документам с таблицами, диаграммами и мелкими деталями, GPT-6.1 Sol превзошла Claude Opus 5.5 с fallback-механизмом при менее чем половине стоимости выполнения задачи. До GPT-6 Astra модель также приблизилась, обходясь примерно в пять раз дешевле.

Улучшилось и управление компьютером. В офлайн-наборе OSWorld 2.0 при максимальном уровне рассуждений GPT-6.1 Sol опередила GPT-6 Sol на 7 процентных пунктов, а от GPT-6 Astra отстала на 2,1 процентного пункта при примерно семикратно меньшей стоимости выполнения задачи.

При этом Astra сохраняет преимущество в наиболее сложных сценариях. Например, в Terminal-Bench Science 0.1 она показала лучший среди протестированных моделей результат 68,1%.

Ultrafast

Вместе с новыми инструментами OpenAI представила премиальный режим Ultrafast для ускоренного вывода токенов. Сейчас он доступен для GPT-6 Astra и обеспечивает до восьмикратного ускорения в Codex и до шестикратного через API, в зависимости от сценария.

Поддержка GPT-6.1 Sol в Ultrafast пока не запущена. OpenAI обещает добавить её в ближайшие дни. Для Sol компания заявляет ускорение генерации до восьми раз по сравнению со стандартным режимом в Codex.

Доступность и цены

GPT-6.1 Sol уже доступна разработчикам через OpenAI API под названием gpt-6.1-sol. Пользователи подписок Plus, Pro, Business, Enterprise и Edu получили доступ к модели в ChatGPT Work и Codex. В обычном режиме Chat модель пока недоступна.

GitHub также начал поэтапное развёртывание GPT-6.1 Sol в Copilot для подписчиков Pro+, Max, Business и Enterprise. Модель можно использовать в Visual Studio Code, Visual Studio, Copilot CLI, GitHub Copilot coding agent, приложении Copilot, на github.com, в мобильном приложении GitHub, JetBrains IDE, Xcode и Eclipse.

Стандартные тарифы OpenAI API составляют:

  • 1 млн входных токенов – $2;
  • 1 млн кэшированных входных токенов – $0,10;
  • 1 млн выходных токенов – $10.

Таким образом, обычные входные и выходные токены GPT-6.1 Sol стоят в пять раз дешевле, чем у GPT-6 Astra, а кэшированные входные данные – на 50% дешевле, чем у GPT-6 Sol.

Подпишись на MobiDevices
Telegram