OpenAI представила GPT-6.1 Sol – оновлену модель сімейства GPT-6, орієнтовану на виконання складних професійних завдань. Модель наближається за можливостями до флагманської GPT-6 Astra, але через API коштує у 5 разів дешевше.

Можливості GPT-6.1 Sol

GPT-6.1 Sol стала помітним оновленням GPT-6 Sol у програмуванні, роботі з документами, керуванні комп’ютером та виконанні багатоетапних бізнес-завдань. При цьому OpenAI позиціонує Astra як продуктивнішу модель для найскладніших сценаріїв.

Покращилася і фактична точність. У тесті OpenAI на складних запитах при низькому рівні міркувань частка відповідей хоча б з однією фактичною помилкою знизилася з 11,4% у GPT-6 Sol до 7,7% у GPT-6.1 Sol, тобто приблизно на 32%. Компанія попереджає, що для випробування спеціально використовувалися запити, здатні провокувати помилки, тому ці показники не відображають частоту галюцинацій при звичайному використанні.

OpenAI також повідомляє, що GPT-6.1 Sol краще дотримується явно заданих обмежень, рідше виконує недозволені дії в агентних сценаріях і точніше повідомляє користувачеві про проблеми з інструментами, що використовуються.

Результати в тестах

У DeepSWE v1.1, який перевіряє роботу ШІ-агентів із реальними кодовими базами, GPT-6.1 Sol показала результат на рівні GPT-6 Astra приблизно за одну п’яту вартості виконання завдання. Порівняно з найкращим результатом GPT-6 Sol перевага склала 6,4 відсоткового пункту при менших витратах і нижчому рівні міркувань.

ТестРезультат GPT-6.1 SolПорівняння
DeepSWE v1.1На рівні GPT-6 AstraПриблизно у 5 разів дешевше
AutomationBench 1.0.6На 2,2 в. п. вище за Claude Opus 5.5Приблизно втричі дешевше
GDP.pdfВище Claude Opus 5.5Менше половини вартості
OSWorld 2.0На 2,1 в. п. нижче за GPT-6 AstraПриблизно у 7 разів дешевше

В AutomationBench 1.0.6 модель на середньому рівні міркувань випередила Claude Opus 5.5 на 2,2 відсоткового пункту приблизно при втричі меншій вартості виконання завдання. Від GPT-6 Sol при тих самих налаштуваннях нова версія відірвалася на 4,8 відсоткового пункту.

У GDP.pdf, де моделі відповідають на запитання щодо складних професійних PDF-документів із таблицями, діаграмами та дрібними деталями, GPT-6.1 Sol перевершила Claude Opus 5.5 із fallback-механізмом при менш ніж половині вартості виконання завдання. До GPT-6 Astra модель також наблизилася, обходячись приблизно вп’ятеро дешевше.

Керування комп’ютером також покращилося. В офлайн-наборі OSWorld 2.0 при максимальному рівні міркувань GPT-6.1 Sol випередила GPT-6 Sol на 7 відсоткових пунктів, а від GPT-6 Astra відстала на 2,1 відсоткового пункту при приблизно семиразово меншій вартості виконання завдання.

При цьому Astra зберігає перевагу в найбільш складних сценаріях. Наприклад, у Terminal-Bench Science 0,1 вона показала найкращий серед протестованих моделей результат 68,1%.

Надшвидкий

Разом із новими інструментами OpenAI представила преміальний режим Ultrafast для прискореного виведення токенів. Зараз він доступний для GPT-6 Astra і забезпечує до восьмиразового прискорення в Codex і до шестиразового через API, залежно від сценарію.

Підтримку GPT-6.1 Sol в Ultrafast поки що не запущено. OpenAI обіцяє додати її найближчими днями. Для Sol компанія заявляє прискорення генерації до восьми разів порівняно зі стандартним режимом у Codex.

Доступність та ціни

GPT-6.1 Sol вже доступна розробникам через OpenAI API під назвою gpt-6.1-sol. Користувачі підписок Plus, Pro, Business, Enterprise та Edu отримали доступ до моделі в ChatGPT Work та Codex. У звичайному режимі Chat модель поки що недоступна.

GitHub також розпочав поетапне розгортання GPT-6.1 Sol у Copilot для передплатників Pro+, Max, Business та Enterprise. Модель можна використовувати у Visual Studio Code, Visual Studio, Copilot CLI, GitHub Copilot coding agent, застосунку Copilot, на github.com, у мобільному застосунку GitHub, JetBrains IDE, Xcode та Eclipse.

Стандартні тарифи OpenAI API становлять:

  • 1 млн вхідних токенів – $2;
  • 1 млн кешованих вхідних токенів – $0,10;
  • 1 млн вихідних токенів – $10.

Таким чином, звичайні вхідні та вихідні токени GPT-6.1 Sol коштують у п’ять разів дешевше, ніж у GPT-6 Astra, а кешовані вхідні дані – на 50% дешевше, ніж у GPT-6 Sol.

Підпишіться на MobiDevices
Telegram