OpenAI додала режим Ultrafast для GPT-6.1 Sol і відкрила бету Decisions API
OpenAI запустила режим Ultrafast для GPT-6.1 Sol, який прискорює відповіді до восьми разів, але коштує вшестеро дорожче за стандартний. Окремо відкрито публічну бету Decisions API на базі GPT-6 Luna для швидких простих рішень.
OpenAI розширила набір інструментів для розробників, яким потрібна швидка робота штучного інтелекту. Для моделі GPT-6.1 Sol з’явився режим Ultrafast, що прискорює відповіді до восьми разів, але коштує значно дорожче за стандартну обробку. Одночасно компанія відкрила публічну бету Decisions API — інструменту для швидких простих рішень.
Минулого тижня OpenAI представила GPT-6.1 Sol. За словами компанії, ця модель наближається до рівня GPT-6 Astra в агентному програмуванні, роботі з комп’ютером і професійних завданнях, але коштує вп’ятеро менше. Тепер до неї додали режим Ultrafast, доступний в API, Codex і ChatGPT Work.
Найбільше новий режим допомагає в Codex: він працює до восьми разів швидше, ніж у стандартному режимі. Для розробників це означає менше очікування під час написання коду, пошуку помилок і тестування змін. В API Ultrafast скорочує затримки, з якими агенти виконують робочі процеси. Щоб увімкнути режим, у запиті потрібно вказати service_tier зі значенням ultrafast. OpenAI також радить використовувати постійні WebSocket-з’єднання, які зменшують мережеві накладні витрати й дозволяють отримати від режиму максимум.
Платити за це доведеться істотно більше. Стандартна обробка коштує 2 долари за мільйон вхідних токенів і 10 доларів за мільйон вихідних. Ultrafast із коротким контекстом — від 12 доларів за мільйон вхідних і від 60 доларів за мільйон вихідних. Тобто новий режим вшестеро дорожчий за стандартну обробку.
Якщо Ultrafast пришвидшує складні міркування, то Decisions API заточений під прості рішення, які треба ухвалювати швидко. Інструмент працює на GPT-6 Luna, обробляє текст і зображення та повертає структуровані результати, з якими застосунок може працювати напряму. Це корисно там, де звичайна велика мовна модель підходить гірше.
Наприклад, застосунок підтримки клієнтів має визначити, до якого відділу спрямувати запит: біллінг, технічна підтримка чи доставка. Замість текстової відповіді моделі Decisions API одразу обирає потрібну категорію. Підтримуються три типи рішень: Predicate повертає оцінену ймовірність того, що умова істинна; Choice обирає варіант із заздалегідь заданого набору й дає інформацію про ймовірності; Score оцінює вхідні дані за наперед визначеною рубрикою.
За даними OpenAI, під час ранніх тестів Decisions API працював до 10 разів швидше, ніж аналогічні рішення через Responses API з GPT-6 Luna. Вартість становить 0,10 долара за мільйон вхідних токенів при використанні GPT-6 Luna. За вихідні токени, читання з кешу та запис у кеш окремо не стягують.
Швидкість стає критичним фактором для ШІ-застосунків і агентів, які нерідко мусять ухвалити кілька рішень або виконати кілька дій, перш ніж відповісти на запит. Саме на цих затримках і виникають вузькі місця. Тому OpenAI зробила два кроки: прискорила складні міркування через Ultrafast і винесла прості рішення в окремий інструмент Decisions API.
Цього тижня GPT-6 стала доступною для всіх тарифів ChatGPT. Раніше компанія також повідомляла про результати застосування нової моделі в наукових дослідженнях, зокрема про розв’язання складних математичних задач. Втім, частина науковців ставиться до таких заяв обережно, оскільки OpenAI поки не надала доступу до самої моделі для відтворення результатів.
Нові інструменти орієнтовані насамперед на розробників і компанії, які будують агентні системи. Вони отримують вибір між максимальною швидкістю за вищу ціну та стандартною обробкою, а для простих завдань — окремий механізм ухвалення рішень без повноцінного міркування великої мовної моделі.
6



