Рубріки: Новини

В OpenAI пояснили, як вдвічі зекономити гроші при користуванні моделями o3 і o4-mini

Дмитро Сімагін

OpenAI запускає Flex processing — нову опцію API, завдяки якій можна суттєво зекономити на використання моделей штучного інтелекту в обмін на повільний час відгуку та «тимчасову недоступність ресурсів». Про це повідомляє TechCrunch.

Як пояснюють на сайті OpenAI, Flex processing доступна в бета-версії для нещодавно випущених моделей міркувань o3 і o4-mini. Опція спрямована на виконання завдань з нижчим пріоритетом і «невиробничих» завдань, таких як оцінювання моделей, збагачення даних і асинхронні робочі навантаження.

Використання Flex processing зменшує витрати на API рівно вдвічі. Для o3 застосування Flex processing дає остаточну вартість роботи з моделлю на рівні $5/млн вхідних токенів (~750 000 слів) і $20/млн вихідних токенів. Стандартні ціні на використання o3 через API становлять $10/млн вхідних токенів і $40/млн вихідних токенів. Для o4-mini Flex знижує ціну до $0,55/млн вхідних токенів і $2,20/млн вихідних токенів, тоді як стандартна ціна становить $1,10/млн вхідних токенів і $4,40/млн вихідних токенів.

Запуск Flex processing стався в той час, коли конкуренти OpenAI випускають дешевші та ефективніші бюджетні моделі. Буквально вчора, 17 квітня, Google випустила Gemini 2.5 Flash — модель міркування, яка відповідає або перевершує рівню DeepSeek-R1 з точки зору продуктивності за нижчої вартості вхідних токенів.

В електронному листі для клієнтів OpenAI зазначає, що розробники, які хочуть використовувати модель o3 через API, повинні будуть пройти нещодавно введений процес ідентифікації. За словами представників OpenAI, така перевірка призначена для того, щоб зловмисники не порушували політику використання.

Останні статті

CEO Google обіцяє збільшувати штат програмістів, незважаючи на штучний інтелект

Сундар Пічаї, який очолює Google з 2015 року, заявив, що його компанія продовжуватиме збільшувати число…

05.06.2025

«Ринок переповнений пропозиціями з України». Чому українські провайдери здають в оренду власні IPv4-адреси

Українські телекомунікаційні компанії та провайдери масово здають в оренду IPv4-адреси, які свого часу були виділені…

05.06.2025

ChatGPT отримав доступ до хмарних документів та сторонніх дослідницьких інструментів

У ChatGPT додали конектори для підключення до хмарних сервісів, таких як Google Drive, Box, Dropbox,…

05.06.2025

У Запоріжжі затримано 35-річного хакера, який зламав 5000 хостинг-акаунтів для майнінгу криптовалют

Співробітники управління Кіберполіції НПУ в Запорізькій області затримали 35-річного хакера, який зламав 5000 хостинг-акаунтів і…

05.06.2025

Apple відмовляється від розробки на Java, віддаючи перевагу Swift

Внутрішня команда розробників Apple у новому тематичному дослідженні виявила, що «підхід Java до управління пам’яттю…

05.06.2025

Юлія Штукатурова стала новою керівницею європейського регіону в GlobalLogic

Компанія GlobalLogic заявила, що європейський регіон відтепер очолюватиме Юлія Штукатурова, повідомили в DOU. У GlobalLogic Юлія…

04.06.2025