OpenAI uruchamia Flex – tańszy tryb API w zamian za wolniejsze działanie

OpenAI uruchamia Flex – tańszy tryb API w zamian za wolniejsze działanie

OpenAI zaprezentowało nową opcję korzystania z modeli sztucznej inteligencji, która pozwala obniżyć koszty obsługi zadań asynchronicznych i testowych. Tryb Flex, dostępny w wersji beta, zapewnia niższe opłaty za przetwarzanie, oferując jednak wolniejszy czas odpowiedzi oraz ryzyko czasowej niedostępności zasobów. Rozwiązanie jest skierowane do projektów, które nie wymagają natychmiastowych rezultatów, np. podczas ewaluacji modeli czy wzbogacania zbiorów danych.

Elastyczne ceny i specyfika korzystania z API

Tryb Flex redukuje koszty użytkowania nawet o połowę w porównaniu do standardowych stawek. Dla modelu o3 ceny wynoszą odpowiednio 5 dolarów zamiast 10 dolarów za milion tokenów na wejściu oraz 20 zamiast 40 dolarów za milion tokenów na wyjściu. Z kolei dla mniejszego modelu o4-mini opłaty spadają z 1,10 do 0,55 dolara za milion tokenów na wejściu oraz z 4,40 do 2,20 dolarów za milion tokenów na wyjściu.

Ze względu na wolniejsze działanie, OpenAI zaleca zwiększenie domyślnych limitów czasowych API do około 15 minut oraz wdrożenie mechanizmów ponawiania zapytań z coraz dłuższymi przerwami. Firma zapewnia, że w przypadku braku zasobów (błąd 429) użytkownicy nie ponoszą dodatkowych kosztów. Jeśli jednak szybkość odpowiedzi jest priorytetem, można łatwo przełączyć się z trybu Flex na standardowy.

Nowe wymagania weryfikacji

Równocześnie z uruchomieniem trybu Flex, OpenAI przypomina, że organizacje korzystające z modeli o3 oraz zaawansowanych funkcji API będą musiały przejść nowy proces weryfikacji tożsamości. Dotyczy to użytkowników z poziomów 1–3, czyli organizacji najaktywniej korzystających z platformy.

Flex jest próbą konkurencyjnej odpowiedzi OpenAI na rosnące ceny modeli AI oraz tańsze propozycje innych firm, takich jak Google czy DeepSeek. Nowy tryb pozwala deweloperom oraz zespołom badawczym efektywniej kontrolować wydatki przy mniej priorytetowych zadaniach, zachowując dostęp do zaawansowanych możliwości modeli reasoningowych.

Avatar
Sie 6, 2025

AMD odnotowuje 14% wzrost przychodów w centrach danych w II kwartale 2025 roku – akcje spadają o 4%

Advanced Micro Devices (AMD) w drugim kwartale 2025 roku osiągnęło przychody w segmencie centrów danych na poziomie 3,2 mld USD, co oznacza wzrost o 14% rok do roku i wynik zgodny z oczekiwaniami analityków. Pomimo wzrostu przychodów akcje spadły o około 4% w handlu posesyjnym, ponieważ inwestorzy liczyli na szybsze tempo rozwoju w obszarze chipów AI i wyższe wyniki w centrach danych.
0
Lip 7, 2025

Microsoft redukuje zatrudnienie o 4% i zamyka biuro w Pakistanie

Microsoft ogłosił, że zwolni około 4% globalnej kadry, czyli blisko 9 000 pracowników. Decyzja jest częścią szerszej strategii optymalizacji kosztów w kontekście rosnących wydatków na rozwój infrastruktury AI
0
Sie 7, 2025

Microsoft planuje zaostrzenie polityki obecności w biurze

Microsoft przygotowuje się do wprowadzenia bardziej rygorystycznych zasad dotyczących obecności pracowników w biurach, – informuje Business Insider. Nowa polityka ma zacząć obowiązywać już od stycznia 2026 roku dla zespołów w siedzibie głównej w Redmond, w stanie Waszyngton. W innych lokalizacjach daty wdrożenia mogą się różnić.
0

Ta strona używa plików cookie, aby zapewnić Ci lepsze wrażenia podczas przeglądania.

Dowiedz się więcej o tym, jak używamy plików cookie i jak zmienić preferencje dotyczące plików cookie w naszej Polityka plików cookie.

Zmień ustawienia
Zapisz Akceptuj wszystkie cookies