NVIDIA ogłasza 2 października 2026 r., że GPT-6 Astra Ultrafast jest dostępny przez API oraz dla uprawnionych użytkowników ChatGPT Work i Codex. NVIDIA deklaruje, że tryb może generować tokeny do 8× szybciej niż Astra Standard. OpenAI opisuje konfigurację API, domyślne limity i opcje przetwarzania.
GPT-6 Astra Ultrafast: dostęp i deklaracja szybkości
GPT-6 Astra Ultrafast to tryb usługi dla modelu GPT-6 Astra. NVIDIA przypisuje jego działanie procesorom graficznym NVIDIA Blackwell i deklaruje do 8× szybsze generowanie tokenów niż w Astra Standard.
W Work i Codex OpenAI wymienia uprawnione przestrzenie robocze Enterprise i Edu; dostęp z tych przestrzeni wymaga odpowiednich uprawnień i korzysta z ich kredytów. Plan Plus obejmuje zwykły dostęp do Astra w Work i Codex, ale nie do Ultrafast.
Wcześniej opisywaliśmy GPT-6 Astra; nowe ogłoszenie dotyczy dostępu do trybu Ultrafast.
Konfiguracja Ultrafast w API
W żądaniu API ustaw model na gpt-6-astra, a poziom usługi na ultrafast. OpenAI obsługuje żądania HTTP i WebSocket. TPM oznacza liczbę tokenów na minutę; poniższe wartości to domyślne limity według poziomu API.
| Poziom użycia API | Domyślny limit |
| 1–3 | 500 000 tokenów na minutę |
| 4 | 1 000 000 tokenów na minutę |
| 5 | 5 000 000 tokenów na minutę |
Przy aplikacjach agentowych, które często wywołują narzędzia, OpenAI zaleca trwałe połączenia WebSocket. Ograniczają narzut sieciowy, który może zmniejszać korzyść z niższych opóźnień.
Przetwarzanie globalne i rezydencja danych
OpenAI wymienia przetwarzanie globalne oraz rezydencję danych w USA. Dla API nie oferuje regionalnych endpointów przetwarzania w UE ani w innych regionach poza USA. Korzystanie z przetwarzania globalnego jest dostępne również z Polski; brak endpointu regionalnego UE nie stanowi informacji o zakazie dostępu do API.
Demonstracja w Blenderze pokazuje jeden przepływ pracy
Sponsorowana demonstracja pokazuje tworzenie modelu smoka w Blenderze z użyciem GPT-6 Astra Ultrafast. Podany czas to nieco ponad 10 minut na pierwszą wersję i dodatkowe 35 minut na jej dopracowanie. To przykład pojedynczego zadania, a nie porównawczy pomiar szybkości względem Astra Standard.